출처

요약

원문 URL: https://aisparkup.com/posts/14635

Hermes CLI 요약 생성에 실패하여 원문 앞부분 기반의 임시 요약을 저장합니다.

원문 발췌

2년 전만 해도 오픈 웨이트 모델과 폐쇄형 모델 사이의 성능 격차는 8%가 넘었습니다. 지금은 영역에 따라 거의 사라진 곳도, 다시 벌어진 곳도 있죠. 그런데 정작 요즘 개발자들 사이에서 오가는 진짜 승부는 모델 성능이 아닌 다른 곳에서 갈리고 있습니다. – Mozilla 격차는 좁혀졌는데, 왜 아직 다들 못 쓰고 있나 수치부터 보죠. 오픈-폐쇄 모델의 성능 격차는 2024년 초 8.04%에서 2024년 8월 0.5%까지 좁혀졌습니다. 2025년 2월엔 DeepSeek-R1이 잠깐 최상위 모델을 따라잡기도 했습니다. 지금은 3.3%로 다시 벌어졌지만, 이건 평균값일 뿐입니다. 코딩이나 일반 지식 영역에서는 이미 동률에 가깝고, 격차는 추론과 장문 맥락 처리 같은 특정 영역에 몰려 있습니다. 추론 비용도 극적으로 떨어졌습니다. GPT-4급 성능을 내는 데 드는 비용이 36개월 만에 100만 토큰당 20달러에서 0.40달러로, 40분의 1 수준까지 낮아졌습니다. 실제로 지금 오픈라우터(OpenRouter)에서 오간 토큰의 절반 이상이 오픈 웨이트 모델을 거칩니다. 사용량 상위 5개 모델이 전부 오픈모델일 정도죠. 그런데 여기서 의문이 하나 생깁니다. 성능도 비슷하고 값도 싼데, 왜 다들 여전히 폐쇄형 모델에 기대는 걸까요. Mozilla가 개발자 1,400여 명을 설문한 결과가 답을 줍니다. AI 기능을 새로 넣는 개발자 중 오픈모델을 쓰는 비율은 79%로, 폐쇄형(71%)보다 오히려 높죠. 그런데 이 프로젝트가 실제 서비스로 나가는 비율은 정반대입니다. 오픈모델 팀은 51%만 프로덕션에 도달합니다. 폐쇄형 모델 팀은 63%까지 갑니다. 성능 문제가 아니라는 게 이 조사의 결론입니다. 인프라 비용, 유지보수, 배포 복잡도 같은 운영상의 걸림돌이 발목…

관련 위키

원문 보존 위치

원문 전체는 2026-07-22-aisparkup-post-14635-aisource_url 및 HTML 원문과 함께 저장되어 있습니다.