다시 살아난 메타
1조였나 주고 데려온 수석 연구원 덕분인지, 나날로 메타의 llm 모델 성능이 좋아지네요.
뮤즈 스파크1.2에서 성능이 대폭 향상된 뮤즈 스파크1.3은 백만 토큰당 입력1.25불 출력 4.5불 정도로 매우 저렴한데(chatgpt5.6-sol max와 동일하다네요), 캐시 히트는 88%나 할인해줘서(장기 작업 시 chatgpt보다 오히려 더 저렴해지는 효과) 체감 비용이 매우 낮다고 합니다. 이렇게 저렴한데도 불구하고 뮤즈 스파크1.3 xhigh이 opus5 max와 동급이라고 합니다, 특히 터미널 벤치나 DeepSWE 성능은 opus5, chatgpt5.6-sol max를 상회한다고 합니다. 캐시 할인이 엄청나서 오픈 클로 같은 24시간 에이전트 부리기에도 딱 좋아보이네요.
(데이터 제공 동의 시 100만 토큰당 입력 $0.10, 출력 $0.20라 합니다)
오픈코드에서 무료로 뮤즈 스파크 모델을 사용할 수 있어서 사용해보는데 상당히 답변도 빠르고, 품질도 뮤즈 스파크1.2에서 더 좋아진게 눈에 띕니다.
많이 사용해보지는 못해서 완전 신뢰까지는 못하겠으나 opus5 중간 옵션 이상 만족도는 확실한 것 같습니다.
좀 더 찾아보니,안타까운점은 이 프로젝트를 이끌었던 수석 연구원이 뮤즈 스파크1.3이 공개됨과 동시에 퇴사했다네요.(의리로 공개 전까지 있었다고..) 천재는 어디에 정착하기 힘든가 봅니다
뮤즈 스파크1.2에서 성능이 대폭 향상된 뮤즈 스파크1.3은 백만 토큰당 입력1.25불 출력 4.5불 정도로 매우 저렴한데(chatgpt5.6-sol max와 동일하다네요), 캐시 히트는 88%나 할인해줘서(장기 작업 시 chatgpt보다 오히려 더 저렴해지는 효과) 체감 비용이 매우 낮다고 합니다. 이렇게 저렴한데도 불구하고 뮤즈 스파크1.3 xhigh이 opus5 max와 동급이라고 합니다, 특히 터미널 벤치나 DeepSWE 성능은 opus5, chatgpt5.6-sol max를 상회한다고 합니다. 캐시 할인이 엄청나서 오픈 클로 같은 24시간 에이전트 부리기에도 딱 좋아보이네요.
(데이터 제공 동의 시 100만 토큰당 입력 $0.10, 출력 $0.20라 합니다)
오픈코드에서 무료로 뮤즈 스파크 모델을 사용할 수 있어서 사용해보는데 상당히 답변도 빠르고, 품질도 뮤즈 스파크1.2에서 더 좋아진게 눈에 띕니다.
많이 사용해보지는 못해서 완전 신뢰까지는 못하겠으나 opus5 중간 옵션 이상 만족도는 확실한 것 같습니다.
좀 더 찾아보니,안타까운점은 이 프로젝트를 이끌었던 수석 연구원이 뮤즈 스파크1.3이 공개됨과 동시에 퇴사했다네요.(의리로 공개 전까지 있었다고..) 천재는 어디에 정착하기 힘든가 봅니다
|
댓글을 작성하시려면 로그인이 필요합니다.
댓글 2개