claude opus 4.8에 비비는데 가격은 저렴한 그록4.5
https://youtu.be/-QXatqQAO2s?si=iN8Ffc1fYTV0gzoW
주요 내용 요약:
Grok 4.5 개요: 7월 8일(한국 시간 7월 9일) 공개된 모델로, 코딩 에이전트인 커서(Cursor)를 인수한 후 축적된 데이터를 활용해 학습되어 코딩 능력과 에이전트 작업 수행 능력이 크게 향상되었습니다(0:14 - 1:08).
벤치마크 및 성능: 다양한 소프트웨어 엔지니어링 벤치마크에서 기존의 주요 모델들(Claude, GPT 계열 등)과 경쟁하는 높은 수준의 성능을 보여주며, 특히 토큰 효율성이 좋아 빠르고 비용이 저렴하다는 장점이 있습니다(1:35 - 3:19).
가격: API 기준 입력 100만 토큰당 2달러, 출력 6달러로 매우 경제적입니다(3:20 - 3:39).
테스트 결과: 총 16개의 문제(코딩, 수학, 비전 추론 등)를 테스트한 결과, 모든 문제를 맞히며 만점(100점)을 기록했습니다. 특히 복잡한 코딩이나 비전 추론에서도 매우 뛰어난 정확도를 보였습니다(6:11 - 10:21).
결론: 구글의 Gemini 등 경쟁 모델들을 빠르게 추격하고 있으며, 특히 엔지니어링 및 코딩 업무 활용도가 매우 높은 모델로 평가됩니다(4:13 - 4:55, 11:16 - 11:49).
커서 인수는 잘 한 선택인 것 같네요, 가장 약점을 보완했으니..!
주요 내용 요약:
Grok 4.5 개요: 7월 8일(한국 시간 7월 9일) 공개된 모델로, 코딩 에이전트인 커서(Cursor)를 인수한 후 축적된 데이터를 활용해 학습되어 코딩 능력과 에이전트 작업 수행 능력이 크게 향상되었습니다(0:14 - 1:08).
벤치마크 및 성능: 다양한 소프트웨어 엔지니어링 벤치마크에서 기존의 주요 모델들(Claude, GPT 계열 등)과 경쟁하는 높은 수준의 성능을 보여주며, 특히 토큰 효율성이 좋아 빠르고 비용이 저렴하다는 장점이 있습니다(1:35 - 3:19).
가격: API 기준 입력 100만 토큰당 2달러, 출력 6달러로 매우 경제적입니다(3:20 - 3:39).
테스트 결과: 총 16개의 문제(코딩, 수학, 비전 추론 등)를 테스트한 결과, 모든 문제를 맞히며 만점(100점)을 기록했습니다. 특히 복잡한 코딩이나 비전 추론에서도 매우 뛰어난 정확도를 보였습니다(6:11 - 10:21).
결론: 구글의 Gemini 등 경쟁 모델들을 빠르게 추격하고 있으며, 특히 엔지니어링 및 코딩 업무 활용도가 매우 높은 모델로 평가됩니다(4:13 - 4:55, 11:16 - 11:49).
커서 인수는 잘 한 선택인 것 같네요, 가장 약점을 보완했으니..!
총 1명이 반응했습니다
|
댓글을 작성하시려면 로그인이 필요합니다.
댓글 3개
멋지네요. 유용한 정보 고맙습니다.
USA가 AI 대국이네요. 우리나라는 뭐하나~~~
반도체만 만들지 말고 똑똑한 AI 좀 만들어요~
fable 5를 능가하는 모델 빨리 나와서 콧대를 좀 꺽어줬으면 좋겠네요.
돈 먹는 하마를 잡아줘~~~~~~~~
최근에 깜짝 놀랐어요
이미지를 그려주는데 자유도가 높은건지?
다른 AI 에서는 프롬프트 바꾸라고 허단데 여기서는 그냥 ㅇㅇㅇ 이미지를 그려줘서
안보고? 바로 지웠네요
암튼 그록도 좋아지고 있다니 기쁜 소속이네요
다양한 AI 를 사용할수 있다는건 사용자에게는 좋은 일이지요