Claude, Codex, Gemini 같이 써보니...
Gemini가 환각이 심각하네요...
미묘하게 환각을 잘 일으킵니다.
일전에도 이런이런 식으로 사용한다고 이야기를 했었는데
Codex나 Claude가 Gemini가 생성한 환각을 잡아내거 폐기 시키고 재설계하고 하는 과정이 빈번하게 발생하네요..

위 비슷한 내용들이 어쩌다가 한번씩 살펴보는데도
종종 보입니다.
안보던 곳에서는 얼마나 했을지;;;;
결론은 Gemini를 끼워넣으니 이놈이 개발에서 빌런 역할을 해서
개발을 지연시키고 다른 에이전트의 일거리를 더 만들어내는 역할을 하고 있었네요..
아 이거참....;;;
AI도 빌런이 존재하다니..
참 웃프네요..
총 2명이 반응했습니다
|
댓글을 작성하시려면 로그인이 필요합니다.
댓글 8개
Gemini, 지구상에서 그렇게 센 뽕을 주입하고 환각을 보는 게 정상은 아니에요.
ㅎㅎㅎ
요즘 ai가 완전 인간같다니까요..
사람의 글을 보고 학습해서 거짓말하고 잡아떼는 것도 인간같고
잘 웃고 갑니다.
환각에 경우.
계속 junNaGe 갈궈서 인지시켜주면 담 부터는 자제하는쪽으로 갑니다.
(제미나이 뿐만 아니라 gpt도 환각증상 많아요.)
추가로.
개인 인텔리전스 > Gemini 요청 사항
에 환각 부분을 정확히 인지시켜주면 환각 확률은 많이 줄어듭니다.
gemini 3.8 flash 가 금일 출시 되었네요.
다른 모델들은 계속 좋아지는데, gemini 가 업데이트가 없다가 최근에 업데이트가 자주 되고 있습니다. 3.7 -> 3.8 flash 로 넘어가는데 3주 밖에 안 걸렸네요.
그록봇(grok cli 4.6)을 자주 쓰는데, 그록봇이 frontend 디자인을 정말 못합니다. 처음부터 시키면 거의 사용 못할 수준으로 나오네요.
그래서 gemini 3.8 flash 를 디자인과 프론트 엔드 작업을 시키고, 나머지 기획/검토/백엔드/PM 은 그록봇 맡겨서 한번 작업해볼려고 합니다.
AI 모델별로 시켜보고 잘하는 일을 시키는게 맞는것 같습니다.
이방법도 어제가 다르고, 오늘이 다르고, 내일이 다르다는게 문제네요. 매번 테스트를 해봐야 하니..
AI 모델을 골라서 잘 쓰는게 기술인데, 쉽지 않네요.
추측하지 않고라고 답을 하는데 추측이더라~
지가 추측안하고 답하면 모두 맞아야 정상이지.