Cardnews Brief
Sonnet 5.5와 Sol 6.1은 벌써 나왔고 이제는 Gemini 4를 기다립니다
Anthropic이 9월 28일 Claude Sonnet 5.5를 공개했고 OpenAI는 29일 GPT-6.1 Sol을 내놨습니다. Opus 5.5 소식을 전한 지 얼마 되지도 않았는데 벌써 다음 모델들을 고를 차례입니다. 모델이 자주 나오는 건 반가운데 하나씩 써보고 판단할 시간은 점점 짧아지는 것 같습니다.
Anthropic은 Sonnet 5.5의 출력 속도가 전작보다 30% 이상 빨라졌다고 소개했습니다. 유리병 안의 배를 직접 조종하는 작품을 만든 사람도 있습니다. 다만 주인장이 둘러본 쪽에서는 Opus 때처럼 제작 후기가 쏟아지는 느낌은 아직 덜합니다. 다들 프론티어급 모델에 주목하느라 바쁜가 봅니다.
Sol 6.1은 Artificial Analysis의 종합평가에서 최고 추론 설정으로 Astra와 거의 같은 점수를 받으면서 과제당 비용은 4분의 1도 들지 않았습니다. 개발자 커뮤니티에서도 사용 한도가 거의 닳지 않는다는 후기가 나옵니다. 대신 최근에는 너무 느리다는 불만도 함께 올라오는데 다들 싸다고 몰려가서 쓰는 건가 싶을 정도입니다. Sonnet은 빨라서 주목받았는데 Sol은 반대 이유로 속도가 화제입니다.
주인장 생각에는 지금은 Opus 5.5를 메인 지시자로 두고 실제 작업을 처리하는 워커에는 Sol 6.1을 쓰는 조합이 가장 괜찮아 보입니다. 어려운 문제가 나오면 Astra에게 맡기고요. 원래도 그랬지만 이제는 일에 맞는 모델과 추론 강도(effort)를 고르고 일을 잘 나눠주면 시너지가 엄청날 것 같습니다. 언젠가는 모델과 effort를 고르는 일도 AI가 알아서 해주겠지요. 아니면 아예 고를 필요가 없어지는 시대가 와도 좋겠습니다(AGI).
9월 30일에는 Google도 Gemini 4 Argon을 발표했습니다. 아직 일부 대상에게만 풀렸고 일반 사용자는 기다려야 하지만 공개된 평가 결과부터 기대할 만합니다. Artificial Analysis의 종합평가에서는 Astra와 동점이고 업무 능력을 평가하는 Vals Index에서는 1위에 올랐습니다. 이제 구글도 제대로 달리기 시작하는 걸까요. 잠자던 사자가 몸을 풀기 시작한 것 같아 직접 써볼 날이 기다려집니다.
Grok과 Meta의 Muse도 좋다는 평가가 나오는 걸 보면 다시 3파전이라고 했다가 4파전과 5파전까지 세어야 할지도 모르겠습니다. 주인장은 AI가 이렇게 발전하는 시대에 살고 있다는 게 참 재미있습니다. 달리기 경주를 보는 기분인데 그 달리기가 인류에게 유익하다는 점까지 좋습니다. 누가 이길지 궁금해하면서도 잘 달리는 선수가 더 늘어나길 바라게 됩니다.
다만 새 모델을 반기고 나면 얼마 뒤에는 출시 때보다 지능이 떨어졌다는 이른바 '너프' 논란을 또 보게 되는 건 참 곤란합니다. 매일 쓰는 입장에서 성능이 들쑥날쑥하게 느껴지면 어느 모델에 일을 맡길지도 다시 고민하게 됩니다. 하드웨어도 같이 발전해서 좋은 모델을 빠르고 꾸준하게 쓸 수 있었으면 합니다.