AI · 글로벌

Anthropic의 Opus 5, Fable 5 및 GPT-5.6 Sol 비교

Anthropic의 Claude Opus 5가 ARC-AGI-3 벤치마크에서 30.2%를 기록하며, 이전 기록인 GPT-5.6 Sol의 7.8%를 거의 4배 초과했다. 벤치마크 개발자들은 Opus 5가 독립적으로 반영을 형성했다고 전했다. 이 결과는 AI 모델의 실제 지능을 측정하기 위한 기준으로 사용된다.

출처 1개해외단일 출처단일 출처
출처 1곳 자세히 보기
  • Anthropic의 Opus 5가 Fable 5와 GPT-5.6 Sol을 초과하는 성능을 보였음을 보도함

주장

단일 출처가 제기한, 교차 확인 전 주장

Opus 5가 독립적으로 반영을 형성했다고 벤치마크 개발자들이 전함 — The Decoder

Anthropic의 Claude Opus 5, ARC-AGI-3 벤치마크에서 30.2% 기록 — The Decoder

GPT-5.6 Sol, 이전 기록 7.8%로 확인 — The Decoder

빠진 관점

아직 확인되지 않았거나 보도에서 빠진 관점

Opus 5와 Fable 5의 개발 배경 및 목표 미제공

출처 원문

The Decoder ↗

여러 공개 출처를 교차검증해 종합·정리한 이슈 카드입니다. 자세한 내용은 원문을, 정정·삭제 요청은 권리침해 신고로 보내주세요.

이런 정리를 매일 아침 메일로

댓글

    회원 없이도 댓글 작성 가능 · 작성자 책임 · 권리침해 시 즉시 임시조치