ai
brief
← 피드로 돌아가기
AI

Anthropic, Claude Sonnet 4.5 출시 — 코딩·에이전트 SWE-bench 77.2% 달성

An

Anthropic 공식 블로그

2025년 9월 29일

Anthropic이 2025년 9월 29일 **Claude Sonnet 4.5**를 공개했습니다. 코딩, 에이전트, 컴퓨터 사용(Computer Use) 능력에서 Claude 4 패밀리 내 최고 수준의 성능을 기록했습니다.

SWE-bench Verified에서 **77.2%**를 달성하며 GPT-5 Codex(74.5%)를 앞섰습니다. 또한 단일 작업에서 **30시간 이상** 지속 실행하는 장기 에이전트 능력을 입증했습니다.

주요 벤치마크

  • SWE-bench Verified: 77.2% (업계 최고)
  • 30시간 이상 복잡한 에이전트 작업 지속 수행
  • GPT-5 Codex 대비 코딩 성능 우위

큐레이터 노트

  • Claude Agent SDK: 메모리·권한·서브에이전트 조율 도구
  • Claude Code 체크포인트: 작업 저장·롤백 기능
  • VS Code 네이티브 확장 출시
#Claude Sonnet 4.5#SWE-bench#코딩AI#에이전트SDK

출처

Anthropic 공식 블로그

https://www.anthropic.com/news/claude-sonnet-4-5

원문 보기 →

같이 볼만한 기사

AI 인용이란: AI가 내 콘텐츠를 출처로 선택하는 기준

오픈애즈·2주 전

AI 에이전트 검색이란: AI가 직접 검색·비교·구매하는 시대

오픈애즈·2주 전

오픈AI, 칸 라이언즈 첫 참가 — 챗GPT 광고 비즈니스·코덱스 공개로 광고 시장 본격 진출

AI타임스·1개월 전

Anthropic, 구글 출신 AI 연구자 2명 영입 — 인재 유출 가속화

TechCrunch AI·1개월 전