Docs | Src |  A-  |  A*  |  A+  | -/-

Metadata
sourcehttps://www.anthropic.com/news/claude-opus-4-8
created2026-06-02
byopenai:gpt-5.4
style번호식
# (요약) Introducing Claude Opus 4.8 1. Anthropic이 Claude Opus를 새 버전인 Claude Opus 4.8로 업그레이드함. 2. Claude Opus 4.8은 Opus 4.7을 기반으로 벤치마크 전반에서 개선되었음. 3. Claude Opus 4.8은 더 효과적인 협업자(collaborator)로 소개됨. 4. Claude Opus 4.8은 오늘부터 동일한 가격으로 제공됨. 5. Opus 4.8은 여러 신규 기능과 함께 출시됨. 6. claude.ai 사용자는 이제 Claude가 작업에 투입하는 노력의 양을 제어할 수 있음. 7. Claude Code에는 매우 대규모 문제를 다룰 수 있게 하는 새로운 `dynamic workflows` 기능이 추가됨. 8. Opus 4.8의 fast mode는 모델이 2.5배 속도로 작업할 수 있는 모드임. 9. Opus 4.8의 fast mode 가격은 이전 모델들보다 3배 저렴해짐. ## Opus 4.8의 역량 10. 아래 표는 Opus 4.8이 이전 버전 및 다른 모델들과 비교해 코딩, 에이전트형(agentic) 기술, 추론, 실용적 지식 작업 테스트에서 어떻게 평가되는지 보여줌. 11. 더 자세한 내용과 더 폭넓은 역량 평가는 [Claude Opus 4.8 System Card](https://www.anthropic.com/claude-opus-4-8-system-card)에 제공됨. ## Opus 4.8과의 협업 12. 초기 테스터들은 Claude Opus 4.8이 에이전트형 작업을 수행할 때 더 신뢰할 수 있고 판단력이 더 예리하다고 평가했음. 13. 본문 아래에는 이들 테스터가 Opus 4.8과 협업한 경험에 대한 여러 인용문이 제시됨. 14. Opus 4.8의 가장 두드러진 개선점 중 하나는 정직성(honesty)임. 15. Anthropic은 모든 모델이 정직하도록 훈련함. 16. 예를 들어 모델이 뒷받침할 수 없는 주장을 피하도록 훈련함. 17. 그러나 AI 모델의 일반적인 문제는 근거가 약한데도 작업에서 진전을 이뤘다고 자신 있게 결론을 서두르는 경우가 있다는 점임. 18. 초기 테스터들은 Opus 4.8이 자신의 작업에 대한 불확실성을 더 자주 표시하고, 근거 없는 주장을 덜 한다고 보고했음. 19. 이러한 평가는 [자체 평가](https://www.anthropic.com/claude-opus-4-8-system-card)로도 뒷받침됨. 20. 해당 평가에 따르면 Opus 4.8은 이전 버전보다 자신이 작성한 코드의 결함을 언급 없이 넘길 가능성이 약 4배 낮음. 21. Anthropic은 늘 그래왔듯 출시 전 모델에 대한 상세한 정렬(alignment) 평가를 수행했음. 22. 긍정적 특성 측면에서 Alignment 팀은 Opus 4.8이 “사용자 자율성 지원과 사용자의 최선의 이익에 따라 행동하는 것과 같은 친사회적 특성 측정에서 새로운 최고치를 기록했다”고 결론내렸음. 23. 이 평가는 Opus 4.8의 비정렬 행동률도 보여주었음. 24. 비정렬 행동의 예로는 기만(deception)이나 오용 협조(cooperation with misuse)가 있음. 25. 이러한 비정렬 행동률은 Opus 4.7보다 상당히 낮았음. 26. 이러한 수치는 최고 수준으로 정렬된 모델인 Claude Mythos Preview와 유사했음. 27. 전체 정렬 평가는 배포 전 안전성 테스트 모음과 함께 Claude Opus 4.8 System Card에 보고됨. ## 오늘 함께 출시되는 사항 28. Claude Opus 4.8 외에도 여러 업데이트가 함께 제공됨. 29. `Dynamic workflows`는 연구 프리뷰(research preview)로 제공되는 새 기능임. 30. 이 기능은 Claude Code에서 Claude가 더 큰 작업을 맡을 수 있게 함. 31. Claude는 작업을 계획한 뒤 단일 세션에서 수백 개의 병렬 하위 에이전트(subagents)를 실행할 수 있음. 32. Opus 4.8에서는 이 에이전트들이 더 오랫동안 실행될 수 있음. 33. Claude는 사용자에게 보고하기 전에 자신의 출력 결과를 검증함. 34. 예를 들어 Opus 4.8이 탑재된 Claude Code는 이제 수십만 줄의 코드에 걸친 코드베이스 규모 마이그레이션을 시작부터 병합(merge)까지 수행할 수 있음. 35. 이 과정에서 기존 테스트 스위트가 기준점(bar)으로 사용됨. 36. Dynamic workflows에 대한 자세한 내용은 Claude Code의 Enterprise, Team, Max 요금제에서 제공되는 [이 글](https://claude.com/blog/introducing-dynamic-workflows-in-claude-code)에서 확인할 수 있음. 37. [claude.ai](http://claude.ai/redirect/website.v1.951b02db-206e-4e88-b90a-1130a529bd33)와 Cowork에는 노력 제어(effort control) 기능이 추가됨. 38. 모델 선택기 옆의 새로운 제어 장치로 사용자는 Claude가 응답에 얼마나 많은 노력을 들일지 선택할 수 있음. 39. 더 높은 노력 설정에서는 Claude가 더 자주, 더 깊이 생각하여 더 나은 응답을 제공함. 40. 더 낮은 노력 설정에서는 Claude가 더 빠르게 응답하고 사용자의 rate limit를 더 천천히 소모함. 41. 이 노력 제어 기능은 모든 요금제에서 사용할 수 있음. 42. Messages API는 이제 messages 배열 내부의 system 엔트리를 허용함. 43. 개발자는 프롬프트 캐시를 깨뜨리거나 사용자 턴을 통해 업데이트를 우회하지 않고도 작업 중간에 Claude의 지시를 갱신할 수 있음. 44. 이는 특정 하니스(harness)에서 에이전트가 실행되는 동안 권한, 토큰 예산, 환경 맥락을 갱신하는 데 사용할 수 있음. ## 노력(effort)에 대한 설명 45. Opus 4.8의 기본값은 high effort임. 46. Anthropic은 이것이 품질과 사용자 경험 사이에서 전반적으로 가장 좋은 균형이라고 판단함. 47. 코딩 작업에서 이 노력 수준은 Opus 4.7의 기본값과 비슷한 수의 토큰을 사용함. 48. 그러나 성능은 더 우수함. 49. 사용자는 `extra` 또는 `max`를 선택할 수 있음. 50. Claude Code에서는 `extra`가 `xhigh`로 표기됨. 51. 이 설정에서는 모델이 더 나은 결과를 얻기 위해 더 많은 토큰을 사용함. 52. Anthropic은 어려운 작업과 오래 실행되는 비동기 워크플로에는 `extra` 사용을 권장함. 53. 더 높은 노력 수준의 더 높은 토큰 사용량을 수용하기 위해 Claude Code의 rate limit가 상향됨. 54. 사용자는 각자의 프로젝트에 맞는 설정을 선택할 수 있음. ## 다음 계획 55. 사용자는 Opus 4.8이 이전 버전에 비해 크지는 않지만 체감 가능한 개선임을 느낄 것이라고 설명됨. 56. 다만 아직 할 일은 더 남아 있음. 57. Anthropic은 Opus와 유사한 역량을 더 낮은 비용으로 제공하는 모델을 개발하고 출시하기 위해 작업 중임. 58. Anthropic은 Opus보다 더 높은 지능을 지닌 새로운 모델 계열도 출시할 계획임. 59. [Project Glasswing](https://www.anthropic.com/research/glasswing-initial-update)의 일환으로 현재 소수의 조직이 사이버보안 작업에 Claude Mythos Preview를 사용 중임. 60. 이 수준의 역량을 가진 모델은 일반 공개 전에 더 강력한 사이버 안전장치가 필요함. 61. Anthropic은 이러한 안전장치 개발에서 빠르게 진전하고 있음. 62. 향후 몇 주 안에 Mythos급 모델을 모든 고객에게 제공할 수 있을 것으로 기대함. ## 제공 범위 63. Claude Opus 4.8은 오늘부터 모든 곳에서 사용 가능함. 64. 일반 사용 요금은 Opus 4.7과 동일하게 유지됨. 65. 일반 사용 입력 토큰 가격은 백만 토큰당 5달러임. 66. 일반 사용 출력 토큰 가격은 백만 토큰당 25달러임. 67. Fast mode 입력 토큰 가격은 백만 토큰당 10달러임. 68. Fast mode 출력 토큰 가격은 백만 토큰당 50달러임. 69. 개발자는 [Claude API](https://platform.claude.com/docs/en/about-claude/models/overview)를 통해 `claude-opus-4-8`을 사용할 수 있음. #### 각주 70. **Terminal-Bench 2.1:** 모든 모델의 점수는 Terminus-2 공개 하니스(public harness)를 사용해 보고되었음. 71. GPT-5.5의 Codex CLI 하니스 사용 보고 점수는 83.4%임. 72. **OSWorld-Verified:** 실제 환경에서의 모델 성능을 더 정확히 반영하기 위해 OSWorld-Verified 평가 실행 방식이 변경되었음. 73. 이에 따라 Opus 4.7 점수는 82.3%로 갱신되었음. 74. 관련 업데이트의 자세한 내용은 [System Card](https://www.anthropic.com/claude-opus-4-8-system-card)에서 확인할 수 있음. 75. **Finance Agent v2:** Gemini 3.5 Flash는 Finance Agent v2에서 57.9%를 기록했음. 76. 이는 Gemini 3.1 Pro 대비 유의미한 개선임.