Claude Opus 5 금쪽이 모드, Anthropic은 왜 말 안 듣는 AI를 만들었을까
Anthropic이 Claude Opus 5를 공개했습니다. Fable 5에 가까운 성능을 절반 수준의 가격으로 제공하지만, 사용자의 지시에 반대하고 작업 범위를 스스로 판단하는 새로운 성향도 나타나고 있습니다. 최근 Kiro 에이전트에서 겪은 지시 무시 경험과 함께…
Anthropic이 Claude Opus 5를 공개했습니다. Fable 5에 가까운 성능을 절반 수준의 가격으로 제공하지만, 사용자의 지시에 반대하고 작업 범위를 스스로 판단하는 새로운 성향도 나타나고 있습니다. 최근 Kiro 에이전트에서 겪은 지시 무시 경험과 함께…
AWS Kiro 에이전트에서 Claude Opus 4.8과 GPT-5.6 Sol을 사용해 며칠 동안 신규 기능을 개발했습니다. 작업이 모두 끝난 줄 알았지만, Git 히스토리를 확인해보니 에이전트가 요구사항을 임의로 해석하고 핵심 구조까지 바꿔놓은 상태였습니다. AI…
GPT-5.6보다 중요한 변화는 무엇일까요? Codex가 ChatGPT 안으로 들어오면서 개발자 생태계가 어떻게 바뀔지 분석합니다. Appshots와 Computer Use의 등장도 함께 살펴봅니다.
A closer look at Codex Desktop, Computer Use / CUA background processes, and possible clues behind faster weekly usage exhaustion.
OpenAI Codex 사용량 한도 이슈와 Weekly Limit 소진 논란, 사용자 제보, 공식 인시던트 이후 남은 불확실성을 정리했습니다.
Meta의 Claudeonomics 사례를 통해 AI 토큰 사용량을 생산성 지표로 보는 위험과 tokenmaxxing 문화의 문제를 짚어봅니다.
Claude Sonnet 5의 가격, 벤치마크, 에이전트 성능을 Opus 4.8과 비교해 실제 대체 가능성과 비용 의미를 정리했습니다.
DeepReinforce Ornith-1.0의 Self-Scaffolding RL, 모델 라인업, 벤치마크 의미와 한계를 코딩 AI 관점에서 정리합니다.
검색 결과가 없습니다.