목록2026/07 (3)
꿈 많은 사람의 이야기
Anthropic이 Claude Opus 5를 공개했습니다. 좋은 성능을 싼값에 쓸 수 있게 만든 모델이라는 특징이 두드러집니다.그리고 같은 날 올라온 글이 하나 더 있습니다. Anthropic 기술 스태프 Thariq Shihipar가 쓴 "The new rules of context engineering for Claude 5 generation models"인데요. 이 글에서는 Opus 5와 Fable 5 같은 모델을 위해 Claude Code 시스템 프롬프트의 80퍼센트 이상을 제거했고 자사 코딩 평가에서 측정 가능한 손실이 없었다는 겁니다. 벤치마크 차트보다 이쪽이 실무자에게 더 중요할 것 같고 저도 이 글을 좀 더 관심있게 봤습니다. 클로드 모델 중 Opus 5의 라인업 앤트로픽의 클로드 모..
이 논문은 제목부터가 좀 놀랍다. "왜 모든 LLM은 일본 문화에 집착하는가"라는 물음은 이 논문이 실제로 발견한 현상을 그대로 옮긴 것이다. 지금까지 언어모델의 문화 편향을 다룬 연구들은 대체로 "LLM은 서구, 특히 미국과 유럽 쪽으로 기운다"는 결론을 반복해 왔다. 그런데 이 논문은 지역 정보를 일부러 지운 상태에서 모델에게 문화 질문을 던지고 스스로 장소를 고르게 했더니, 여덟 개의 최신 모델 대부분이 미국보다 오히려 일본을 가장 자주 떠올린다는 사실을 확인했다. 기존 통념을 정면으로 뒤집는 결과다.저자들은 여기서 멈추지 않고 두 가지를 더 파고든다. 하나는 입력 언어가 이 편향을 어떻게 바꾸는지, 다른 하나는 이 편향이 모델 학습의 어느 단계에서 생겨나는지다. 결론부터 말하면, 편향은 사전학습(..
포스팅 개요본 포스팅은 AI 에이전트 상호운용(interoperability) 프로토콜을 다룬 논문 Governance Gaps in Agent Interoperability Protocols: What MCP, A2A, and ACP Cannot Express를 리뷰한 글입니다. 2026년 6월에 공개된 논문(arXiv:2606.31498)으로, 요즘 부쩍 자주 들리는 다섯 개의 에이전트 프로토콜인 MCP, A2A, ACP, ANP, ERC-8004을 하나하나 뜯어보면서 "이 프로토콜들이 과연 에이전트 공동체의 거버넌스를 담을 수 있는가"를 체계적으로 따진 연구입니다.그런데 제목을 보고 "또 프로토콜 비교 논문이겠거니" 하고 넘기기엔 조금 관점이 다릅니다. 이 논문에서는 "우리는 AI 에이전트에게 일하..