본문 바로가기

Anthropic

(21)
오픈웨이트 모델이 Mythos급 공격 역량에 도달했습니다 9월 29일, Anthropic의 Frontier Red Team이 보고서를 발표했습니다.자사 모델이 아니라 경쟁사 모델에 대한 평가였습니다.중국 Zhipu AI가 8월에 공개한 오픈웨이트 모델 GLM-5.3입니다. 보고서의 결론은 분명합니다.GLM-5.3은 처음부터 끝까지 작동하는 익스플로잇을 스스로 만들 수 있고,그 수준이 Claude Mythos Preview에 거의 근접하다는 내용입니다. 수치부터 보면 Chrome의 V8 엔진에 알려진 취약점을 익스플로잇하는 ExploitBench에서 GLM-5.3은 410회 시도 가운데 50회 성공했습니다.Mythos Preview는 56회였습니다. 비율로 보면 12.2%와 13.7%입니다. Anthropic 내부의 바이너리 익스플로잇 테스트에서는 GLM-5.3..
Claude가 Anthropic 연구의 4분의 1을 이끕니다 9월 17일, Anthropic Institute가 내부 측정 결과를 처음으로 공개했습니다. 2026년 8월 기준 Claude가 Anthropic의 AI 연구개발 업무 가운데 26%를 ‘이끌고 있다’는 내용입니다. 2월에는 1%에도 미치지 못했습니다. 불과 6개월 사이의 변화입니다. 이번 발표는 지난주 Dario Amodei가 공개한 에세이와 함께 보면 더 인상적입니다. AI 개발 속도를 늦추는 방안을 제안한 회사가 닷새 뒤, 자기 회사의 AI 개발 속도계를 공개한 셈이기 때문입니다. Anthropic은 Epoch AI가 만든 여섯 단계의 자동화 척도를 사용했습니다. AI가 전혀 관여하지 않는 AL0부터 사람의 개입 없이 완전히 자율적으로 움직이는 AL5까지입니다. 이 가운데 AL3은 사람의 밀착 지시..
가장 빨리 달리던 회사가 속도를 늦추자고 했습니다 9월 12일 토요일, Dario Amodei가 개인 사이트에 에세이 한 편을 올렸습니다. 제목은 "We Must Pace the Frontier"입니다. 약 3,800단어 분량이며 핵심 문장은 다음과 같습니다. AI 모델의 역량을 개선하는 속도를 늦춰야 한다는 것입니다. 몇 시간 뒤 Sam Altman이 동의한다고 밝혔습니다. OpenAI도 Anthropic이 약속한 첫 번째 조치를 똑같이 이행하겠다고 덧붙였습니다. Elon Musk도 동의를 표했고, 다음 날 Satya Nadella가 AI 모델의 역량에 대해 의도적인 속도 조절과 상주 평가자 개념을 환영했습니다. 경쟁 관계인 프론티어 랩의 수장들이 감속에 한목소리를 낸 것은 처음입니다. 이 에세이가 특이한 이유는 발언자가 Dario Amodei이기 때..
자신을 Claude라고 말하는 모델 - Kimi K3가 남긴 흔적 한 사용자가 중국 Moonshot AI의 최신 모델 Kimi K3와 대화하다 이상한 답변을 받았습니다. 모델이 자신을 "Anthropic이 만든 Claude"라고 소개한 것입니다. 처음에는 해프닝처럼 보였습니다. 그런데 7월 22일에 이 이야기가 백악관에서 다시 나왔습니다. 백악관 과학기술정책실(OSTP) 국장 Michael Kratsios가 공개적으로 발언했습니다. Moonshot AI가 Kimi K3를 개발하는 과정에서 Anthropic의 Fable 모델을 디스틸레이션했다는 것입니다. 그는 이것을 "미국의 독점 기술을 훔치고 미국 연구를 훼손하기 위한 대규모의 은밀한 산업적 디스틸레이션"이라고 표현했습니다. Moonshot이 태국을 경유해 수출 통제 대상인 NVIDIA GB300 칩에 접근했다는 의혹..
Sonnet 5, GPT-5.6, Grok 4.5 - 몇 주 사이에 벌어진 일 6월 30일 Anthropic이 Claude Sonnet 5를 7월 8일 xAI가 Grok 4.5를 출시했습니다. 7월 9일에는 OpenAI의 GPT-5.6이 정부 검토를 거쳐 일반에 공개됐습니다. 3주가 채 안 되는 기간에 프론티어 모델 세 개가 나왔고, GLM-5.2 같은 오픈소스 모델들이 그 뒤를 바짝 추격하고 있습니다. 그리고 이 기간에 나오지 못한 모델이 하나 있습니다. Google의 Gemini 3.5 Pro입니다. 먼저 나온 세 모델을 보면 이렇습니다. Claude Sonnet 5는 중간 티어의 반란입니다. 에이전트 코딩 벤치마크에서 63.2%를 기록하며 상위 모델인 Opus 4.8(69.2%)에 바짝 다가섰고, 터미널 에이전트 벤치마크에서는 Sonnet 계열 최초로 Opus를 앞질렀습니..
Fable 5가 돌아왔습니다 - 19일의 공백이 남긴 것 7월 1일 Claude Fable 5가 전 세계 사용자에게 복구됐습니다. 6월 12일 수출 통제 지시로 90분 만에 내려간 지 19일 만입니다. 6월 30일 미국 상무부가 수출 통제를 해제했고, Anthropic은 다음 날 Claude, Claude Code, Claude Cowork 전반에 모델을 재배포했습니다. AWS, Google Cloud, Microsoft Foundry 접근도 순차적으로 복구됐습니다. 그런데 이 복귀는 단순히 모델을 다시 켠 것이 아닙니다. 돌아온 Fable 5는 세 가지가 달라졌습니다. 첫째, 새로운 안전 분류기가 붙었습니다. 이번 사태의 발단은 Amazon 연구진이 보고한 탈옥(Jailbreak) 기법이었습니다. 모델의 안전장치를 우회해 소프트웨어 취약점을 식별하게 ..
강제와 자발, 결과는 같았습니다 - Mythos와 GPT-5.6의 공통점 지난 두 편의 글에서 두 사건을 다뤘습니다. 6월 12일, Anthropic이 정부 명령으로 Fable 5와 Mythos 5를 차단한 사건과 그리고 6월 26일, OpenAI가 정부 요청으로 GPT-5.6 출시를 소수 파트너로 제한한 사건입니다.당시에는 두 사건이 별개처럼 보였습니다. 하나는 강제 중단이었고, 하나는 자발적 협조였습니다. 그런데 6월 26일과 27일 이틀 사이에 벌어진 일을 함께 놓고 보면, 두 사건이 사실은 하나의 그림이었다는 것이 분명해집니다. 먼저 그 이틀 동안 무슨 일이 있었는지 정리하면 이렇습니다.6월 26일 금요일, OpenAI가 GPT-5.6을 정부 승인 파트너 약 20곳으로 제한해 출시했습니다. 같은 날, 상무부 장관 Howard Lutnick이 Anthropic에 두 번째..
역대 최대 규모의 디스틸레이션 공격 - Anthropic vs Alibaba 6월 24일, CNBC가 Anthropic이 미국 상원에 보낸 서한을 입수해 보도했습니다.내용은 이렇습니다. Anthropic이 중국 기업 Alibaba를 "노골적이고(brazenly) 불법적으로(illicitly)" 자사 AI 역량을 빼내려 했다고 고발했습니다. "지금까지 Anthropic이 확인한 가장 큰 규모의 디스틸레이션 공격(distillation attack)."이라는 내용이었습니다. 서한은 6월 10일자로, 상원 은행위원회의 Tim Scott 위원장과 Elizabeth Warren 간사에게 전달됐습니다. 단순한 기업 간 분쟁이 아니라, 의회를 향한 공식 문제 제기였습니다. 먼저 디스틸레이션이 무엇인지부터 짚어야 합니다.디스틸레이션(Distillation)은 그 자체로는 합법적인 머신러닝 ..