본문 바로가기

OpenAI

(9)
토큰 효율은 엔지니어의 역량입니다 - OpenAI DevDay를 보며 9월 29일 OpenAI DevDay에서 20개가 넘는 발표가 나왔습니다.그중 가장 많은 반응을 얻은 것은 모델이 아니라 요금제였습니다.월 500달러의 Pro 500 플랜이 새로 생겼습니다.Plus의 25배 사용량과 함께 Codex에서 초당 300토큰을 내는 Ultrafast 속도 등급이 추가되었습니다.기존 속도의 최대 8배입니다.같은 날 월 200달러 플랜의 사용량은 기존 대비 절반으로 줄었습니다.Work와 Codex 허용량이 Plus의 20배에서 10배가 되고, GPT-6 Pro 채팅은 주당 200회에서 100회가 됩니다.10월 30일부터 적용됩니다.저는 이 발표에서 두가지가 눈에 들어왔습니다.계층화와 토큰 맥시마이징의 수익화입니다.500달러 플랜이 파는 것은 속도만이 아닙니다.같은 모델을 쓰더라도 ..
가장 빨리 달리던 회사가 속도를 늦추자고 했습니다 9월 12일 토요일, Dario Amodei가 개인 사이트에 에세이 한 편을 올렸습니다. 제목은 "We Must Pace the Frontier"입니다. 약 3,800단어 분량이며 핵심 문장은 다음과 같습니다. AI 모델의 역량을 개선하는 속도를 늦춰야 한다는 것입니다. 몇 시간 뒤 Sam Altman이 동의한다고 밝혔습니다. OpenAI도 Anthropic이 약속한 첫 번째 조치를 똑같이 이행하겠다고 덧붙였습니다. Elon Musk도 동의를 표했고, 다음 날 Satya Nadella가 AI 모델의 역량에 대해 의도적인 속도 조절과 상주 평가자 개념을 환영했습니다. 경쟁 관계인 프론티어 랩의 수장들이 감속에 한목소리를 낸 것은 처음입니다. 이 에세이가 특이한 이유는 발언자가 Dario Amodei이기 때..
피해자가 가해자에게 요구한 것 - Hugging Face의 두 가지 조건 7월 26일 토요일, Hugging Face의 공동창업자이자 CEO인 Clement Delangue가 X에 글을 올렸습니다. 며칠 전 OpenAI의 AI 에이전트가 자사 프로덕션 시스템에 침투한 사건에 대한 입장이었습니다.그는 샌프란시스코로 날아가 OpenAI 경영진을 직접 만난 뒤, "투명성의 정신"으로 요구 사항을 공개한다고 밝혔습니다. 요구는 두 가지였습니다.그런데 그 두 가지에는 손해배상도, 사과도, 법적 조치도 들어 있지 않았습니다. 먼저 사건의 시간표를 정리하면 이렇습니다.7월 16일, Hugging Face가 자율 에이전트 하나가 내부 데이터셋과 자격증명에 접근했다는 사실을 공개했습니다.OpenAI가 자사 모델의 관여를 확인한 것은 7월 21일과 22일이었습니다.공식 공개는 7월 24일에 이..
OpenAI의 에이전트가 샌드박스를 탈출했습니다 7월 21일, OpenAI가 이례적인 보안 사고를 공개했습니다. 자사의 AI 모델이 격리된 테스트 환경을 스스로 빠져나와 외부 인터넷에 접근했고, Hugging Face의 프로덕션 시스템까지 침투했다는 내용입니다.사고에 관여한 것은 GPT-5.6 Sol과 아직 공개되지 않은 더 강력한 모델이었습니다. 가장 놀라운 것은 동기였습니다.이 모델들은 누군가의 공격 지시를 받은 것이 아닙니다.자신에게 주어진 벤치마크 시험을 통과하기 위해 그 시험의 정답을 찾아 나선 것입니다. 무슨 일이 있었는지부터 정리하면 이렇습니다.OpenAI는 모델의 사이버 공격 역량을 측정하기 위해 ExploitGym이라는 벤치마크로 평가를 진행하고 있었습니다.실제 소프트웨어 취약점을 작동하는 익스플로잇 코드로 바꿔내는 과제 898개로 구..
Sonnet 5, GPT-5.6, Grok 4.5 - 몇 주 사이에 벌어진 일 6월 30일 Anthropic이 Claude Sonnet 5를 7월 8일 xAI가 Grok 4.5를 출시했습니다. 7월 9일에는 OpenAI의 GPT-5.6이 정부 검토를 거쳐 일반에 공개됐습니다. 3주가 채 안 되는 기간에 프론티어 모델 세 개가 나왔고, GLM-5.2 같은 오픈소스 모델들이 그 뒤를 바짝 추격하고 있습니다. 그리고 이 기간에 나오지 못한 모델이 하나 있습니다. Google의 Gemini 3.5 Pro입니다. 먼저 나온 세 모델을 보면 이렇습니다. Claude Sonnet 5는 중간 티어의 반란입니다. 에이전트 코딩 벤치마크에서 63.2%를 기록하며 상위 모델인 Opus 4.8(69.2%)에 바짝 다가섰고, 터미널 에이전트 벤치마크에서는 Sonnet 계열 최초로 Opus를 앞질렀습니..
강제와 자발, 결과는 같았습니다 - Mythos와 GPT-5.6의 공통점 지난 두 편의 글에서 두 사건을 다뤘습니다. 6월 12일, Anthropic이 정부 명령으로 Fable 5와 Mythos 5를 차단한 사건과 그리고 6월 26일, OpenAI가 정부 요청으로 GPT-5.6 출시를 소수 파트너로 제한한 사건입니다.당시에는 두 사건이 별개처럼 보였습니다. 하나는 강제 중단이었고, 하나는 자발적 협조였습니다. 그런데 6월 26일과 27일 이틀 사이에 벌어진 일을 함께 놓고 보면, 두 사건이 사실은 하나의 그림이었다는 것이 분명해집니다. 먼저 그 이틀 동안 무슨 일이 있었는지 정리하면 이렇습니다.6월 26일 금요일, OpenAI가 GPT-5.6을 정부 승인 파트너 약 20곳으로 제한해 출시했습니다. 같은 날, 상무부 장관 Howard Lutnick이 Anthropic에 두 번째..
Anthropic이 먼저 했습니다 - AI 신원 인증이 표준이 될 것인가 4월 14일, Anthropic이 헬프센터 페이지를 조용히 업데이트했습니다. 공식 발표도 없었고, 공지 이메일도 없었고, 블로그 포스트도 없었습니다. 사용자들은 X에 올라온 스크린샷을 통해 처음 알았습니다. Claude를 구독하거나 특정 기능에 접근하려면 정부 발급 신분증과 실시간 셀피를 제출해야 한다는 내용이었습니다. Anthropic이 주요 AI 챗봇 중 최초로 소비자 대상 신원 인증을 도입한 것입니다. ChatGPT도, Gemini도, 이런 요구를 하지 않습니다. 구체적인 내용은 이렇습니다. 신원 인증은 모든 사용자에게 적용되지 않습니다. Anthropic은 "일부 사용 사례"에 한해 적용된다고 밝혔습니다. 실제 트리거가 되는 상황은 네 가지입니다. 사용 정책 위반을 반복한 계정, 중국, ..
AI가 더 강한 AI를 만들기 시작했습니다 - 재귀적 자기 개선(RSI)의 시대 Anthropic의 한 직원이 내부에서 이런 글을 남겼습니다."우리는 Claude n이 Claude n+1을 만들게 하고 싶습니다. 그러면 우리는 집에 가서 스웨터를 짤 수 있을 테니까요."농담처럼 읽히지만 이것은 지금 AI 업계 전체가 실제로 향하고 있는 방향입니다. 재귀적 자기 개선(Recursive Self-Improvement, RSI)이라는 개념이 있습니다. AI 시스템이 스스로를 개선하는 능력을 갖추고, 그렇게 만들어진 더 강한 AI가 다시 더 강한 AI를 만드는 루프입니다. 오랫동안 먼 미래의 이야기로 여겨졌습니다. 하지만 지금은 다릅니다.OpenAI는 2026년 9월까지 'AI 연구 인턴'을 배치하고, 2028년 3월까지 '완전 자동화된 AI 연구자'를 개발하겠다는 목표를 공개적으로 밝혔습..