본문 바로가기

전체 글

(195)
Harvey가 보여준 AI 서비스 기업의 원가 구조 9월 21일 Bloomberg가 법률 AI 기업 Harvey의 실적을 보도했습니다. 올해 초 약 50%였던 매출총이익률이 6월에는 -50%가 됐다는 내용입니다.기업가치 156억 달러로 평가받는 법률 버티컬 AI의 대표 기업입니다.그 회사가 몇 달 만에 매출 1달러를 만들 때마다 1.50달러의 원가가 발생하는 상태가 되었습니다. 그 동안 무슨 일이 있었는지는 다음과 같습니다.Harvey는 좌석 기반 정액제로 고객에게 변호사 한 명당 정해진 금액을 받습니다.그런데 OpenAI와 Anthropic에 내는 모델 비용은 종량제로 사용한 만큼 나갑니다.3월 AI 에이전트를 업데이트하자 고객 사용량이 급증했고, 올해 토큰 사용량은 20배까지 늘었습니다.고객이 더 많이 써도 좌석당 매출은 크게 달라지지 않는 상황에서 ..
오픈웨이트 모델이 Mythos급 공격 역량에 도달했습니다 9월 29일, Anthropic의 Frontier Red Team이 보고서를 발표했습니다.자사 모델이 아니라 경쟁사 모델에 대한 평가였습니다.중국 Zhipu AI가 8월에 공개한 오픈웨이트 모델 GLM-5.3입니다. 보고서의 결론은 분명합니다.GLM-5.3은 처음부터 끝까지 작동하는 익스플로잇을 스스로 만들 수 있고,그 수준이 Claude Mythos Preview에 거의 근접하다는 내용입니다. 수치부터 보면 Chrome의 V8 엔진에 알려진 취약점을 익스플로잇하는 ExploitBench에서 GLM-5.3은 410회 시도 가운데 50회 성공했습니다.Mythos Preview는 56회였습니다. 비율로 보면 12.2%와 13.7%입니다. Anthropic 내부의 바이너리 익스플로잇 테스트에서는 GLM-5.3..
토큰 효율은 엔지니어의 역량입니다 - OpenAI DevDay를 보며 9월 29일 OpenAI DevDay에서 20개가 넘는 발표가 나왔습니다.그중 가장 많은 반응을 얻은 것은 모델이 아니라 요금제였습니다.월 500달러의 Pro 500 플랜이 새로 생겼습니다.Plus의 25배 사용량과 함께 Codex에서 초당 300토큰을 내는 Ultrafast 속도 등급이 추가되었습니다.기존 속도의 최대 8배입니다.같은 날 월 200달러 플랜의 사용량은 기존 대비 절반으로 줄었습니다.Work와 Codex 허용량이 Plus의 20배에서 10배가 되고, GPT-6 Pro 채팅은 주당 200회에서 100회가 됩니다.10월 30일부터 적용됩니다.저는 이 발표에서 두가지가 눈에 들어왔습니다.계층화와 토큰 맥시마이징의 수익화입니다.500달러 플랜이 파는 것은 속도만이 아닙니다.같은 모델을 쓰더라도 ..
네 개의 AI가 투표해서 다음 공격을 정하는 악성코드 9월 22일, Cisco Talos가 CLOSEDQUORUM이라는 악성코드를 공개했습니다. Windows를 표적으로 하는 Go 기반 임플란트인데, 지금까지 알려진 악성코드와 다른 점이 하나 있습니다. 공격자의 서버에서 매번 다음 명령을 받는 대신 DeepSeek, Qwen, Mistral, Gemini 네 모델의 투표로 다음 행동을 결정합니다.감염된 시스템의 현재 상황을 정리해 네 모델에 동시에 보낸 후 각 모델이 다음 행동을 제안하면 다수결로 하나를 선택해 실행합니다. 자격증명 수집, 권한 상승, 측면 이동처럼 선택지를 미리 좁혀 둔 뒤에 그 안에서 모델이 판단하게 하는 구조입니다.처음 배포한 뒤에는 공격자의 지속적인 명령이 필요 없습니다. 이 발견은 Talos가 같은 날 공개한 CAIRN이라는 오픈소..
Claude가 Anthropic 연구의 4분의 1을 이끕니다 9월 17일, Anthropic Institute가 내부 측정 결과를 처음으로 공개했습니다. 2026년 8월 기준 Claude가 Anthropic의 AI 연구개발 업무 가운데 26%를 ‘이끌고 있다’는 내용입니다. 2월에는 1%에도 미치지 못했습니다. 불과 6개월 사이의 변화입니다. 이번 발표는 지난주 Dario Amodei가 공개한 에세이와 함께 보면 더 인상적입니다. AI 개발 속도를 늦추는 방안을 제안한 회사가 닷새 뒤, 자기 회사의 AI 개발 속도계를 공개한 셈이기 때문입니다. Anthropic은 Epoch AI가 만든 여섯 단계의 자동화 척도를 사용했습니다. AI가 전혀 관여하지 않는 AL0부터 사람의 개입 없이 완전히 자율적으로 움직이는 AL5까지입니다. 이 가운데 AL3은 사람의 밀착 지시..
가장 빨리 달리던 회사가 속도를 늦추자고 했습니다 9월 12일 토요일, Dario Amodei가 개인 사이트에 에세이 한 편을 올렸습니다. 제목은 "We Must Pace the Frontier"입니다. 약 3,800단어 분량이며 핵심 문장은 다음과 같습니다. AI 모델의 역량을 개선하는 속도를 늦춰야 한다는 것입니다. 몇 시간 뒤 Sam Altman이 동의한다고 밝혔습니다. OpenAI도 Anthropic이 약속한 첫 번째 조치를 똑같이 이행하겠다고 덧붙였습니다. Elon Musk도 동의를 표했고, 다음 날 Satya Nadella가 AI 모델의 역량에 대해 의도적인 속도 조절과 상주 평가자 개념을 환영했습니다. 경쟁 관계인 프론티어 랩의 수장들이 감속에 한목소리를 낸 것은 처음입니다. 이 에세이가 특이한 이유는 발언자가 Dario Amodei이기 때..
산업은 달랐지만 문제는 같았습니다 - AX 컨설팅 현장에서 느낀 점 아틀란소프트를 운영하며 컨설팅과 자문 7건, 프로젝트 3건을 경험했습니다. 초기 스타트업부터 TIPS 수행기업, 비영리기관, 스포츠산업, 뷰티, 통신, 음악·콘텐츠 플랫폼, 웰니스까지 다양한 기업과 조직을 만나 문제를 함께 살펴봤습니다. 조직 규모 역시 중소기업에서 대기업까지 다양했습니다. 서로 다른 산업의 문제를 들여다보면서 한 가지 흥미로운 공통점을 발견했습니다. 산업도 규모도 달랐지만 처음 받는 요청과 실제로 마주하는 문제는 의외로 비슷한 부분이 많았습니다. 대체로 처음에는 이런 요청을 받습니다. 사내 데이터를 학습한 챗봇을 만들고 싶다. 업무를 자동화하고 싶다. 대시보드를 만들어서 데이터를 보고 싶다. AI를 활용하여 무언가를 개선하고 싶다는 방향은 분명하지만, 정작 무엇을 해결해야 하는지는 아직..
피해자가 가해자에게 요구한 것 - Hugging Face의 두 가지 조건 7월 26일 토요일, Hugging Face의 공동창업자이자 CEO인 Clement Delangue가 X에 글을 올렸습니다. 며칠 전 OpenAI의 AI 에이전트가 자사 프로덕션 시스템에 침투한 사건에 대한 입장이었습니다.그는 샌프란시스코로 날아가 OpenAI 경영진을 직접 만난 뒤, "투명성의 정신"으로 요구 사항을 공개한다고 밝혔습니다. 요구는 두 가지였습니다.그런데 그 두 가지에는 손해배상도, 사과도, 법적 조치도 들어 있지 않았습니다. 먼저 사건의 시간표를 정리하면 이렇습니다.7월 16일, Hugging Face가 자율 에이전트 하나가 내부 데이터셋과 자격증명에 접근했다는 사실을 공개했습니다.OpenAI가 자사 모델의 관여를 확인한 것은 7월 21일과 22일이었습니다.공식 공개는 7월 24일에 이..