프론티어 AI: 지금 어디까지 왔나
훈련 연산량은 1e26 FLOP을 넘었고 연 4~5배로 증가합니다. 2026년에는 프론티어 모델이 처음으로 전략물자처럼 수출통제됐습니다. 벤치마크는 계속 이동합니다 — ARC-AGI-3는 모든 모델이 1% 미만으로 출발했다가 한 모델이 30.2%에 도달했습니다.
프론티어 AI는 여기서 지표 4개와 마일스톤 17건을 담고 있으며, 진전을 측정하는 방법 자체가 논쟁적인 분야입니다.
가장 깔끔한 숫자는 훈련 연산량입니다. GPT-4가 2023년 1e25 FLOP 규모의 첫 모델이었고, 프론티어 모델은 2025년 1e26 FLOP을 넘어 10배 도약했으며, Epoch AI에 따르면 연산량은 연 약 4~5배로 증가합니다. 이제 12개 개발사의 30개 이상 모델이 1e25를 넘었습니다. 연간 민간 AI 투자는 2024년 미국 $109.1B, 중국 $9.3B였고, 발표 논문은 연 약 103,146편으로 이 트래커의 어떤 분야보다 압도적으로 많습니다.
역량은 측정이 더 어렵고, 트래커가 ARC-AGI를 쓰는 이유는 이 벤치마크가 계속 포화를 거부하기 때문입니다. OpenAI o3는 2024년 12월 ARC-AGI-1에서 76~88%를 기록해 암기를 넘어선 첫 AI가 됐습니다(인간 기준선 약 85%). 2025년 3월 더 어려운 ARC-AGI-2가 뒤따랐습니다. 2026년 3월 출시된 ARC-AGI-3는 최초의 완전 상호작용형 벤치마크로, 설명 없는 수작업 게임 환경에서 에이전트가 규칙을 스스로 발견해야 합니다. 출시 시점 모든 프론티어 모델이 1% 미만(최고 0.37%)이었던 반면 인간은 전부 풉니다. 7월 ARC Prize가 Claude Opus 5를 직접 평가해 30.2%를 기록했는데, 이전 최고치 7.8%의 약 네 배이며 어떤 모델도 통과하지 못한 환경 여럿을 클리어했습니다. 짚어둘 이유가 있습니다. 더 널리 퍼진 다른 숫자가 있기 때문입니다 — 96.2%라는 수치는 독립 개발자가 공개 레벨 25개에 대해 자체 하네스로 돌린 결과이지 ARC Prize가 시행한 평가가 아닙니다. 트래커는 시행된 쪽을 기록합니다.
2026년 기록에서 구조적 변화 둘이 두드러집니다. 첫째는 연산 주권입니다. DeepSeek의 1.6조 파라미터 V4가 화웨이 Ascend 실리콘에서 구동되고, 화웨이 주도 팀이 Ascend 910C 약 1,000기에서 전체 파라미터 사후훈련을 완료했습니다. 사전훈련 하드웨어는 비공개라 '엔비디아 없이 훈련'은 확립된 사실이 아닙니다. 이 구분은 관련 보도에서 자주 사라집니다. DeepSeek은 첫 외부 라운드로 최대 $59B 가치에 약 $7.4B 조달에 나섰습니다.
둘째는 프론티어 모델이 국가 통제의 대상이 됐다는 점입니다. 2026년 6월 Anthropic은 계층적 안전 배포로 Claude Fable 5를 공개했고, 제한 없는 Mythos 5는 미국 정부 프로그램을 통해 검증된 사이버 방어자에게만 제공했습니다. 며칠 뒤 미 상무부가 두 모델을 수출통제해 모든 외국인 접근을 금지했고, 이를 실시간으로 선별 집행할 수 없었던 Anthropic은 두 모델을 전 세계에서 중단했습니다. 배포된 프론티어 AI 모델이 전략기술처럼 수출통제된 최초의 사례입니다.
효율도 움직였습니다. CoreWeave는 MLPerf v6.0에서 GB300 GPU 8,192기로 6,710억 파라미터 DeepSeek-V3를 2.02분에 훈련했습니다. Anthropic의 Claude Sonnet 5는 Opus급에 근접한 에이전트 성능을 훨씬 낮은 비용으로 끌어내렸습니다. 그리고 2025년의 교훈 — 규모만이 아니라 추론·에이전트 훈련이 프론티어를 밀어올린다 — 은 유지됐습니다.
잠긴 마일스톤은 AGI 자체이며, 날짜가 붙어 있지 않고 정의가 논쟁적이라고 명시돼 있습니다. 그것이 정직한 배치입니다.
- 최신
- 1×10²⁶ FLOP
- 2025년
관련 주체
ChatGPT·GPT 시리즈 개발사. GPT-4가 첫 1e25 FLOP 모델, o3로 ARC-AGI 첫 돌파. 프론티어 AI 선두.
Claude 모델 개발사; 안전성 중시 프론티어 연구소. Amazon·Google 후원.
중국 오픈웨이트 모델 개발사; 적은 컴퓨트로 프론티어급 성능을 내 주목받음.
알파벳의 AI 연구소(2023년 DeepMind+Brain 통합); Gemini 모델 개발.
관련 글
독자 반응
반응과 댓글은 독자의 의견입니다 — 검증되지 않았으며, 뉴스룸의 사실 기록에 포함되지 않습니다.
댓글 0
아직 댓글이 없습니다 — 첫 댓글을 남겨보세요.