[AI Breakfast] OpenAI, SpaceXAI, DeepSeek, 생성형 AI 속도와 비용 경쟁 심화
0
설명
## 배경
이번 호는 생성형 AI 분야의 최신 기술 발전과 시장 경쟁 동향을 다룹니다. OpenAI는 GPT-5.6 Sol의 'Ultrafast Mode'를 공개하며 실시간 에이전트 처리 속도를 14배 향상시켰습니다. 이는 Cerebras wafer-scale 하드웨어를 기반으로 하며, 44GB 온칩 SRAM에 모델 가중치를 저장하여 GPU 클러스터의 메모리 병목 현상을 극복했습니다. 또한, ChatGPT Work 및 Codex 사용자를 위한 'Computer History' 기능을 macOS에 도입하여 사용자 상호작용 기록을 로컬 이벤트 로그로 관리합니다. SpaceXAI는 Grok 4.6을 출시하며 GPT-5.6 Sol Max와 동등한 성능을 절반 이하의 가격으로 제공합니다. 특히 200,000 토큰을 초과하는 프롬프트에 대해 요금이 두 배로 증가하는 정책을 도입했습니다. 𝕏는 'For You' 타임라인의 랭킹 및 필터링 코드를 오픈소스로 공개하며 투명성을 높였습니다. DeepSeek는 DeepSeek-V4-Pro를 출시하고, Claude Code의 대안으로 DeepSeek Harness v0.1을 오픈소스로 공개했습니다. Harness v0.1은 Cordis 시스템을 기반으로 AI 에이전트가 자체 코드를 안전하게 수정할 수 있도록 지원합니다. DeepSeek는 IPO 준비를 위해 8월 16일부터 동적 요금제를 도입합니다.
### 1. OpenAI, GPT-5.6 Sol 'Ultrafast Mode' 공개로 실시간 에이전트 속도 14배 향상
**요약** — OpenAI는 Cerebras wafer-scale 하드웨어를 기반으로 하는 GPT-5.6 Sol의 'Ultrafast Mode'를 공개했습니다. 이 모드는 44GB 온칩 SRAM을 활용하여 기존 GPU 클러스터의 메모리 병목 현상을 극복하고 초당 750 토큰의 추론 속도를 달성했습니다. 벤치마크 테스트에서 Sol Ultrafast는 Humanity's Last Exam의 2,500개 질문을 11시간 11분 만에 완료했으며, 이는 Claude Fable 5보다 훨씬 빠른 속도입니다. 이 기능은 실시간 음성, 코딩, 금융 연구, 사고 대응 등 시간 민감성이 높은 작업의 피드백 루프를 단축하는 데 초점을 맞추고 있으며, Jane Street, Podium, Basis, Rogo 등에서 초기 테스트가 진행 중입니다. 또한, macOS 사용자를 위한 'Computer History' 기능도 도입되어 사용자 상호작용 기록을 로컬 이벤트 로그로 관리합니다.
**인사이트** — 실시간 AI 에이전트의 성능 향상은 다양한 산업 분야에서 즉각적인 의사결정과 자동화를 가속화할 것입니다.
### 2. SpaceXAI, Grok 4.6 출시로 가격 경쟁력 강화 및 투명성 증대
**요약** — SpaceXAI는 Grok 4.6을 출시하며 경쟁 모델 대비 절반 이하의 가격으로 최고 수준의 성능을 제공한다고 발표했습니다. Artificial Analysis의 Intelligence Index에서 61점을 기록하며 GPT-5.6 Sol Max와 동등한 성능을 보였으며, Kimi K3를 능가했습니다. Grok 4.6은 합성 추론 데이터와 강화 학습으로 훈련되었으며, 특히 에이전트 워크플로우에 중점을 두어 복잡한 코딩, 연구, CAD 작업을 Claude Opus 5보다 약 절반의 단계로 완료합니다. 가격은 입력 토큰당 2달러, 출력 토큰당 6달러로 경쟁사 대비 60% 이상 저렴하지만, 200,000 토큰 초과 시 요금이 두 배로 증가합니다. 𝕏는 'For You' 타임라인의 랭킹 및 필터링 코드를 오픈소스로 공개하여 대중의 비판을 수렴하고, 'Under the Hood' 대시보드를 통해 라벨 투명성 기능을 시범 운영합니다.
**인사이트** — AI 모델의 가격 경쟁 심화는 더 많은 기업과 개발자가 첨단 AI 기술에 접근할 수 있는 기회를 확대할 것입니다.
### 3. DeepSeek, Claude Code 경쟁 모델 DeepSeek Harness v0.1 오픈소스로 공개
**요약** — DeepSeek는 DeepSeek-V4-Pro를 출시하며 에이전트 기능 강화와 함께 가격을 인상했습니다. 이 모델은 Vals Index에서 11점 상승하여 오픈 웨이트 모델 중 두 번째로 높은 순위를 차지했으며, 작업당 0.14달러의 비용으로 제공됩니다. V4-Pro는 조정 가능한 추론 노력, 네이티브 OpenAI Responses API 지원, 원클릭 Codex 통합 기능을 제공합니다. 또한, DeepSeek는 Peking University 연구진과 협력하여 개발한 DeepSeek Harness v0.1을 MIT 라이선스로 오픈소스로 공개했습니다. Harness v0.1은 Cordis 시스템을 기반으로 하며, AI 에이전트가 자체 코드를 안전하게 수정하고, 오류 발생 시 자동으로 되돌리며, 모듈을 교체하는 등의 기능을 지원합니다. DeepSeek는 8월 16일부터 동적 요금제를 도입하여 서버 부하를 관리할 예정입니다.
**인사이트** — 오픈소스 AI 프레임워크의 발전은 AI 에이전트의 자율성과 안전성을 높여 개발 및 배포를 더욱 용이하게 할 것입니다.
## 향후 전망
향후 몇 주간 생성형 AI 시장은 속도와 비용 효율성을 중심으로 한 경쟁이 더욱 치열해질 것으로 예상됩니다. 특히 실시간 에이전트, 코딩 지원, 콘텐츠 생성 등 다양한 분야에서 이러한 기술 발전이 적용될 것입니다. 또한, 오픈소스 모델의 발전과 함께 AI 모델의 투명성 및 안전성에 대한 논의도 지속될 것으로 보입니다. OpenAI의 내부 보고서와 같이 AI 사용량과 실제 비즈니스 성과 간의 연관성에 대한 분석도 주목할 만합니다.
---
Source: AI Breakfast Newsletter ([Original link](https://aibreakfast.beehiiv.com/p/openai-previews-14-faster-gpt-5-6-sol-for-real-time-agents))
신고 · 불법·유해·아동 안전(CSAE) 관련 콘텐츠
댓글 0
아직 댓글이 없습니다. 첫 댓글을 남겨 보세요.