AI 브리핑
매일 AI 업계의 핵심만 골라 전해드려요
요약
- ·첫째, Anthropic이 Claude Haiku 5.5를 내놓고 캐시 가격까지 낮추면서 소형 모델과 에이전트 운영 비용 경쟁이 더 뜨거워졌어요.
- ·둘째, OpenAI의 GPT-6와 DevDay 발표, Google의 Gemini 4 Argon, Mistral의 1조 파라미터 오픈웨이트 모델이 이어지며 장시간 에이전트 워크플로우 경쟁이 본격화됐어요.
- ·셋째, 에이전트가 실제 업무에 들어오면서 접근 제어, 자동 리뷰, 사고 신고 의무화 같은 안전·거버넌스 이슈가 함께 커지고 있어요.
- ·넷째, NVIDIA·Microsoft의 로컬 에이전트 PC와 온디바이스 임베딩 모델처럼 클라우드 밖에서 AI를 돌리는 흐름도 뚜렷해졌어요.
주요 뉴스15건
Claude 5.5 계열의 프롬프트 캐시 적중 가격이 기본 입력가의 5% 이하로 내려갔어요. 긴 컨텍스트를 반복 쓰는 RAG와 에이전트의 비용이 크게 줄어요.
OpenAI DevDay와 Google Gemini 4 Argon을 함께 보면 경쟁 단위가 모델 성능에서 저장소 점검·수정·테스트·제출까지의 완결된 워크플로우로 옮겨 가고 있어요.
Mistral이 1조 파라미터 이상의 오픈웨이트 모델 Large 4를 API 프리뷰로 공개했어요. 가중치는 27일에 풀려요.
Hermes 에이전트를 만든 Nous Research가 9,000만 달러 시리즈 B로 기업 가치 15억 달러를 확인하고 기업용 에이전트를 내놨어요. 오픈소스 에이전트도 상업화 단계에 들어섰어요.
OpenAI와 Anthropic이 호주 청문회에서 에이전트 데이터 침해 사고의 의무 신고 제도를 지지했어요. 에이전트 규제가 구체화되는 신호예요.
웹케시는 은행 경영정보 에이전트의 날짜 오류와 근거 없는 수치를 규칙 엔진, 용어 사전, 되묻기, 위험 SQL 차단으로 잡아 조회 시간을 20분에서 5초로 줄였어요.
OpenAI가 수학 분야에 수백 건의 새 결과를 내놓아 수학계가 다시 충격을 받고 있어요. AI의 추론 능력이 연구 현장으로 번지고 있다는 신호예요.
그럴 수도 있음
공식 발표 전의 초기 신호입니다. 사실로 단정하지 마세요.
- 공식 확인 전ChatGPT GPT-6 Astra
ChatGPT의 ‘Chat’ 영역에서 GPT-6 Astra가 보이지 않는다는 관측
한 Reddit 사용자는 GPT-6 Astra가 ChatGPT의 ‘Chat’ 영역에서 갑자기 사라졌지만 Pro 플랜의 ‘Work’ 영역에서는 여전히 보인다고 전했어요. 원인은 확인되지 않았으며, 이 관측이나 모델의 제공 상태는 아직 공식 확인이 없어요.
- 공식 확인 전OpenAI GPT-6 Astra
OpenAI GPT-6 ‘Astra’ 출시 관련 보도 관측
The Hindu가 OpenAI의 GPT-6 ‘Astra’ 출시를 다룬 기사를 냈다는 신호예요. 제공된 정보만으로는 구체적인 출시 내용이나 일정을 확인할 수 없고, 공식 확인도 아직 없어요.
- 공식 확인 전OpenAI Pro
OpenAI Pro 사용량이 예정일보다 일찍 리셋됐다는 사용자 제보
한 OpenAI Pro 사용자는 주간 사용량 리셋 예정일보다 하루 먼저 잔여 사용량이 초기화됐다고 주장해요. 개인 계정에서 겪었다는 경험담이며, GPT-6 Astra에 관한 정보나 일반적인 리셋 정책 변경을 뜻하는지는 확인되지 않았고 공식 확인도 없어요.
10월 8일 AI 브리핑
첫째, Anthropic이 Claude Haiku 5.5를 내놓고 캐시 가격까지 낮추면서 소형 모델과 에이전트 운영 비용 경쟁이 더 뜨거워졌어요. 둘째, OpenAI의 GPT-6와 DevDay 발표, Google의 Gemini 4 Argon, Mistral의 1조 파라미터 오픈웨이트 모델이 이어지며 장시간 에이전트 워크플로우 경쟁이 본격화됐어요. 셋째, 에이전트가 실제 업무에 들어오면서 접근 제어, 자동 리뷰, 사고 신고 의무화 같은 안전·거버넌스 이슈가 함께 커지고 있어요. 넷째, NVIDIA·Microsoft의 로컬 에이전트 PC와 온디바이스 임베딩 모델처럼 클라우드 밖에서 AI를 돌리는 흐름도 뚜렷해졌어요.
- Claude Haiku 5.5 출시와 AI 비용 구조 변화
- 프런티어 모델·에이전트 경쟁 가속
- 에이전트 시대의 보안·거버넌스와 로컬 AI 확산
- Introducing Claude Haiku 5.5
Claude Haiku 5.5가 입력 $0.10, 출력 $0.50의 저가로 나왔어요. 새 토크나이저로 토큰 수가 늘고 10만 토큰 초과 시 가격이 5배가 되는 점은 따져봐야 해요.
- [중요 요금 변경] Anthropic Prompt Caching
Claude 5.5 계열의 프롬프트 캐시 적중 가격이 기본 입력가의 5% 이하로 내려갔어요. 긴 컨텍스트를 반복 쓰는 RAG와 에이전트의 비용이 크게 줄어요.
- GPT‑6 and Intelligent UI for everyone
OpenAI가 'GPT-6와 모두를 위한 지능형 UI'를 공개했어요. 본문이 없어 세부는 불명확하지만 모델과 인터페이스를 함께 바꾸는 대형 발표예요.
- The Sequence Learning Loop - Issue 946: Learning About OpenAI DevDay Releases and Gemini 4 Argon
OpenAI DevDay와 Google Gemini 4 Argon을 함께 보면 경쟁 단위가 모델 성능에서 저장소 점검·수정·테스트·제출까지의 완결된 워크플로우로 옮겨 가고 있어요.
- 미스트랄, 1조 매개변수 ‘라지 4’ 공개..."사이버 보안·오픈 모델 최상위"
Mistral이 1조 파라미터 이상의 오픈웨이트 모델 Large 4를 API 프리뷰로 공개했어요. 가중치는 27일에 풀려요.
- NVIDIA, Microsoft Kick Off a New Beginning for Windows PCs With RTX Spark and AI Agents
NVIDIA와 Microsoft가 에이전트를 OS 수준에서 안전하게 돌리는 MXC와 128GB 통합 메모리의 RTX Spark PC를 공개했어요. 에이전트의 로컬 실행 시대가 열려요.
- "결정 피로 줄인다"…오픈AI, 코덱스 2일차 업데이트로 ‘오토리뷰’ 전면 무료화
OpenAI가 보조 에이전트가 위험한 명령을 실시간으로 차단하는 Codex '오토리뷰'를 무료로 풀었어요. 매번 승인하지 않아도 되는 에이전트 안전장치가 표준이 되고 있어요.
- Rethinking access control for RAG with Amazon Quick and Amazon Bedrock
AWS가 RAG에서 질의 시점에 원본 소스의 권한을 다시 확인하는 2단계 ACL 검증을 소개했어요. 복제한 권한이 낡아 정보가 새는 문제를 직접 겨냥해요.
- Agent Lightning v1.0: A 3,500-Line Lightweight Agentic RL Framework for Training Agents with Real Harnesses
Microsoft가 실제 배포용 하네스를 그대로 강화학습에 쓰는 Agent Lightning v1.0을 공개했어요. Qwen3.5-9B가 약 6천 샘플로 SWE-bench Verified를 41.8%에서 56.4%로 올렸어요.
- Nous Research confirms it hit $1.5B valuation, launches AI agents for business users
Hermes 에이전트를 만든 Nous Research가 9,000만 달러 시리즈 B로 기업 가치 15억 달러를 확인하고 기업용 에이전트를 내놨어요. 오픈소스 에이전트도 상업화 단계에 들어섰어요.
- Liquid AI Releases Open-Weight d1-3B and d1-omni-600M: Multimodal Decision Models With Zero Output Tokens
Liquid AI가 출력 토큰 없이 한 번의 순전파로 판단을 내리는 d1-3B, d1-omni-600M을 오픈웨이트로 공개했어요. 분류·라우팅 비용과 지연이 크게 줄어요.
- 구글, ‘임베딩젬마 2’ 공개…온디바이스서 텍스트·이미지·음성 한 번에 처리
Google이 텍스트·이미지·음성·비디오를 하나의 벡터 공간에서 처리하는 온디바이스 임베딩 모델 EmbeddingGemma 2를 공개했어요. 기기 안에서 멀티모달 RAG가 가능해져요.
- 호주 청문회 출석한 오픈AI·앤트로픽 "에이전트 사고 신고 의무화 찬성"
OpenAI와 Anthropic이 호주 청문회에서 에이전트 데이터 침해 사고의 의무 신고 제도를 지지했어요. 에이전트 규제가 구체화되는 신호예요.
- "2분기 실적 날짜도 틀리던 AI"…웹케시는 어떻게 은행용 에이전트 바꿨나
웹케시는 은행 경영정보 에이전트의 날짜 오류와 근거 없는 수치를 규칙 엔진, 용어 사전, 되묻기, 위험 SQL 차단으로 잡아 조회 시간을 20분에서 5초로 줄였어요.
- OpenAI unleashes hundreds more math results upon a field in shock
OpenAI가 수학 분야에 수백 건의 새 결과를 내놓아 수학계가 다시 충격을 받고 있어요. AI의 추론 능력이 연구 현장으로 번지고 있다는 신호예요.