AI 브리핑
매일 AI 업계의 핵심만 골라 전해드려요
요약
- ·첫째, 구글이 제미나이 4 아르곤을 공개했고 OpenAI DevDay에서는 지속형 에이전트가 나오면서 경쟁의 초점이 장시간 에이전트 작업으로 옮겨가고 있어요.
- ·둘째, 앤트로픽의 감시 플러그인, AWS의 소형 판단 모델, DeepSeek의 오픈소스 하네스처럼 에이전트의 행동을 점검하고 통제하는 도구가 잇따라 나왔어요.
- ·셋째, 추론 비용이 1년 새 13분의 1로 떨어지고 요금제 개편과 예산 한도 논의가 나오면서 AI의 가격과 과금 방식이 바뀌고 있어요.
- ·넷째, 알레프 알파의 콜리브리와 엔비디아의 DGX 스파크 파생 모델처럼 소버린 AI와 로컬 추론 인프라 선택지도 넓어지고 있어요.
주요 뉴스14건
OpenAI DevDay의 지속형 에이전트 Dots, Gemini 4, Meta 엔터프라이즈 플랫폼, AMD의 World Labs 인수 합의까지 지난주 핵심 소식을 한눈에 정리했어요.
비슷한 수준의 문제를 푸는 추론 비용이 1년 새 약 13분의 1로 떨어졌어요. AI 서비스의 원가 구조와 가격 전략이 바뀌는 신호예요.
AWS가 20억 파라미터 소형 모델 스트랜즈 디사이더 2B를 아파치 2.0으로 공개했어요. 에이전트의 도구 실행 여부와 추가 질문 필요 여부를 수십 밀리초 안에 점검해요.
DeepSeek이 MIT 라이선스 에이전트 하네스 v0.2와 공식 데스크톱 앱을 공개했어요. 모델 어댑터와 도구를 플러그인으로 바꿔 끼울 수 있지만 개발자 프리뷰라 호환성이 깨질 수 있어요.
구글이 9일부터 무료와 AI 플러스 요금제에서 제미나이 프로 모델을 빼요. 프로급 모델은 상위 유료 요금제로 묶는 흐름이 뚜렷해졌어요.
Simon Willison은 코딩 에이전트의 예기치 않은 비용 폭증을 막으려면 경고만 보내는 소프트 캡이 아니라 기본 하드 예산 한도가 필요하다고 주장했어요. AWS와 구글 클라우드가 이미 관련 기능을 내놓았어요.
티냅스는 에이전트 실행 직전에 기업 정책을 확인해 통과 또는 차단하는 검증 계층으로 엔비디아 인셉션 챌린지 톱10에 올랐어요. KB국민은행과 금융권 검증 협업도 진행했어요.
퍼플렉시티가 연내 한국 법인을 세우겠다고 밝혔어요. 20~30개 LLM을 골라 쓰고 교차 검증하는 퍼플렉시티 컴퓨터와 하이브리드 컴퓨트를 앞세워 국내 기업과 협력을 넓힐 계획이에요.
한 연구자가 GPT-6 아스트라로 월드 오브 워크래프트의 오크 시작 지역 퀘스트를 화면 없이 40분 만에 끝냈다고 밝혔어요. 모델의 자율 실행 능력을 보여주는 사례지만 개인 실험이라 검증이 필요해요.
엔비디아가 메모리를 64GB로 줄인 DGX 스파크 파생 모델을 23일부터 4999달러에 공급해요. 메모리 공급난으로 가격이 오른 가운데 로컬 추론 선택지가 넓어졌어요.
JetBrains가 시맨틱 코드 검색용 RAG 파이프라인을 만든 과정을 개발자 일지로 공유했어요. 본문이 제공되지 않아 구체적인 구현과 성능은 원문에서 확인해야 해요.
그럴 수도 있음
공식 발표 전의 초기 신호입니다. 사실로 단정하지 마세요.
- 공식 확인 전ChatGPT GPT-6 Astra
ChatGPT의 ‘Chat’ 영역에서 GPT-6 Astra가 보이지 않는다는 관측
한 Reddit 사용자는 GPT-6 Astra가 ChatGPT의 ‘Chat’ 영역에서 갑자기 사라졌지만 Pro 플랜의 ‘Work’ 영역에서는 여전히 보인다고 전했어요. 원인은 확인되지 않았으며, 이 관측이나 모델의 제공 상태는 아직 공식 확인이 없어요.
- 공식 확인 전OpenAI
OpenAI가 ‘dots’를 출시하고 GPT-6 Astra를 에이전트에 적용한다는 관측
The Rundown AI의 제목은 OpenAI가 ‘dots’를 출시하고 GPT-6 Astra를 24시간 가동 에이전트에 적용한다고 전해요. 제공된 정보는 제목과 링크뿐이며, 아직 공식 확인은 없어요.
- 공식 확인 전OpenAI GPT-6 Astra
OpenAI GPT-6 ‘Astra’ 출시 관련 보도 관측
The Hindu가 OpenAI의 GPT-6 ‘Astra’ 출시를 다룬 기사를 냈다는 신호예요. 제공된 정보만으로는 구체적인 출시 내용이나 일정을 확인할 수 없고, 공식 확인도 아직 없어요.
10월 5일 AI 브리핑
첫째, 구글이 제미나이 4 아르곤을 공개했고 OpenAI DevDay에서는 지속형 에이전트가 나오면서 경쟁의 초점이 장시간 에이전트 작업으로 옮겨가고 있어요. 둘째, 앤트로픽의 감시 플러그인, AWS의 소형 판단 모델, DeepSeek의 오픈소스 하네스처럼 에이전트의 행동을 점검하고 통제하는 도구가 잇따라 나왔어요. 셋째, 추론 비용이 1년 새 13분의 1로 떨어지고 요금제 개편과 예산 한도 논의가 나오면서 AI의 가격과 과금 방식이 바뀌고 있어요. 넷째, 알레프 알파의 콜리브리와 엔비디아의 DGX 스파크 파생 모델처럼 소버린 AI와 로컬 추론 인프라 선택지도 넓어지고 있어요.
- 제미나이 4·DevDay로 본 장시간 에이전트 경쟁
- 에이전트 감시·통제 도구의 확산
- 추론 가격 폭락과 과금·요금제 변화
- [AI는 지금] 챗GPT·클로드 추격할까…'제미나이4' 띄운 구글, 기술·가격·마케팅 총공세
구글이 10개월 만에 제미나이 4 아르곤을 내놓고 출력 토큰을 100만 개로 늘렸어요. 장시간 에이전트 작업과 가격 경쟁이 본격화됐지만 현재는 일부 보안 전문가에게만 제공돼요.
- The Sequence Radar - Issue 944 — Last Week in AI: Last Week in AI: OpenAI Connects the Dots, Gemini Levels Up, and Agents Cash In
OpenAI DevDay의 지속형 에이전트 Dots, Gemini 4, Meta 엔터프라이즈 플랫폼, AMD의 World Labs 인수 합의까지 지난주 핵심 소식을 한눈에 정리했어요.
- [AI픽] "AI 두뇌값 1년새 13분의 1"…유례없는 가격 폭락
비슷한 수준의 문제를 푸는 추론 비용이 1년 새 약 13분의 1로 떨어졌어요. AI 서비스의 원가 구조와 가격 전략이 바뀌는 신호예요.
- "클로드가 일하고, 클로드가 감시한다"... 앤트로픽, '알아두어야 할 사항' 플러그인 공개
앤트로픽이 클로드 코드에 보조 에이전트가 메인 작업을 지켜보고 중요한 내용을 알려주는 플러그인을 넣었어요. AI가 AI를 감시하는 구조가 제품에 들어오기 시작했어요.
- "답변 생성·판단 나눠"…아마존, AI 에이전트 행동 점검 모델 공개
AWS가 20억 파라미터 소형 모델 스트랜즈 디사이더 2B를 아파치 2.0으로 공개했어요. 에이전트의 도구 실행 여부와 추가 질문 필요 여부를 수십 밀리초 안에 점검해요.
- DeepSeek Harness v0.2 Brings Official Desktop Apps to Its Open-Source Agent Harness
DeepSeek이 MIT 라이선스 에이전트 하네스 v0.2와 공식 데스크톱 앱을 공개했어요. 모델 어댑터와 도구를 플러그인으로 바꿔 끼울 수 있지만 개발자 프리뷰라 호환성이 깨질 수 있어요.
- 구글, 제미나이 요금제 개편..무료·저가 요금제서 '프로' 모델 뺀다
구글이 9일부터 무료와 AI 플러스 요금제에서 제미나이 프로 모델을 빼요. 프로급 모델은 상위 유료 요금제로 묶는 흐름이 뚜렷해졌어요.
- Aleph Alpha Releases Kolibri: A 78.1B Open-Weight English-German MoE Model With Only 3.46B Active Parameters
Aleph Alpha가 전체 78.1B에 활성 3.46B 규모인 영어·독일어 MoE 모델 콜리브리를 아파치 2.0으로 공개했어요. 성능 경쟁보다 데이터 주권과 EU 규제 대응에 초점을 둔 점이 특징이에요.
- We're going to need default hard budget caps on pretty much everything
Simon Willison은 코딩 에이전트의 예기치 않은 비용 폭증을 막으려면 경고만 보내는 소프트 캡이 아니라 기본 하드 예산 한도가 필요하다고 주장했어요. AWS와 구글 클라우드가 이미 관련 기능을 내놓았어요.
- 티냅스, 창업 1년여 만에 ‘엔비디아 인셉션 챌린지 2026’ 톱10 선정
티냅스는 에이전트 실행 직전에 기업 정책을 확인해 통과 또는 차단하는 검증 계층으로 엔비디아 인셉션 챌린지 톱10에 올랐어요. KB국민은행과 금융권 검증 협업도 진행했어요.
- [AI 리더스] 모리타 준 퍼플렉시티 APAC "연내 韓 법인 설립, AI 선택지 넓혀"
퍼플렉시티가 연내 한국 법인을 세우겠다고 밝혔어요. 20~30개 LLM을 골라 쓰고 교차 검증하는 퍼플렉시티 컴퓨터와 하이브리드 컴퓨트를 앞세워 국내 기업과 협력을 넓힐 계획이에요.
- 화면 안 보고 게임한다…GPT-6 아스트라, 'WoW' 40분 만에 클리어
한 연구자가 GPT-6 아스트라로 월드 오브 워크래프트의 오크 시작 지역 퀘스트를 화면 없이 40분 만에 끝냈다고 밝혔어요. 모델의 자율 실행 능력을 보여주는 사례지만 개인 실험이라 검증이 필요해요.
- 엔비디아, 메모리 64GB 탑재 'DGX 스파크' 이달 출시
엔비디아가 메모리를 64GB로 줄인 DGX 스파크 파생 모델을 23일부터 4999달러에 공급해요. 메모리 공급난으로 가격이 오른 가운데 로컬 추론 선택지가 넓어졌어요.
- Building a RAG Pipeline for Semantic Code Search
JetBrains가 시맨틱 코드 검색용 RAG 파이프라인을 만든 과정을 개발자 일지로 공유했어요. 본문이 제공되지 않아 구체적인 구현과 성능은 원문에서 확인해야 해요.