DeepSeek이 2조 파라미터 모델을 학습 중이며 8조 파라미터 모델까지 계획하고 있다는 소식이에요. 초거대 모델 경쟁이 다시 격화될 신호예요.
AI 브리핑
매일 AI 업계의 핵심만 골라 전해드려요
요약
- ·첫째, DeepSeek과 StepFun 등 중국 AI 기업들이 초대형·에이전틱 특화 모델을 잇달아 공개하며 모델 경쟁이 가속화되고 있어요.
- ·둘째, AWS와 NVIDIA를 중심으로 에이전트 하니스와 보안 프레임워크가 정비되면서 에이전틱 AI의 엔지니어링 표준화가 진행되고 있어요.
- ·셋째, AI 챗봇의 금융 답변 오류 조사 결과가 나오면서 신뢰성과 검증 절차의 중요성이 다시 부각됐어요.
- ·넷째, 벤치마크 스타트업 투자와 국내 파운데이션 모델 다운로드 경쟁 등 AI 생태계 전반의 저변이 확대되고 있어요.
주요 뉴스13건
StepFun이 600B 총 파라미터 MoE 모델 'Step 5 Preview'를 공개했어요. 에이전트·코딩·금융 특화로 100만 토큰 컨텍스트를 지원해요.
xAI의 Grok 4.6이 Amazon Bedrock에서 정식 지원돼요. 500K 컨텍스트와 4단계 추론 강도로 에이전트·코딩 업무를 겨냥했어요.
앤돈랩스가 AI 에이전트에 이메일·금융 계좌 권한까지 부여해 기업 경영 전반을 자율 수행하는 플랫폼 '파이온'을 공개했어요.
AI 벤치마크 스타트업 발스 AI가 a16z 주도로 4000만달러를 유치하며 기업가치 4억달러를 평가받았어요.
NVIDIA가 에이전트 스택 전 계층의 보안을 엔지니어링 문제로 다루는 프레임워크와 파트너 사례를 공개했어요.
여러 AI 챗봇이 금융 질의에 대부분 잘못된 답을 내놨다는 조사 결과가 나와 신뢰성 문제가 다시 부각됐어요.
여러 코딩 에이전트가 같은 저장소에서 동시 작업할 때 발생하는 의도 충돌을 사전에 감지하는 오픈소스 도구가 공개됐어요.
KAIST가 온디바이스 소형 AI와 서버 대형 AI가 지식을 재사용해 서버 호출을 57% 줄이는 협업 기술을 개발했어요.
샤오미가 차세대 모델 'MiMo-V2.6'의 강화학습 사후훈련 과정을 실시간 대시보드로 처음 생중계했어요.
글로벌 기업 사례를 바탕으로 AI 에이전트를 프롬프트 대상이 아닌 채용 대상처럼 관리해야 한다는 조직 운영 관점이 제시됐어요.
그럴 수도 있음
공식 발표 전의 초기 신호입니다. 사실로 단정하지 마세요.
- 공식 확인 전Anthropic
Anthropic이 신규 AI 모델 출시 검토 중
Anthropic이 OpenAI의 GPT-6 'Astra'에 대응하기 위해 신규 AI 모델 출시를 검토 중인 것으로 관측되고 있어요. 다만 이는 아직 공식 확인이 없는 미확인 신호이며, 구체적인 모델 사양이나 출시 일정은 공개되지 않았어요.
- 공식 확인 전OpenAI
OpenAI의 차세대 모델 'GPT-6 Astra' 개발 중
OpenAI가 차세대 모델로 알려진 'GPT-6 Astra'를 준비 중이라는 루머성 보도가 있어요. 다만 아직 공식 확인이 없으며, 구체적인 기능이나 출시 일정에 대한 세부 정보는 확인되지 않았어요.
- 공식 확인 전OpenAI GPT-6 Astra
GPT-6 Astra 모델 출시 및 가격 정보
GPT-6 Astra라는 모델이 강력한 성능을 보이지만 높은 가격대를 유지하고 있으며 제한적으로만 공개되고 있다는 미확인 관측입니다. 아직 공식 확인이 없습니다.
9월 22일 AI 브리핑
첫째, DeepSeek과 StepFun 등 중국 AI 기업들이 초대형·에이전틱 특화 모델을 잇달아 공개하며 모델 경쟁이 가속화되고 있어요. 둘째, AWS와 NVIDIA를 중심으로 에이전트 하니스와 보안 프레임워크가 정비되면서 에이전틱 AI의 엔지니어링 표준화가 진행되고 있어요. 셋째, AI 챗봇의 금융 답변 오류 조사 결과가 나오면서 신뢰성과 검증 절차의 중요성이 다시 부각됐어요. 넷째, 벤치마크 스타트업 투자와 국내 파운데이션 모델 다운로드 경쟁 등 AI 생태계 전반의 저변이 확대되고 있어요.
- 중국발 초대형·에이전틱 모델 경쟁 심화
- 에이전트 엔지니어링 표준화와 보안 강화
- AI 신뢰성 논쟁과 벤치마크 생태계 성장
- DeepSeek is training a 2T-parameter model and plans to build an 8T-parameter one
DeepSeek이 2조 파라미터 모델을 학습 중이며 8조 파라미터 모델까지 계획하고 있다는 소식이에요. 초거대 모델 경쟁이 다시 격화될 신호예요.
- StepFun Launches Step 5 Preview: A 600B-Total, 27B-Active MoE Model With 1M Context for Long-Horizon Agentic Work
StepFun이 600B 총 파라미터 MoE 모델 'Step 5 Preview'를 공개했어요. 에이전트·코딩·금융 특화로 100만 토큰 컨텍스트를 지원해요.
- xAI’s Grok 4.6 is now available in Amazon Bedrock
xAI의 Grok 4.6이 Amazon Bedrock에서 정식 지원돼요. 500K 컨텍스트와 4단계 추론 강도로 에이전트·코딩 업무를 겨냥했어요.
- AWS Strands Agents Team Releases Strands Harness: An Open-Source Agent Harness With 28% Lower Token Cost at Comparable Accuracy
AWS가 오픈소스 에이전트 하니스 'Strands harness'를 공개했어요. 경쟁 도구 대비 유사 정확도로 토큰 비용을 28% 줄였어요.
- 앤돈랩스, AI가 기업 전반 자율 운영하는 플랫폼 '파이온' 공개
앤돈랩스가 AI 에이전트에 이메일·금융 계좌 권한까지 부여해 기업 경영 전반을 자율 수행하는 플랫폼 '파이온'을 공개했어요.
- ‘암호 해독·마인크래프트’ 성과 낸 발스, AI 벤치마크 강자로 주목
AI 벤치마크 스타트업 발스 AI가 a16z 주도로 4000만달러를 유치하며 기업가치 4억달러를 평가받았어요.
- AI Security Is an Engineering Problem — How to Solve It at Every Layer of the Agent Stack
NVIDIA가 에이전트 스택 전 계층의 보안을 엔지니어링 문제로 다루는 프레임워크와 파트너 사례를 공개했어요.
- AI chatbots give wrong answers to financial queries 'most of the time'
여러 AI 챗봇이 금융 질의에 대부분 잘못된 답을 내놨다는 조사 결과가 나와 신뢰성 문제가 다시 부각됐어요.
- Show HN: Foremerge – Catch Intent Conflicts Between Parallel Coding Agents
여러 코딩 에이전트가 같은 저장소에서 동시 작업할 때 발생하는 의도 충돌을 사전에 감지하는 오픈소스 도구가 공개됐어요.
- KAIST, ‘지식 재사용’으로 서버 호출 57% 줄였다…“증류·추가학습 필요 없어”
KAIST가 온디바이스 소형 AI와 서버 대형 AI가 지식을 재사용해 서버 호출을 57% 줄이는 협업 기술을 개발했어요.
- 샤오미, AI 훈련 과정 첫 '생중계'…일주일 만에 50억 투입
샤오미가 차세대 모델 'MiMo-V2.6'의 강화학습 사후훈련 과정을 실시간 대시보드로 처음 생중계했어요.
- Stop Prompting, Start Employing: A Blueprint for the Agentic Enterprise
글로벌 기업 사례를 바탕으로 AI 에이전트를 프롬프트 대상이 아닌 채용 대상처럼 관리해야 한다는 조직 운영 관점이 제시됐어요.
- SKT, 독파모 13만 다운로드로 확산 선도…업스테이지·모티프 순
SK텔레콤의 독자 파운데이션 모델이 국내 평가 1위와 허깅페이스 다운로드 1위를 동시에 기록했어요.