AI 브리핑
매일 AI 업계의 핵심만 골라 전해드려요
요약
- ·첫째, 메타 뮤즈 스파크 1.3이 오픈AI를 제치고 세계 3위 성능에 오르면서 구글 제미나이 3.8 플래시, 앤트로픽 페이블 5.1까지 모델 삼각 경쟁이 치열해졌어요.
- ·둘째, 앤트로픽이 30일 데이터 보존 정책을 철회하고 EFS를 도입했고 오픈AI는 챗GPT에 전자의무기록을 연동하는 등 엔터프라이즈 신뢰 확보 경쟁이 본격화됐어요.
- ·셋째, 오픈AI의 새 추론 기법에 안전 전문가들이 우려를 표하고 Perplexity의 인용 정확도 문제가 드러나면서 AI 신뢰성 논란이 커지고 있어요.
- ·넷째, AI 토큰 가격이 중국산 모델 경쟁으로 사상 최저치를 기록하며 업계 수익성 우려가 확산되고 있어요.
주요 뉴스13건
앤트로픽이 코딩·에이전트 작업 성능을 높이면서 비용을 최대 45% 낮춘 페이블 5.1을 출시해 에이전트 경쟁에 대응했어요.
오픈AI가 순차적 사고를 벗어난 재귀적 깊이 추론 기법을 새 모델에 도입했는데, AI 안전 전문가들이 이에 우려를 표하고 있어요.
LLM 토큰 지출 지수가 중국산 모델 경쟁으로 사상 최저치를 기록해 주요 AI 기업들의 수익성 악화 우려가 커지고 있어요.
Perplexity 답변 인용 중 3분의 1이 실제 해당 수치를 포함하지 않는다는 조사 결과가 나와 AI 검색 신뢰성 문제가 부각됐어요.
장애 학생 진로 계획을 돕는 멀티에이전트 서비스 Trinity가 미국 12개 이상 주로 확산되고 국제 확장까지 진행 중이에요.
플레이디가 6개월간 사내 TF로 AI 에이전트 42개를 자체 구축해 키워드 분석 업무를 1~2일에서 20분으로 단축했어요.
구글 연구진이 LLM 환각의 주원인이 지식 부족이 아닌 '기억 인출 실패'라며 RAG 의존을 넘어 추론 시간 확보가 해결책이라고 제시했어요.
Multiverse Computing이 4,380억 파라미터 규모의 유럽산 대형 모델 Quasar 438B를 공개해 유럽 AI 자립 흐름이 이어지고 있어요.
Perplexity가 맥용 하이브리드 컴퓨트를 출시해 민감 정보는 온디바이스, 복잡한 추론은 클라우드로 나눠 처리하는 구조를 선보였어요.
그럴 수도 있음
공식 발표 전의 초기 신호입니다. 사실로 단정하지 마세요.
- 공식 확인 전OpenAI GPT-6
GPT-6 출시일 예측 시장 분석
GPT-6의 출시일에 대한 예측 시장 배당률 분석이 보도되었어요. 다만 구체적인 출시일이나 사양은 아직 OpenAI로부터 공식 확인이 없는 루머 및 추측성 정보에 기반하고 있어요.
- 공식 확인 전OpenAI
ChatGPT 6 공개 출시 예상
OpenAI가 ChatGPT 6를 2024년 9월 3일에서 10일 사이에 공개할 것으로 예상된다는 루머성 보도예요. 아직 OpenAI의 공식 확인이 없으며, 구체적인 사실 근거 없이 출시 시점에 대한 추측만 담긴 내용이에요.
- 공식 확인 전OpenAI ChatGPT 6 Astra
ChatGPT 6 Astra가 10조 파라미터를 탑재했다는 루머
OpenAI의 차세대 모델로 알려진 'ChatGPT 6 Astra'가 10조 개의 파라미터를 탑재했다는 루머가 보도되었어요. 아직 공식 발표되지 않은 미확인 정보이며, 구체적인 성능이나 출시 일정은 확인되지 않았어요.
9월 3일 AI 브리핑
첫째, 메타 뮤즈 스파크 1.3이 오픈AI를 제치고 세계 3위 성능에 오르면서 구글 제미나이 3.8 플래시, 앤트로픽 페이블 5.1까지 모델 삼각 경쟁이 치열해졌어요. 둘째, 앤트로픽이 30일 데이터 보존 정책을 철회하고 EFS를 도입했고 오픈AI는 챗GPT에 전자의무기록을 연동하는 등 엔터프라이즈 신뢰 확보 경쟁이 본격화됐어요. 셋째, 오픈AI의 새 추론 기법에 안전 전문가들이 우려를 표하고 Perplexity의 인용 정확도 문제가 드러나면서 AI 신뢰성 논란이 커지고 있어요. 넷째, AI 토큰 가격이 중국산 모델 경쟁으로 사상 최저치를 기록하며 업계 수익성 우려가 확산되고 있어요.
- 메타·구글·앤트로픽 신모델 동시 출시로 성능 경쟁 심화
- 엔터프라이즈 데이터 보안·신뢰성 확보 경쟁
- AI 검색 신뢰도 논란과 토큰 가격 폭락
- 메타, '뮤즈 스파크 1.3' 출시...오픈AI 제치고 세계 3위 성능
메타 뮤즈 스파크 1.3이 종합 지능 지수에서 오픈AI 주요 모델을 제치고 세계 3위에 올라 모델 경쟁 구도가 재편되고 있어요.
- Introducing Gemini 3.8 Flash and 3.8 Flash Cyber
구글이 장기 에이전트 작업에 최적화된 제미나이 3.8 플래시와 보안 특화 버전을 동시 출시하며 기존 3.7 세대를 대체했어요.
- 앤트로픽, 기업 데이터 직접 관리 'EFS' 공개... 30일 보존 방침 철회
앤트로픽이 논란이 됐던 30일 데이터 보존 정책을 철회하고 고객이 직접 데이터를 관리하는 EFS를 도입해 엔터프라이즈 신뢰를 강화했어요.
- [AI프리즘] AI 에이전트 경쟁 가열…앤트로픽 '페이블 5.1' 출격
앤트로픽이 코딩·에이전트 작업 성능을 높이면서 비용을 최대 45% 낮춘 페이블 5.1을 출시해 에이전트 경쟁에 대응했어요.
- OpenAI’s new reasoning technique alarms AI safety experts
오픈AI가 순차적 사고를 벗어난 재귀적 깊이 추론 기법을 새 모델에 도입했는데, AI 안전 전문가들이 이에 우려를 표하고 있어요.
- AI 토큰 가격 사상 최저치…중국산 모델 인기·가격 경쟁 심화 여파
LLM 토큰 지출 지수가 중국산 모델 경쟁으로 사상 최저치를 기록해 주요 AI 기업들의 수익성 악화 우려가 커지고 있어요.
- 환자 차트 속으로 들어간 챗GPT…오픈AI, 진료기록 연동
오픈AI가 챗GPT를 에픽의 전자의무기록 시스템과 연동해 의료진이 진료기록을 직접 조회·요약할 수 있게 했어요.
- A third of Perplexity's citations don't contain the number they're cited for
Perplexity 답변 인용 중 3분의 1이 실제 해당 수치를 포함하지 않는다는 조사 결과가 나와 AI 검색 신뢰성 문제가 부각됐어요.
- Trinity: Agentic AI-powered transition planning for students with disabilities
장애 학생 진로 계획을 돕는 멀티에이전트 서비스 Trinity가 미국 12개 이상 주로 확산되고 국제 확장까지 진행 중이에요.
- 플레이디, AI 에이전트 42개 자체 구축…"전사 생산성 극대화"
플레이디가 6개월간 사내 TF로 AI 에이전트 42개를 자체 구축해 키워드 분석 업무를 1~2일에서 20분으로 단축했어요.
- 구글 “LLM 환각 원인은 지식 부족 아닌 '기억 인출' 실패”...‘생각하기’가 해결책
구글 연구진이 LLM 환각의 주원인이 지식 부족이 아닌 '기억 인출 실패'라며 RAG 의존을 넘어 추론 시간 확보가 해결책이라고 제시했어요.
- Quasar 438B: Europe's Leading AI Model
Multiverse Computing이 4,380억 파라미터 규모의 유럽산 대형 모델 Quasar 438B를 공개해 유럽 AI 자립 흐름이 이어지고 있어요.
- Perplexity Releases Hybrid Compute on Mac: Cloud Agents Orchestrate Down to a Local Model, Gated On Device
Perplexity가 맥용 하이브리드 컴퓨트를 출시해 민감 정보는 온디바이스, 복잡한 추론은 클라우드로 나눠 처리하는 구조를 선보였어요.