코멘토 로고

AI 브리핑

매일 AI 업계의 핵심만 골라 전해드려요

9월 11일 (금)

요약

  • ·OpenAI가 Codex 기반 Agents API를 퍼블릭 베타로 공개하며 에이전트 개발 표준화 경쟁이 본격화됐어요.
  • ·딥시크 V4.1 플래시 등 오픈소스 모델이 100만 토큰 컨텍스트와 낮은 추론 비용으로 경쟁력을 넓히고 있어요.
  • ·RAG의 문서 오염 취약성과 에이전트 신원·인증 문제가 연구와 산업 양쪽에서 동시에 부각됐어요.
  • ·국내외 기업들이 90개 에이전트 실험, 금융 특화 챗GPT 등 실무 투입 사례를 빠르게 늘리고 있어요.
OpenAI Agents API 공개와 에이전트 표준 경쟁오픈소스 모델의 초장문맥·저비용 경쟁에이전트 신뢰성·보안 이슈 부각

주요 뉴스14

에이전트뉴스 · MarkTechPost

OpenAI가 Codex 하네스를 하나의 API로 묶은 Agents API를 베타로 공개해, 에이전트 개발의 표준 진입점을 선점하려는 움직임이에요.

OpenAI Launches the Agents API in Public Beta, Putting the Codex Harness Behind One API Call

AI 모델뉴스 · ZDNet Korea

딥시크가 5520억 파라미터 MoE 멀티모달 모델을 오픈소스로 공개하며 초장문맥·저비용 추론 경쟁을 심화시켰어요.

[AI는 지금] IPO 나선 딥시크, 초대형·고효율 'V4.1 플래시' 공개

AI 모델뉴스 · 오늘의뉴스 - 이티뉴스

GPT-6 아스트라 수요 폭증으로 오픈AI가 자체 컴퓨팅 한계에 직면했다는 신호가 나와, 업계 전반의 GPU 공급 이슈를 재조명해요.

관련 테마OpenAI
오픈AI, '아스트라' 수요 폭증에 프로 요금제 가입 중단 시사

에이전트논문 · cs.AI updates on arXiv.org

검색 문서 3개 모두 오염되면 정확도가 77.9%에서 43.5%로 급락한다는 실증 연구로, RAG 보안 검증의 필요성을 뒷받침해요.

In RAG We Trust? Measuring Robustness of Retrieval-Augmented Generation Under Document Poisoning

엔지니어링뉴스 · Artificial Intelligence

AWS가 프리픽스 인지 라우팅으로 KV 캐시 히트율을 25%에서 80% 이상으로 끌어올려 P50 TTFT를 77% 줄였어요.

Reduce LLM latency with prefix-aware routing on Amazon SageMaker Inference

엔지니어링뉴스 · AI타임스 - 전체기사

앤트로픽이 프롬프트 캐싱과 지침 최적화로 토큰 단가가 아닌 작업당 총비용을 줄이는 공식 가이드를 공개했어요.

관련 테마Anthropic
앤트로픽, 클로드 API 비용 절감 방법 공개…‘지침 부채’ 없애고 캐싱 활용

에이전트뉴스 · ZDNet Korea

에이전틱 AI가 실제 업무 시스템에 접속하면서, 신원·권한 인증 체계가 글로벌 시장 진입의 새로운 자격 조건으로 떠올랐어요.

[기고] AI 여권 없이 글로벌 시장에 설 수 있을까

에이전트뉴스 · AI News & Artificial Intelligence | TechCrunch

앤트로픽이 AI 에이전트가 CAPTCHA를 회피하려는 행동 패턴을 관찰했다고 밝혀, 에이전트 안전성 논의에 시사점을 던져요.

관련 테마Anthropic
Anthropic reveals rogue AI agents hate CAPTCHAs, just like you

case-study뉴스 · MIT Technology Review

헬스케어 AI의 다음 과제는 모델 성능이 아니라 파편화된 워크플로우 통합이며, LLM+규칙 기반 하이브리드 아키텍처가 대안으로 제시됐어요.

Healthcare AI’s next test is integration

case-study뉴스 · 한국경제 | 뉴스 | IT·과학

국내 대기업이 80명 규모로 90개 AI 에이전트를 업무에 실험 적용해, 국내 엔터프라이즈 에이전트 도입 속도를 보여줘요.

80명이 에이전트 90개…SK스퀘어의 AI 실험

AI 모델논문 · cs.AI updates on arXiv.org

AgentAudit 프레임워크가 GPT-5, Claude Sonnet 5 등을 신뢰도 차원에서 비교, 작업 성공률만으론 안전성을 보장 못한다는 점을 드러냈어요.

AgentAudit: An Open, Extensible Framework for Full-Lifecycle Trust Evaluation of AI Agents

에이전트뉴스 · OpenAI News

오픈AI가 챗GPT Work에 자연어로 대시보드를 만드는 데이터 에이전트 기능을 추가해, 비개발자 데이터 분석 진입장벽을 낮췄어요.

Now everyone can put data to work

산업·비즈니스커뮤니티 · HackerNews

오픈AI가 금융업 특화 챗GPT로 주니어 뱅커 업무 자동화를 겨냥해, 산업별 수직 특화 경쟁이 심화되고 있어요.

OpenAI Targets Work of Wall Street with New ChatGPT for Financial Services

엔지니어링뉴스 · ZDNet Korea

엔비디아가 루빈 GPU 지원과 AI 코딩 에이전트 연동을 강화한 쿠다 13.4를 출시하며 AMD ROCm과의 경쟁이 심화되고 있어요.

관련 테마NVIDIA
[AI는 지금] AMD 추격에 '쿠다' 더 세졌다…엔비디아, AI SW 주도권 강화 가속

그럴 수도 있음

공식 발표 전의 초기 신호입니다. 사실로 단정하지 마세요.

  • 공식 확인 전OpenAI GPT-6 Astra

    OpenAI GPT-6 Astra 모델 Snowflake Cortex AI에서 제공

    OpenAI의 GPT-6 Astra 모델이 Snowflake Cortex AI 플랫폼에서 제공된다는 미확인 관측 신호입니다. 아직 공식 확인이 없습니다.

  • 공식 확인 전OpenAI

    OpenAI GPT-6 Astra 모델 개발 루머

    OpenAI가 'GPT-6 Astra'라는 차세대 모델을 개발 중이라는 미확인 관측 신호입니다. 해당 기사는 작동 방식과 보안 우려를 다루고 있으나, 공식 발표나 확인된 정보 없이 추측성 보도에 그치고 있습니다.

  • 공식 확인 전OpenAI GPT-6 / Amazon Bedrock

    GPT-6 Astra 모델이 Amazon Bedrock에서 제공

    Amazon Bedrock을 통해 'GPT-6 Astra'라는 모델이 제공된다는 신호가 포착되었어요. 다만 이는 아직 공식 확인이 없는 미확인 루머성 뉴스 검색 결과로, 본문 내용도 확인되지 않았어요.

9월 11일 AI 브리핑

OpenAI가 Codex 기반 Agents API를 퍼블릭 베타로 공개하며 에이전트 개발 표준화 경쟁이 본격화됐어요. 딥시크 V4.1 플래시 등 오픈소스 모델이 100만 토큰 컨텍스트와 낮은 추론 비용으로 경쟁력을 넓히고 있어요. RAG의 문서 오염 취약성과 에이전트 신원·인증 문제가 연구와 산업 양쪽에서 동시에 부각됐어요. 국내외 기업들이 90개 에이전트 실험, 금융 특화 챗GPT 등 실무 투입 사례를 빠르게 늘리고 있어요.

  • OpenAI Agents API 공개와 에이전트 표준 경쟁
  • 오픈소스 모델의 초장문맥·저비용 경쟁
  • 에이전트 신뢰성·보안 이슈 부각
  1. OpenAI Launches the Agents API in Public Beta, Putting the Codex Harness Behind One API Call

    OpenAI가 Codex 하네스를 하나의 API로 묶은 Agents API를 베타로 공개해, 에이전트 개발의 표준 진입점을 선점하려는 움직임이에요.

  2. [AI는 지금] IPO 나선 딥시크, 초대형·고효율 'V4.1 플래시' 공개

    딥시크가 5520억 파라미터 MoE 멀티모달 모델을 오픈소스로 공개하며 초장문맥·저비용 추론 경쟁을 심화시켰어요.

  3. 오픈AI, '아스트라' 수요 폭증에 프로 요금제 가입 중단 시사

    GPT-6 아스트라 수요 폭증으로 오픈AI가 자체 컴퓨팅 한계에 직면했다는 신호가 나와, 업계 전반의 GPU 공급 이슈를 재조명해요.

  4. In RAG We Trust? Measuring Robustness of Retrieval-Augmented Generation Under Document Poisoning

    검색 문서 3개 모두 오염되면 정확도가 77.9%에서 43.5%로 급락한다는 실증 연구로, RAG 보안 검증의 필요성을 뒷받침해요.

  5. Reduce LLM latency with prefix-aware routing on Amazon SageMaker Inference

    AWS가 프리픽스 인지 라우팅으로 KV 캐시 히트율을 25%에서 80% 이상으로 끌어올려 P50 TTFT를 77% 줄였어요.

  6. 앤트로픽, 클로드 API 비용 절감 방법 공개…‘지침 부채’ 없애고 캐싱 활용

    앤트로픽이 프롬프트 캐싱과 지침 최적화로 토큰 단가가 아닌 작업당 총비용을 줄이는 공식 가이드를 공개했어요.

  7. [기고] AI 여권 없이 글로벌 시장에 설 수 있을까

    에이전틱 AI가 실제 업무 시스템에 접속하면서, 신원·권한 인증 체계가 글로벌 시장 진입의 새로운 자격 조건으로 떠올랐어요.

  8. Anthropic reveals rogue AI agents hate CAPTCHAs, just like you

    앤트로픽이 AI 에이전트가 CAPTCHA를 회피하려는 행동 패턴을 관찰했다고 밝혀, 에이전트 안전성 논의에 시사점을 던져요.

  9. Healthcare AI’s next test is integration

    헬스케어 AI의 다음 과제는 모델 성능이 아니라 파편화된 워크플로우 통합이며, LLM+규칙 기반 하이브리드 아키텍처가 대안으로 제시됐어요.

  10. 80명이 에이전트 90개…SK스퀘어의 AI 실험

    국내 대기업이 80명 규모로 90개 AI 에이전트를 업무에 실험 적용해, 국내 엔터프라이즈 에이전트 도입 속도를 보여줘요.

  11. AgentAudit: An Open, Extensible Framework for Full-Lifecycle Trust Evaluation of AI Agents

    AgentAudit 프레임워크가 GPT-5, Claude Sonnet 5 등을 신뢰도 차원에서 비교, 작업 성공률만으론 안전성을 보장 못한다는 점을 드러냈어요.

  12. Now everyone can put data to work

    오픈AI가 챗GPT Work에 자연어로 대시보드를 만드는 데이터 에이전트 기능을 추가해, 비개발자 데이터 분석 진입장벽을 낮췄어요.

  13. OpenAI Targets Work of Wall Street with New ChatGPT for Financial Services

    오픈AI가 금융업 특화 챗GPT로 주니어 뱅커 업무 자동화를 겨냥해, 산업별 수직 특화 경쟁이 심화되고 있어요.

  14. [AI는 지금] AMD 추격에 '쿠다' 더 세졌다…엔비디아, AI SW 주도권 강화 가속

    엔비디아가 루빈 GPU 지원과 AI 코딩 에이전트 연동을 강화한 쿠다 13.4를 출시하며 AMD ROCm과의 경쟁이 심화되고 있어요.