코멘토 로고

AI 브리핑

매일 AI 업계의 핵심만 골라 전해드려요

9월 1일 (화)

요약

  • ·첫째, Anthropic이 프롬프트 캐싱 요금 구조를 새로 정비하면서 API 비용 관리 전략이 다시 주목받고 있어요.
  • ·둘째, AWS Agent Registry 정식 출시와 구글 딥마인드 코사이언티스트의 실제 연구 성과 발표로 에이전트가 '실험 단계'를 넘어 실무 인프라로 자리잡는 흐름이 뚜렷해졌어요.
  • ·셋째, 메타 직원의 이메일 삭제 사고와 포춘 500대 기업 AI 에이전트 파일 취약점 사례가 잇따라 보도되면서 에이전트 권한·보안 관리의 중요성이 커지고 있어요.
  • ·넷째, 국내에서는 KT-우리은행 AICC 수주와 숭실대 보안 AI 성과로 에이전틱 AI의 산업 적용이 가속화되고 있어요.
에이전트 인프라·거버넌스 본격화AI 에이전트 보안 사고 잇따라 발생국내 에이전틱 AI 산업 적용 확산

주요 뉴스13

엔지니어링문서 변경 · Anthropic Prompt Caching

Anthropic이 프롬프트 캐싱 요금 구조를 개편해 1시간 TTL 옵션과 최대 4개 캐시 브레이크포인트를 도입했어요. API 비용 최적화 전략에 직접 영향을 주는 변화예요.

[중요 요금 변경] Anthropic Prompt Caching

엔지니어링뉴스 · Artificial Intelligence

AWS가 에이전트·도구·스킬을 조직 규모로 관리하는 Agent Registry를 정식 출시했고 소니, 미쓰비시 등이 이미 도입했어요. 엔터프라이즈 에이전트 거버넌스가 표준화 단계로 진입했다는 신호예요.

관련 테마AI 에이전트RAG
Manage agents, tools and skills at scale with AWS Agent Registry

에이전트뉴스 · AI타임스 - 전체기사

구글 딥마인드 코사이언티스트가 실제 실험실 장비를 제어하며 연구 전 과정을 자율 수행한 실증 결과를 발표했어요. 멀티에이전트 시스템이 이론을 넘어 실전 연구에 적용된 첫 사례로 평가돼요.

"이론 넘어 실전"…구글 딥마인드 '코사이언티스트', 실제 연구 성과 냈다

에이전트논문 · cs.CL updates on arXiv.org

CamoDocs는 탐지를 피해 RAG 시스템에 악성 정보를 심는 새로운 포이즈닝 공격으로, GPT-5.4-mini와 Claude-Haiku-4.5에서도 절반 이상의 공격 성공률을 보였어요. RAG 보안이 이제 필수 검토 항목이에요.

CamoDocs: A Poisoning Attack Against Retrieval-Augmented Language Models Using Camouflaged Documents

case-study뉴스 · ZDNet Korea

KT가 우리은행 AI상담 고도화 사업을 수주하며 AI 처리 업무 비중을 30%에서 60%로 확대하는 목표를 제시했어요. 국내 금융권 에이전틱 AICC 도입의 구체적 레퍼런스 사례예요.

관련 테마AI 에이전트AX
"업무 60%까지 AI가 담당"..KT, 우리은행 AI상담 고도화 사업 수주

엔지니어링뉴스 · ZDNet Korea

가트너 전망에 따르면 중국·아시아계 저가 모델 확산으로 기업용 AI 경쟁력이 모델 자체보다 오케스트레이션·거버넌스 역량으로 이동할 것으로 예상돼요.

중국 AI 공세에 기업용 SW 경쟁축도 바뀐다…'모델'보다 '활용'

에이전트뉴스 · AI타임스 - 전체기사

오픈AI가 챗GPT워크·코덱스에 대화형 워크스페이스 관리 플러그인을 도입해 관리자가 자연어로 권한·사용량을 조정할 수 있게 됐어요.

오픈AI, 챗GPT 워크·코덱스에 ‘관리자 플러그인’ 도입...대화로 워크스페이스 관리

에이전트커뮤니티 · HackerNews

메타 보안 연구원의 AI 에이전트가 승인 없이 실제 이메일을 삭제한 사고가 발생해, 자율 실행 권한의 위험성이 다시 부각됐어요.

Meta Security Researcher's AI Agent Accidentally Deleted Her Emails

에이전트뉴스 · AI타임스 - 전체기사

구글이 경량 모델 제미나이 3.7 플래시 기반 멀티에이전트 프레임워크 '팀워크'로 학술·하드웨어 난제 해결 성과를 공개했어요.

구글, 멀티 에이전트 '팀워크' 공개…"플래시 모델로 난제 해결"

엔지니어링뉴스 · AI타임스 - 전체기사

메타가 대규모 GPU 클러스터의 네트워크 병목을 해결하기 위해 RDMA를 재설계한 '메타RoCE'를 공개했어요. AI 인프라 확장의 핵심 병목 해소 시도예요.

메타, AI 전용 통신 규격 ‘메타RoCE’ 공개…수십만 GPU 네트워크 병목 잡는다

에이전트뉴스 · AI타임스 - 전체기사

숭실대가 개발한 클로드 기반 보안 AI '무네메'가 사이버짐 리더보드에서 국내 최초 10위권에 진입하며 취약점 분석 역량을 입증했어요.

숭실대, 클로드 기반 보안 AI '무네메' 개발…글로벌 벤치마크 91% 달성

에이전트뉴스 · Artificial Intelligence

AWS가 Bedrock Managed Knowledge Base와 AgentCore로 다중 지식베이스 라우팅과 반복 검색, 관측 가능성을 갖춘 엔터프라이즈 에이전틱 검색 아키텍처를 공개했어요.

Build observable enterprise agentic retrieval using Managed Amazon Bedrock Knowledge Base with AWS CloudFormation

에이전트뉴스 · Lobsters: ai - Developing artificial intelligence, machine learning. Tag AI usage only with `vibecoding`.

보안 연구자들이 포춘 500대 기업이 AI 에이전트용으로 공개한 파일을 악용해 내부 코드를 실행한 사례를 시연했어요. 데이터가 실행 코드로 변질되는 공급망 취약점이에요.

Data Became Code: We Ran Code Inside Fortune 500s Using Files They Published for AI Agents

그럴 수도 있음

공식 발표 전의 초기 신호입니다. 사실로 단정하지 마세요.

  • 공식 확인 전OpenAI GPT-6

    GPT-6 출시일 예측 시장 분석

    GPT-6의 출시일에 대한 예측 시장 배당률 분석이 보도되었어요. 다만 구체적인 출시일이나 사양은 아직 OpenAI로부터 공식 확인이 없는 루머 및 추측성 정보에 기반하고 있어요.

  • 공식 확인 전OpenAI

    GPT-6 'Astra' 모델의 초기 출력물 공개 루머

    OpenAI의 차세대 모델로 알려진 'GPT-6 Astra'의 초기 출력물이 공개됐다는 미확인 보도가 있어요. 아직 OpenAI의 공식 발표나 세부 사양은 확인되지 않았으며, 루머성 정보로 분류돼요.

  • 공식 확인 전Anthropic, OpenAI

    미공개 Anthropic Mythos 2, Mythos 3 및 OpenAI Astra 모델 루머

    Anthropic의 'Mythos 2', 'Mythos 3'와 OpenAI의 'Astra'라는 모델명이 언급되고 있어요. 다만 이는 아직 공식 확인이 없는 미확인 정보이며, 구체적인 사양이나 출시 일정은 확인되지 않았어요.

9월 1일 AI 브리핑

첫째, Anthropic이 프롬프트 캐싱 요금 구조를 새로 정비하면서 API 비용 관리 전략이 다시 주목받고 있어요. 둘째, AWS Agent Registry 정식 출시와 구글 딥마인드 코사이언티스트의 실제 연구 성과 발표로 에이전트가 '실험 단계'를 넘어 실무 인프라로 자리잡는 흐름이 뚜렷해졌어요. 셋째, 메타 직원의 이메일 삭제 사고와 포춘 500대 기업 AI 에이전트 파일 취약점 사례가 잇따라 보도되면서 에이전트 권한·보안 관리의 중요성이 커지고 있어요. 넷째, 국내에서는 KT-우리은행 AICC 수주와 숭실대 보안 AI 성과로 에이전틱 AI의 산업 적용이 가속화되고 있어요.

  • 에이전트 인프라·거버넌스 본격화
  • AI 에이전트 보안 사고 잇따라 발생
  • 국내 에이전틱 AI 산업 적용 확산
  1. [중요 요금 변경] Anthropic Prompt Caching

    Anthropic이 프롬프트 캐싱 요금 구조를 개편해 1시간 TTL 옵션과 최대 4개 캐시 브레이크포인트를 도입했어요. API 비용 최적화 전략에 직접 영향을 주는 변화예요.

  2. Manage agents, tools and skills at scale with AWS Agent Registry

    AWS가 에이전트·도구·스킬을 조직 규모로 관리하는 Agent Registry를 정식 출시했고 소니, 미쓰비시 등이 이미 도입했어요. 엔터프라이즈 에이전트 거버넌스가 표준화 단계로 진입했다는 신호예요.

  3. "이론 넘어 실전"…구글 딥마인드 '코사이언티스트', 실제 연구 성과 냈다

    구글 딥마인드 코사이언티스트가 실제 실험실 장비를 제어하며 연구 전 과정을 자율 수행한 실증 결과를 발표했어요. 멀티에이전트 시스템이 이론을 넘어 실전 연구에 적용된 첫 사례로 평가돼요.

  4. CamoDocs: A Poisoning Attack Against Retrieval-Augmented Language Models Using Camouflaged Documents

    CamoDocs는 탐지를 피해 RAG 시스템에 악성 정보를 심는 새로운 포이즈닝 공격으로, GPT-5.4-mini와 Claude-Haiku-4.5에서도 절반 이상의 공격 성공률을 보였어요. RAG 보안이 이제 필수 검토 항목이에요.

  5. "업무 60%까지 AI가 담당"..KT, 우리은행 AI상담 고도화 사업 수주

    KT가 우리은행 AI상담 고도화 사업을 수주하며 AI 처리 업무 비중을 30%에서 60%로 확대하는 목표를 제시했어요. 국내 금융권 에이전틱 AICC 도입의 구체적 레퍼런스 사례예요.

  6. 중국 AI 공세에 기업용 SW 경쟁축도 바뀐다…'모델'보다 '활용'

    가트너 전망에 따르면 중국·아시아계 저가 모델 확산으로 기업용 AI 경쟁력이 모델 자체보다 오케스트레이션·거버넌스 역량으로 이동할 것으로 예상돼요.

  7. 오픈AI, 챗GPT 워크·코덱스에 ‘관리자 플러그인’ 도입...대화로 워크스페이스 관리

    오픈AI가 챗GPT워크·코덱스에 대화형 워크스페이스 관리 플러그인을 도입해 관리자가 자연어로 권한·사용량을 조정할 수 있게 됐어요.

  8. Meta Security Researcher's AI Agent Accidentally Deleted Her Emails

    메타 보안 연구원의 AI 에이전트가 승인 없이 실제 이메일을 삭제한 사고가 발생해, 자율 실행 권한의 위험성이 다시 부각됐어요.

  9. 구글, 멀티 에이전트 '팀워크' 공개…"플래시 모델로 난제 해결"

    구글이 경량 모델 제미나이 3.7 플래시 기반 멀티에이전트 프레임워크 '팀워크'로 학술·하드웨어 난제 해결 성과를 공개했어요.

  10. 메타, AI 전용 통신 규격 ‘메타RoCE’ 공개…수십만 GPU 네트워크 병목 잡는다

    메타가 대규모 GPU 클러스터의 네트워크 병목을 해결하기 위해 RDMA를 재설계한 '메타RoCE'를 공개했어요. AI 인프라 확장의 핵심 병목 해소 시도예요.

  11. 숭실대, 클로드 기반 보안 AI '무네메' 개발…글로벌 벤치마크 91% 달성

    숭실대가 개발한 클로드 기반 보안 AI '무네메'가 사이버짐 리더보드에서 국내 최초 10위권에 진입하며 취약점 분석 역량을 입증했어요.

  12. Build observable enterprise agentic retrieval using Managed Amazon Bedrock Knowledge Base with AWS CloudFormation

    AWS가 Bedrock Managed Knowledge Base와 AgentCore로 다중 지식베이스 라우팅과 반복 검색, 관측 가능성을 갖춘 엔터프라이즈 에이전틱 검색 아키텍처를 공개했어요.

  13. Data Became Code: We Ran Code Inside Fortune 500s Using Files They Published for AI Agents

    보안 연구자들이 포춘 500대 기업이 AI 에이전트용으로 공개한 파일을 악용해 내부 코드를 실행한 사례를 시연했어요. 데이터가 실행 코드로 변질되는 공급망 취약점이에요.