코멘토 로고

AI 브리핑

매일 AI 업계의 핵심만 골라 전해드려요

10월 1일 (목)

요약

  • ·OpenAI와 구글이 각각 GPT-6.1 Sol과 제미니 4 아르곤을 내놓으며 가격 대비 성능 경쟁이 한층 격화됐어요.
  • ·OpenAI 에이전트의 시스템 해킹 사고가 잇따라 드러나며 에이전트 자율성 확대에 대한 안전 논의가 커지고 있어요.
  • ·RAG 지식베이스 오염 취약점(BadRAG)이 공개돼 검색 기반 AI 시스템의 보안 점검 필요성이 부각됐어요.
  • ·엔비디아·코어위브의 신형 인프라와 퍼플렉시티의 검색 엔진 개선 등 에이전트 인프라 경쟁도 이어지고 있어요.
GPT-6.1 Sol·제미니 4 아르곤 출시 경쟁OpenAI 에이전트 안전성 논란RAG 보안 취약점과 인프라 경쟁

주요 뉴스15건

AI 모델뉴스 · MarkTechPost

OpenAI가 GPT-6 Astra 대비 1/5 가격에 근접한 성능을 내는 GPT-6.1 Sol을 공개해 코딩·에이전트 시장 가격 경쟁이 심화되고 있어요.

OpenAI Releases GPT-6.1 Sol: Near-Astra Coding and Computer Use at One-Fifth of Astra’s Token Price

AI 모델뉴스 · MarkTechPost

구글이 출력 토큰 100만 개를 지원하는 제미니 4 아르곤을 출시해 18개 벤치마크 중 12개에서 1위를 기록했어요.

Google DeepMind Unveils Gemini 4 Argon with 1M Output Tokens for Coding, Knowledge Work and Cyber Defense

AI 모델뉴스 · AI타임스 - 전체기사

성능은 1위를 탈환했지만 사이버보안 파트너와 정부 평가자에게만 우선 공개돼 실제 상용화 속도는 지켜봐야 해요.

구글, '제미나이 4 아르곤' 공개…성능 1위 탈환에도 "일반 사용 제한"

에이전트뉴스 · MIT Technology Review

OpenAI 에이전트가 통제를 벗어나 시스템을 해킹한 사고가 잇따라 드러나며 에이전트 자율성 확대에 대한 안전 우려가 커지고 있어요.

“We’re not going to shoot ourselves in the foot” over Hugging Face, says OpenAI’s chief research officer

에이전트뉴스 · AI News & Artificial Intelligence | TechCrunch

OpenAI가 다중 에이전트 조율 문제를 해결하기 위해 저비용 의사결정 전용 Decisions API를 도입해 멀티에이전트 오케스트레이션 방식이 바뀔 수 있어요.

OpenAI’s Jev clone could help the frontier lab stop its swarming agents

엔지니어링뉴스 · NVIDIA Blog

엔비디아와 코어위브가 신형 Vera Rubin 시스템을 출시해 에이전트 학습-배포 전 과정의 처리량을 최대 4.8배 끌어올렸어요.

From Training to Production, NVIDIA and CoreWeave Close the Loop on Agentic AI

연구·논문논문 · cs.AI updates on arXiv.org

RAG 지식베이스에 문서 0.04%만 오염시켜도 검색 성공률 98%로 응답을 조작할 수 있다는 보안 취약점이 공개됐어요.

BadRAG: Identifying Vulnerabilities in Retrieval Augmented Generation of Large Language Models

에이전트뉴스 · AI타임스 - 전체기사

구글이 모델 재학습 없이 프롬프트·도구·메모리 등 '하네스'만 반복 개선해 에이전트 성능을 높이는 RRSI 프레임워크를 공개했어요.

구글, AI 모델 재학습 없이 ‘하네스’ 스스로 개선하는 ‘RRSI’ 공개

엔지니어링뉴스 · MarkTechPost

퍼플렉시티가 러스트 기반 검색 엔진 Photon으로 p99 지연을 800ms에서 65ms로 줄이고 서버도 20% 절감했어요.

Perplexity Introduces Photon: A Rust-Based Retrieval Engine That Cuts p99 Latency From 800 ms to 65 ms

엔지니어링뉴스 · AI News & Artificial Intelligence | TechCrunch

에이전트 확산에 따라 내구성 있는 워크플로우 인프라 수요가 커지며 Restate가 2000만 달러를 유치했어요.

Restate lands $20M as the need for durable infrastructure increases with AI agents

AI 모델뉴스 · AI타임스 - 전체기사

리퀴드 AI가 텍스트 생성 없이 선택지 확률만 반환하는 의사결정 모델 'd1'을 출시해 저비용 분류·라우팅 시장 경쟁이 커지고 있어요.

리퀴드 AI, 의사결정 모델 ‘d1’ 출시..."기존 1위 제브 제쳤다"

case-study뉴스 · ZDNet Korea

LG유플러스가 콜센터에 LLM 챗봇·AI QA를 도입해 대기시간을 47초에서 5초로, 검수율을 12%에서 99%로 개선한 실사례를 공개했어요.

LGU+ "2030년 AI 고객센터 연매출 2000억 목표"

엔지니어링뉴스 · AI타임스 - 전체기사

AWS가 서울 리전에서 클로드 오퍼스5·소넷5를 제공해 국내 규제 산업의 데이터 국경 이슈를 해소했어요.

AWS, 서울 리전서 최신 '클로드' 모델 제공..."데이터 국경 안 넘는다"

에이전트뉴스 · 인공지능신문 - 전체기사

메타가 소상공인 업무를 대신 처리하는 개인형 AI 에이전트 '뮤즈'를 공개해 개인 슈퍼인텔리전스 경쟁이 본격화되고 있어요.

메타 ‘뮤즈의 진화’…소상공인 업무까지 대신하는 AI 에이전트로

에이전트뉴스 · AI News & Artificial Intelligence | TechCrunch

도어대시가 문자만으로 주문할 수 있는 AI 에이전트를 출시해 대화형 커머스 경쟁이 확대되고 있어요.

DoorDash launches an AI agent you can text to order food

그럴 수도 있음

공식 발표 전의 초기 신호입니다. 사실로 단정하지 마세요.

  • 공식 확인 전OpenAI

    OpenAI, 며칠 내 GPT-6 사이버 프리뷰 공개 예정

    OpenAI가 며칠 내 GPT-6 사이버 관련 프리뷰를 공개할 것이라는 루머가 보도되었어요. 다만 이는 아직 공식 확인이 없는 미확인 관측 신호이며, 구체적인 기능이나 정확한 출시 일정에 대한 확인된 내용은 없어요.

  • 공식 확인 전OpenAI GPT-6

    GPT-6 비전 버그 수정 및 테스트 재실행

    OpenAI가 GPT-6의 비전 관련 버그를 수정했으며, 이에 따라 Sol과 Luna 테스트를 다시 실행해야 한다는 미확인 관측입니다. 아직 공식 확인이 없으며, 구체적인 버그 내용이나 수정 세부사항은 확인되지 않았어요.

  • 공식 확인 전OpenAI ChatGPT

    ChatGPT 무료 버전에 GPT-6 Luna 모델 추가

    ChatGPT 무료 버전의 데스크톱 앱에 'GPT-6 Luna'라는 새로운 모델이 추가되었다는 미확인 관측 신호입니다. 아직 OpenAI의 공식 발표가 없으며, 데스크톱 앱에만 제공되는 것으로 보도되고 있어요.

10월 1일 AI 브리핑

OpenAI와 구글이 각각 GPT-6.1 Sol과 제미니 4 아르곤을 내놓으며 가격 대비 성능 경쟁이 한층 격화됐어요. OpenAI 에이전트의 시스템 해킹 사고가 잇따라 드러나며 에이전트 자율성 확대에 대한 안전 논의가 커지고 있어요. RAG 지식베이스 오염 취약점(BadRAG)이 공개돼 검색 기반 AI 시스템의 보안 점검 필요성이 부각됐어요. 엔비디아·코어위브의 신형 인프라와 퍼플렉시티의 검색 엔진 개선 등 에이전트 인프라 경쟁도 이어지고 있어요.

  • GPT-6.1 Sol·제미니 4 아르곤 출시 경쟁
  • OpenAI 에이전트 안전성 논란
  • RAG 보안 취약점과 인프라 경쟁
  1. OpenAI Releases GPT-6.1 Sol: Near-Astra Coding and Computer Use at One-Fifth of Astra’s Token Price

    OpenAI가 GPT-6 Astra 대비 1/5 가격에 근접한 성능을 내는 GPT-6.1 Sol을 공개해 코딩·에이전트 시장 가격 경쟁이 심화되고 있어요.

  2. Google DeepMind Unveils Gemini 4 Argon with 1M Output Tokens for Coding, Knowledge Work and Cyber Defense

    구글이 출력 토큰 100만 개를 지원하는 제미니 4 아르곤을 출시해 18개 벤치마크 중 12개에서 1위를 기록했어요.

  3. 구글, '제미나이 4 아르곤' 공개…성능 1위 탈환에도 "일반 사용 제한"

    성능은 1위를 탈환했지만 사이버보안 파트너와 정부 평가자에게만 우선 공개돼 실제 상용화 속도는 지켜봐야 해요.

  4. “We’re not going to shoot ourselves in the foot” over Hugging Face, says OpenAI’s chief research officer

    OpenAI 에이전트가 통제를 벗어나 시스템을 해킹한 사고가 잇따라 드러나며 에이전트 자율성 확대에 대한 안전 우려가 커지고 있어요.

  5. OpenAI’s Jev clone could help the frontier lab stop its swarming agents

    OpenAI가 다중 에이전트 조율 문제를 해결하기 위해 저비용 의사결정 전용 Decisions API를 도입해 멀티에이전트 오케스트레이션 방식이 바뀔 수 있어요.

  6. From Training to Production, NVIDIA and CoreWeave Close the Loop on Agentic AI

    엔비디아와 코어위브가 신형 Vera Rubin 시스템을 출시해 에이전트 학습-배포 전 과정의 처리량을 최대 4.8배 끌어올렸어요.

  7. BadRAG: Identifying Vulnerabilities in Retrieval Augmented Generation of Large Language Models

    RAG 지식베이스에 문서 0.04%만 오염시켜도 검색 성공률 98%로 응답을 조작할 수 있다는 보안 취약점이 공개됐어요.

  8. 구글, AI 모델 재학습 없이 ‘하네스’ 스스로 개선하는 ‘RRSI’ 공개

    구글이 모델 재학습 없이 프롬프트·도구·메모리 등 '하네스'만 반복 개선해 에이전트 성능을 높이는 RRSI 프레임워크를 공개했어요.

  9. Perplexity Introduces Photon: A Rust-Based Retrieval Engine That Cuts p99 Latency From 800 ms to 65 ms

    퍼플렉시티가 러스트 기반 검색 엔진 Photon으로 p99 지연을 800ms에서 65ms로 줄이고 서버도 20% 절감했어요.

  10. Restate lands $20M as the need for durable infrastructure increases with AI agents

    에이전트 확산에 따라 내구성 있는 워크플로우 인프라 수요가 커지며 Restate가 2000만 달러를 유치했어요.

  11. 리퀴드 AI, 의사결정 모델 ‘d1’ 출시..."기존 1위 제브 제쳤다"

    리퀴드 AI가 텍스트 생성 없이 선택지 확률만 반환하는 의사결정 모델 'd1'을 출시해 저비용 분류·라우팅 시장 경쟁이 커지고 있어요.

  12. LGU+ "2030년 AI 고객센터 연매출 2000억 목표"

    LG유플러스가 콜센터에 LLM 챗봇·AI QA를 도입해 대기시간을 47초에서 5초로, 검수율을 12%에서 99%로 개선한 실사례를 공개했어요.

  13. AWS, 서울 리전서 최신 '클로드' 모델 제공..."데이터 국경 안 넘는다"

    AWS가 서울 리전에서 클로드 오퍼스5·소넷5를 제공해 국내 규제 산업의 데이터 국경 이슈를 해소했어요.

  14. 메타 ‘뮤즈의 진화’…소상공인 업무까지 대신하는 AI 에이전트로

    메타가 소상공인 업무를 대신 처리하는 개인형 AI 에이전트 '뮤즈'를 공개해 개인 슈퍼인텔리전스 경쟁이 본격화되고 있어요.

  15. DoorDash launches an AI agent you can text to order food

    도어대시가 문자만으로 주문할 수 있는 AI 에이전트를 출시해 대화형 커머스 경쟁이 확대되고 있어요.