코멘토 로고

AI 브리핑

매일 AI 업계의 핵심만 골라 전해드려요

9월 17일 (목)

요약

  • ·앤트로픽이 클로드 챗과 코워크를 하나로 통합하고 구글은 AI 에이전트가 스마트홈 기기를 직접 제어하게 하면서, 에이전트가 일상과 업무 전반으로 빠르게 확장되고 있어요.
  • ·삼성이 미스트랄에 대규모 투자를 단행하고 엔비디아 신형 칩과 메타 자체 AI 칩 소식이 이어지며 AI 인프라 경쟁이 계속되고 있어요.
  • ·클로드 코드 계정 정지 논란과 에이전틱 보안 이슈가 부각되며 모델 종속성과 행동 통제 문제가 다시 주목받고 있어요.
  • ·의료 분야 RAG 프레임워크와 실무 벤치마크 구축 사례 등 엔지니어링 관점의 실용적 시도도 여럿 공개됐어요.
에이전트 생태계 통합 경쟁AI 인프라·투자 확대에이전트 보안과 모델 종속성 논란

주요 뉴스13

산업·비즈니스뉴스 · AI News & Artificial Intelligence | TechCrunch

앤트로픽이 클로드 챗과 코워크를 하나로 통합해 단순 질문부터 장시간 작업까지 하나의 에이전트가 처리하도록 만들었어요.

Anthropic merges Claude chat and Cowork in one interface

에이전트뉴스 · AI News & Artificial Intelligence | TechCrunch

구글이 MCP 서버로 클로드·챗GPT 등 AI 에이전트가 구글 홈 기기를 직접 제어하도록 열었어요. 에이전트의 물리적 환경 개입 범위가 넓어지고 있어요.

Your AI agents can now control your Google Home devices

AI 모델뉴스 · 인공지능신문 - 전체기사

구글이 실시간 추론과 도구 호출이 가능한 음성 AI '제미나이 3.8 라이브'를 공개해 음성 에이전트 경쁴이 본격화됐어요.

"말하면서 생각하고 행동한다"...구글, 실시간 음성 AI ‘제미나이 3.8 라이브’ 공개

AI 모델뉴스 · AI타임스 - 전체기사

삼성전자가 미스트랄에 30억유로 규모 투자를 주도하며 온프레미스 반도체 특화 모델 개발 파트너십을 맺었어요. 유럽 AI 기업 역대 최대 투자예요.

[기고] 삼성은 왜 공짜로 쓸 수 있는 미스트랄 모델에 돈을 냈나

AI 모델뉴스 · NVIDIA Blog

NVIDIA의 신형 Vera Rubin NVL72가 MLPerf 추론 벤치마크에서 기존 GB300보다 최대 3.7배 높은 처리량을 기록하며 차세대 인프라 성능을 입증했어요.

관련 테마AI 반도체NVIDIA
NVIDIA Vera Rubin NVL72 Delivers Leading Performance in MLPerf Inference v6.1 Debut

엔지니어링뉴스 · AI타임스 - 전체기사

메타가 자체 3세대 AI 칩 'MTIA 450'을 배치 준비 중이며, 빅테크의 자체 실리콘 전환이 가속화되고 있어요.

메타, 자체 AI 칩 본격 배치...비용·전력 절감 속도

에이전트뉴스 · AI타임스 - 전체기사

클로드 코드에 타사 저가 모델을 연결한 개발자가 계정 정지를 당해 모델 종속성 논란이 불거졌고, 앤트로픽은 차단 의도를 부인했어요.

"클로드 코드에 타사 모델 연결했더니 계정 정지"...앤트로픽 "차단 안 한다" 해명

에이전트뉴스 · 오늘의뉴스 - 이티뉴스

에이전틱 AI 시대에는 답변 검증보다 에이전트의 권한과 행동 통제가 보안 핵심이라는 업계 진단이 나왔어요.

[IT메가비전 2026] 에이전틱 AI 시대, 검증보다 '행동 통제'가 보안 핵심

엔지니어링GitHub · ggml-org/llama.cpp

llama.cpp에서 원격 코드 실행까지 이어질 수 있는 use-after-free 취약점이 발견돼 긴급 수정됐어요.

[ggml-org/llama.cpp] b11000 (pre-release)

에이전트논문 · cs.CL updates on arXiv.org

의료 LLM이 파라메트릭 지식, 로컬 코퍼스, 검색 증거를 종합 검증하는 CLEAR 프레임워크가 제안돼 검색으로 인한 사실 왜곡 문제를 완화했어요.

CLEAR: Cross-Source Evidence Adjudication for Large Language Models in Medicine

AI 모델뉴스 · 토스 기술 블로그, 토스 테크

토스가 공개 리더보드 점수와 실제 서비스 성능이 다르다는 문제를 바탕으로 도메인 특화 자체 벤치마크를 구축한 과정을 공개했어요.

리더보드 1등 LLM, 토스에서도 1등일까? - Toss Benchmark 구축기

case-study뉴스 · ZDNet Korea

GS샵이 모바일 앱에 대화형 AI 쇼핑 어시스턴트를 도입해 상품 검색·리뷰 분석·비교를 지원하는 서비스를 시작했어요.

"수분크림 추천해줘"…GS샵, AI가 쇼핑 도와준다

에이전트뉴스 · MarkTechPost

스탠퍼드 연구팀이 연구 논문을 자동으로 MCP 에이전트로 변환하는 Paper2Agent를 발표해 연구 재현성 자동화 가능성을 보였어요.

Stanford Researchers Release Paper2Agent: Turning Research Papers Into AI Agents That Reproduce Results and Run on New Data

그럴 수도 있음

공식 발표 전의 초기 신호입니다. 사실로 단정하지 마세요.

  • 공식 확인 전OpenAI GPT-6 Astra

    GPT-6 Astra 모델 출시 및 가격 정보

    GPT-6 Astra라는 모델이 강력한 성능을 보이지만 높은 가격대를 유지하고 있으며 제한적으로만 공개되고 있다는 미확인 관측입니다. 아직 공식 확인이 없습니다.

  • 공식 확인 전OpenAI

    OpenAI, 금융 업계 겨냥 'GPT-6 Astra' 플랫폼 준비 중

    OpenAI가 월스트리트를 겨냥한 'GPT-6 Astra' 금융 플랫폼을 준비 중이라는 미확인 관측이에요. 구체적인 기능, 출시 일정, 기술 사양 등은 아직 공식 확인이 없어요.

  • 공식 확인 전Anthropic

    앤트로픽의 미공개 내부 모델 'Mythos'와 'Model 2' 존재 추측

    레딧 커뮤니티에서 앤트로픽이 내부적으로 'Mythos'(4월부터 보유 중)와 'Model 2'라는 미공개 모델을 개발 중이라는 근거 없는 추측이 제기됐어요. 아직 공식 확인이 없으며, IPO 전 새로운 모델 출시 여부에 대한 커뮤니티 추측 수준의 정보예요.

9월 17일 AI 브리핑

앤트로픽이 클로드 챗과 코워크를 하나로 통합하고 구글은 AI 에이전트가 스마트홈 기기를 직접 제어하게 하면서, 에이전트가 일상과 업무 전반으로 빠르게 확장되고 있어요. 삼성이 미스트랄에 대규모 투자를 단행하고 엔비디아 신형 칩과 메타 자체 AI 칩 소식이 이어지며 AI 인프라 경쟁이 계속되고 있어요. 클로드 코드 계정 정지 논란과 에이전틱 보안 이슈가 부각되며 모델 종속성과 행동 통제 문제가 다시 주목받고 있어요. 의료 분야 RAG 프레임워크와 실무 벤치마크 구축 사례 등 엔지니어링 관점의 실용적 시도도 여럿 공개됐어요.

  • 에이전트 생태계 통합 경쟁
  • AI 인프라·투자 확대
  • 에이전트 보안과 모델 종속성 논란
  1. Anthropic merges Claude chat and Cowork in one interface

    앤트로픽이 클로드 챗과 코워크를 하나로 통합해 단순 질문부터 장시간 작업까지 하나의 에이전트가 처리하도록 만들었어요.

  2. Your AI agents can now control your Google Home devices

    구글이 MCP 서버로 클로드·챗GPT 등 AI 에이전트가 구글 홈 기기를 직접 제어하도록 열었어요. 에이전트의 물리적 환경 개입 범위가 넓어지고 있어요.

  3. "말하면서 생각하고 행동한다"...구글, 실시간 음성 AI ‘제미나이 3.8 라이브’ 공개

    구글이 실시간 추론과 도구 호출이 가능한 음성 AI '제미나이 3.8 라이브'를 공개해 음성 에이전트 경쁴이 본격화됐어요.

  4. [기고] 삼성은 왜 공짜로 쓸 수 있는 미스트랄 모델에 돈을 냈나

    삼성전자가 미스트랄에 30억유로 규모 투자를 주도하며 온프레미스 반도체 특화 모델 개발 파트너십을 맺었어요. 유럽 AI 기업 역대 최대 투자예요.

  5. NVIDIA Vera Rubin NVL72 Delivers Leading Performance in MLPerf Inference v6.1 Debut

    NVIDIA의 신형 Vera Rubin NVL72가 MLPerf 추론 벤치마크에서 기존 GB300보다 최대 3.7배 높은 처리량을 기록하며 차세대 인프라 성능을 입증했어요.

  6. 메타, 자체 AI 칩 본격 배치...비용·전력 절감 속도

    메타가 자체 3세대 AI 칩 'MTIA 450'을 배치 준비 중이며, 빅테크의 자체 실리콘 전환이 가속화되고 있어요.

  7. "클로드 코드에 타사 모델 연결했더니 계정 정지"...앤트로픽 "차단 안 한다" 해명

    클로드 코드에 타사 저가 모델을 연결한 개발자가 계정 정지를 당해 모델 종속성 논란이 불거졌고, 앤트로픽은 차단 의도를 부인했어요.

  8. [IT메가비전 2026] 에이전틱 AI 시대, 검증보다 '행동 통제'가 보안 핵심

    에이전틱 AI 시대에는 답변 검증보다 에이전트의 권한과 행동 통제가 보안 핵심이라는 업계 진단이 나왔어요.

  9. [ggml-org/llama.cpp] b11000 (pre-release)

    llama.cpp에서 원격 코드 실행까지 이어질 수 있는 use-after-free 취약점이 발견돼 긴급 수정됐어요.

  10. CLEAR: Cross-Source Evidence Adjudication for Large Language Models in Medicine

    의료 LLM이 파라메트릭 지식, 로컬 코퍼스, 검색 증거를 종합 검증하는 CLEAR 프레임워크가 제안돼 검색으로 인한 사실 왜곡 문제를 완화했어요.

  11. 리더보드 1등 LLM, 토스에서도 1등일까? - Toss Benchmark 구축기

    토스가 공개 리더보드 점수와 실제 서비스 성능이 다르다는 문제를 바탕으로 도메인 특화 자체 벤치마크를 구축한 과정을 공개했어요.

  12. "수분크림 추천해줘"…GS샵, AI가 쇼핑 도와준다

    GS샵이 모바일 앱에 대화형 AI 쇼핑 어시스턴트를 도입해 상품 검색·리뷰 분석·비교를 지원하는 서비스를 시작했어요.

  13. Stanford Researchers Release Paper2Agent: Turning Research Papers Into AI Agents That Reproduce Results and Run on New Data

    스탠퍼드 연구팀이 연구 논문을 자동으로 MCP 에이전트로 변환하는 Paper2Agent를 발표해 연구 재현성 자동화 가능성을 보였어요.