코멘토 로고

AI 브리핑

매일 AI 업계의 핵심만 골라 전해드려요

8월 26일 (수)

요약

  • ·첫째, OpenAI가 자체 개발한 추론 칩 Jalapeño 성능을 공개하며 Nvidia에 도전하는 하드웨어 경쟁이 본격화됐어요.
  • ·둘째, 애플도 M6/M5 Ultra와 새 맥 스튜디오로 온디바이스 AI 인프라 경쟁에 뛰어들었어요.
  • ·셋째, 구글은 제미나이 4 개발에 집중하며 모델 로드맵을 재편하는 동시에 법률 특화 엔터프라이즈 제품을 내놨어요.
  • ·넷째, 멀티에이전트 협업의 함정과 프롬프트 인젝션 위험을 짚은 연구가 나오면서 에이전트 신뢰성 논의가 이어지고 있어요.
AI 칩 경쟁: OpenAI Jalapeño vs Nvidia vs Apple구글 제미나이 로드맵과 엔터프라이즈 확장에이전트 신뢰성과 멀티에이전트 협업의 한계

주요 뉴스15

엔지니어링뉴스 · AI News & Artificial Intelligence | TechCrunch

OpenAI의 자체 추론 칩 Jalapeño가 독립 벤치마크에서 처리량과 전력 효율 모두 기존 기술을 앞섰어요. 빅테크의 자체 실리콘 경쟁이 가속화되고 있어요.

OpenAI’s Jalapeño chip is built for fast inference at scale, benchmarks show

엔지니어링커뮤니티 · HackerNews

애플이 M6/M5 Ultra를 공개하며 온디바이스 AI 연산 성능을 크게 끌어올렸어요. 로컬 추론 하드웨어 경쟁이 클라우드 의존도를 낮추는 방향으로 이어질 수 있어요.

Apple introduces M6 and M5 Ultra for a big leap in performance and AI compute

AI 모델뉴스 · AI타임스 - 전체기사

구글이 중간 모델 제미나이 3.5 프로를 건너뛰고 제미나이 4 개발에 집중한다는 관측이 나왔어요. 12월경 공개가 예상되며 차세대 플래그십 경쟁의 신호탄이 될 수 있어요.

구글, 제미나이 3.5 프로 건너뛰고 차세대 ‘제미나이 4’ 출시 준비하나

산업·비즈니스커뮤니티 · HackerNews

구글 클라우드가 법률 업무 특화 'Gemini Enterprise for Legal'을 출시했어요. 버티컬 AI 제품 경쟁이 법무 분야까지 확산되고 있어요.

Now Introducing Gemini Enterprise for Legal

에이전트뉴스 · AI타임스 - 전체기사

바이트댄스가 '두바오' 중심으로 업무용 AI 도구를 통합하는 슈퍼 앱 전략을 추진하며 에이전트 '두바오 워크'를 공개했어요. 중국 기업용 AI 에이전트 시장 경쟁이 격화되고 있어요.

바이트댄스, '두바오' 중심 AI 도구 결집...기업용 슈퍼 앱 시장 공략

AI 모델뉴스 · Hugging Face - Blog

IBM이 Granite 4.2 시리즈의 하이브리드 아키텍처와 학습 방식을 공개했어요. 오픈소스 진영의 효율적 모델 설계 흐름을 보여줘요.

Granite 4.2 LLMs: How They're Built

에이전트뉴스 · MarkTechPost

Perplexity가 NVIDIA DGX Spark 기반 로컬 우선 에이전트 'Portable Computer'를 출시했어요. 로컬 처리와 클라우드 에스컬레이션을 결합해 비용 효율성을 크게 높였어요.

Perplexity Ships Portable Computer on NVIDIA DGX Spark: Local Harness, OS-Enforced Sandbox, and Zero Per-Token Cost for Local Steps

산업·비즈니스뉴스 · AI News & Artificial Intelligence | TechCrunch

Anthropic이 Claude 채팅과 Cowork 간 공유 메모리 기능을 추가해 맥락 반복 입력 부담을 줄였어요. 에이전트 제품의 지속 맥락 관리 경쟁이 본격화되고 있어요.

Claude Cowork finally remembers what you told the app in chat

에이전트뉴스 · ZDNet Korea

ETRI가 오픈AI·구글·MS·앤트로픽이 참여하는 에이전틱 AI 재단(AAIF)에 가입해 MCP 등 국제표준화 논의에 합류했어요. 국내 에이전틱 AI 기술의 글로벌 표준 반영 기반이 마련됐어요.

韓, 에이전틱 AI 글로벌 표준 경쟁 합류…ETRI, AAIF 가입

엔지니어링뉴스 · 인공지능신문 - 전체기사

엔비디아가 스페이스X 그록 AI 인프라에 에이전틱 워크로드용 베라 CPU를 도입해 기가와트급 규모로 확장한다고 밝혔어요. 에이전트 전용 인프라 투자가 초대형 규모로 커지고 있어요.

엔비디아, 스페이스X '그록 AI' 인프라 기가와트급 컴퓨팅 규모로 확장

연구·논문논문 · cs.AI updates on arXiv.org

멀티에이전트 LLM이 서로 완전한 출력을 공유하면 다양성이 사라져 성능이 오히려 떨어지는 '인터랙션 택스' 현상이 실험으로 확인됐어요. 독립적 제안 생성이 이 붕괴를 막는 핵심으로 제시됐어요.

The Interaction Tax: When Communication Erases Diversity in Multi-Agent Teams

연구·논문뉴스 · TheSequence

Apple 연구팀이 지식 증류에 스케일링 법칙을 적용해 학생 모델의 손실을 교사 크기와 데이터량으로 예측 가능하게 만들었어요. 경험적 노하우에 의존하던 증류 작업을 체계화하는 계기가 될 수 있어요.

The Sequence Knowledge #920: The Physics of Teaching: Distillation Scaling Laws

연구·논문논문 · cs.AI updates on arXiv.org

에이전틱 LLM의 은닉 상태에 프롬프트 인젝션 노출 신호가 존재한다는 연구가 나왔고, 이를 활용한 방어로 공격 성공률을 34.6%에서 0%로 낮췄어요. 에이전트 보안 강화의 실용적 방향을 제시해요.

Your Agentic LLMs Secretly Encode Indirect Prompt-Injection Exposure in Hidden States

case-study뉴스 · 인공지능신문 - 전체기사

한컴이 남양유업에 에이전틱 OS를 적용하는 업무협약을 체결해 제조·유통 기업 대상 AX 사업을 확대하고 있어요. AI 솔루션을 넘어 운영체제 단위로 에이전트를 내재화하는 시도예요.

한컴, 남양유업과 에이전틱 OS 현장 적용 추진… 기업 업무 환경 실증 착수

에이전트논문 · cs.AI updates on arXiv.org

MCP 서버에서 쿼리 시점 SQL 생성 대신 도메인 특화 도구를 선택하게 하는 패턴과 오픈소스 프레임워크 MCP Blueprint가 공개됐어요. 정확도와 비용을 동시에 개선하는 실용적 엔지니어링 패턴이에요.

From SQL Generation to Tool Selection: A Domain-Oriented Pattern for MCP Servers

그럴 수도 있음

공식 발표 전의 초기 신호입니다. 사실로 단정하지 마세요.

  • 공식 확인 전Anthropic, OpenAI

    미공개 Anthropic Mythos 2, Mythos 3 및 OpenAI Astra 모델 루머

    Anthropic의 'Mythos 2', 'Mythos 3'와 OpenAI의 'Astra'라는 모델명이 언급되고 있어요. 다만 이는 아직 공식 확인이 없는 미확인 정보이며, 구체적인 사양이나 출시 일정은 확인되지 않았어요.

  • 공식 확인 전OpenAI

    GPT-6 Astra 출시 임박 루머

    OpenAI의 차세대 모델 'GPT-6 Astra'가 지연되지 않았으며 새로운 모델 출시가 임박했다는 루머가 제기되고 있어요. 다만 이는 아직 공식 확인이 없는 미확인 관측이며, 구체적인 출시일이나 기능에 대한 공식 발표는 나오지 않은 상태예요.

  • 공식 확인 전Anthropic

    Anthropic 내부 'Model 2' 모델 개발 및 Mythos 5 대비 성능 우위

    Anthropic이 내부적으로 'Model 2'라는 모델을 개발해 운용 중이며, 이 모델이 'Mythos 5'보다 우수한 성능을 보인다고 알려졌어요. 다만 이 모델을 외부에 공개할 계획은 없다고 전해졌어요. 아직 공식 확인이 없습니다.

8월 26일 AI 브리핑

첫째, OpenAI가 자체 개발한 추론 칩 Jalapeño 성능을 공개하며 Nvidia에 도전하는 하드웨어 경쟁이 본격화됐어요. 둘째, 애플도 M6/M5 Ultra와 새 맥 스튜디오로 온디바이스 AI 인프라 경쟁에 뛰어들었어요. 셋째, 구글은 제미나이 4 개발에 집중하며 모델 로드맵을 재편하는 동시에 법률 특화 엔터프라이즈 제품을 내놨어요. 넷째, 멀티에이전트 협업의 함정과 프롬프트 인젝션 위험을 짚은 연구가 나오면서 에이전트 신뢰성 논의가 이어지고 있어요.

  • AI 칩 경쟁: OpenAI Jalapeño vs Nvidia vs Apple
  • 구글 제미나이 로드맵과 엔터프라이즈 확장
  • 에이전트 신뢰성과 멀티에이전트 협업의 한계
  1. OpenAI’s Jalapeño chip is built for fast inference at scale, benchmarks show

    OpenAI의 자체 추론 칩 Jalapeño가 독립 벤치마크에서 처리량과 전력 효율 모두 기존 기술을 앞섰어요. 빅테크의 자체 실리콘 경쟁이 가속화되고 있어요.

  2. Apple introduces M6 and M5 Ultra for a big leap in performance and AI compute

    애플이 M6/M5 Ultra를 공개하며 온디바이스 AI 연산 성능을 크게 끌어올렸어요. 로컬 추론 하드웨어 경쟁이 클라우드 의존도를 낮추는 방향으로 이어질 수 있어요.

  3. 구글, 제미나이 3.5 프로 건너뛰고 차세대 ‘제미나이 4’ 출시 준비하나

    구글이 중간 모델 제미나이 3.5 프로를 건너뛰고 제미나이 4 개발에 집중한다는 관측이 나왔어요. 12월경 공개가 예상되며 차세대 플래그십 경쟁의 신호탄이 될 수 있어요.

  4. Now Introducing Gemini Enterprise for Legal

    구글 클라우드가 법률 업무 특화 'Gemini Enterprise for Legal'을 출시했어요. 버티컬 AI 제품 경쟁이 법무 분야까지 확산되고 있어요.

  5. 바이트댄스, '두바오' 중심 AI 도구 결집...기업용 슈퍼 앱 시장 공략

    바이트댄스가 '두바오' 중심으로 업무용 AI 도구를 통합하는 슈퍼 앱 전략을 추진하며 에이전트 '두바오 워크'를 공개했어요. 중국 기업용 AI 에이전트 시장 경쟁이 격화되고 있어요.

  6. Granite 4.2 LLMs: How They're Built

    IBM이 Granite 4.2 시리즈의 하이브리드 아키텍처와 학습 방식을 공개했어요. 오픈소스 진영의 효율적 모델 설계 흐름을 보여줘요.

  7. Perplexity Ships Portable Computer on NVIDIA DGX Spark: Local Harness, OS-Enforced Sandbox, and Zero Per-Token Cost for Local Steps

    Perplexity가 NVIDIA DGX Spark 기반 로컬 우선 에이전트 'Portable Computer'를 출시했어요. 로컬 처리와 클라우드 에스컬레이션을 결합해 비용 효율성을 크게 높였어요.

  8. Claude Cowork finally remembers what you told the app in chat

    Anthropic이 Claude 채팅과 Cowork 간 공유 메모리 기능을 추가해 맥락 반복 입력 부담을 줄였어요. 에이전트 제품의 지속 맥락 관리 경쟁이 본격화되고 있어요.

  9. 韓, 에이전틱 AI 글로벌 표준 경쟁 합류…ETRI, AAIF 가입

    ETRI가 오픈AI·구글·MS·앤트로픽이 참여하는 에이전틱 AI 재단(AAIF)에 가입해 MCP 등 국제표준화 논의에 합류했어요. 국내 에이전틱 AI 기술의 글로벌 표준 반영 기반이 마련됐어요.

  10. 엔비디아, 스페이스X '그록 AI' 인프라 기가와트급 컴퓨팅 규모로 확장

    엔비디아가 스페이스X 그록 AI 인프라에 에이전틱 워크로드용 베라 CPU를 도입해 기가와트급 규모로 확장한다고 밝혔어요. 에이전트 전용 인프라 투자가 초대형 규모로 커지고 있어요.

  11. The Interaction Tax: When Communication Erases Diversity in Multi-Agent Teams

    멀티에이전트 LLM이 서로 완전한 출력을 공유하면 다양성이 사라져 성능이 오히려 떨어지는 '인터랙션 택스' 현상이 실험으로 확인됐어요. 독립적 제안 생성이 이 붕괴를 막는 핵심으로 제시됐어요.

  12. The Sequence Knowledge #920: The Physics of Teaching: Distillation Scaling Laws

    Apple 연구팀이 지식 증류에 스케일링 법칙을 적용해 학생 모델의 손실을 교사 크기와 데이터량으로 예측 가능하게 만들었어요. 경험적 노하우에 의존하던 증류 작업을 체계화하는 계기가 될 수 있어요.

  13. Your Agentic LLMs Secretly Encode Indirect Prompt-Injection Exposure in Hidden States

    에이전틱 LLM의 은닉 상태에 프롬프트 인젝션 노출 신호가 존재한다는 연구가 나왔고, 이를 활용한 방어로 공격 성공률을 34.6%에서 0%로 낮췄어요. 에이전트 보안 강화의 실용적 방향을 제시해요.

  14. 한컴, 남양유업과 에이전틱 OS 현장 적용 추진… 기업 업무 환경 실증 착수

    한컴이 남양유업에 에이전틱 OS를 적용하는 업무협약을 체결해 제조·유통 기업 대상 AX 사업을 확대하고 있어요. AI 솔루션을 넘어 운영체제 단위로 에이전트를 내재화하는 시도예요.

  15. From SQL Generation to Tool Selection: A Domain-Oriented Pattern for MCP Servers

    MCP 서버에서 쿼리 시점 SQL 생성 대신 도메인 특화 도구를 선택하게 하는 패턴과 오픈소스 프레임워크 MCP Blueprint가 공개됐어요. 정확도와 비용을 동시에 개선하는 실용적 엔지니어링 패턴이에요.