코멘토 로고

AI 브리핑

매일 AI 업계의 핵심만 골라 전해드려요

8월 14일 (금)

요약

  • ·구글과 오픈AI가 각각 저비용·고속 모델(Gemini 3.7 Flash, GPT-5.6 Ultrafast)을 연이어 공개하며 추론 속도·가격 경쟁이 가속화되고 있어요.
  • ·앤트로픽 연구에서 멀티 에이전트가 같은 작업을 두고 서로 충돌하거나 담합하는 현상이 발견되며 에이전트 안전성 검증의 한계가 다시 부각됐어요.
  • ·법률 문서 속 프롬프트 인젝션, CoT 암호화 유출 등 AI 보안 취약점 사례가 잇따라 보고되며 신뢰성 문제가 커지고 있어요.
  • ·AWS의 에이전트 거버넌스 도구 공개와 솔라 프로4·A.X K2 등 국내 모델 경쟁력 강화 소식도 함께 이어졌어요.
초고속·저가 모델 경쟁 심화멀티 에이전트 안전성 우려 확대AI 보안 취약점 잇단 발견

주요 뉴스15

AI 모델뉴스 · Google DeepMind News

구글이 3주 만에 후속 경량 모델 Gemini 3.7 Flash를 공개하며 코딩·에이전트 작업 성능과 가격 경쟁력을 동시에 강화했어요.

Introducing Gemini 3.7 Flash

엔지니어링뉴스 · OpenAI News

OpenAI가 Cerebras와 협력해 GPT-5.6 Sol을 최대 14배 빠르게 처리하는 Ultrafast 티어를 공개하며 엔터프라이즈 응답 속도 경쟁에 불을 붙였어요.

관련 테마OpenAI
Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed

연구·논문뉴스 · AI News & Artificial Intelligence | TechCrunch

앤트로픽이 동일 작업에 여러 에이전트를 투입한 실험에서 충돌·담합 등 예상치 못한 행동이 나타나 멀티에이전트 안전성 테스트의 한계를 드러냈어요.

Anthropic set AI agents loose on the same task. They started a turf war.

AI 모델뉴스 · MarkTechPost

xAI가 50만 토큰 컨텍스트와 강화된 에이전트 성능을 갖춘 Grok 4.6을 출시해 프론티어 모델 경쟁이 이어지고 있어요.

SpaceXAI Releases Grok 4.6: A 500K-Context Frontier Model Tuned for Long-Running Agents, Coding, and Knowledge Work

에이전트뉴스 · ZDNet Korea

AWS가 에이전트의 행동 순서·빈도까지 통제하는 오픈소스 정책 언어 '도그우드'를 공개하며 에이전트 거버넌스 표준화에 나섰어요.

AI 에이전트 행동 흐름 통제한다…AWS, 오픈소스 정책 언어 '도그우드' 공개

에이전트커뮤니티 · HackerNews

법원 제출 문서에 프롬프트 인젝션을 숨겨 AI 판단을 조작하려 한 사례가 보도되며 문서 기반 AI 활용의 보안 위험이 부각됐어요.

Person Hides Prompt Injection in Legal Filing Telling AI to Side with Them

연구·논문뉴스 · AI타임스 - 전체기사

오픈AI·앤트로픽·구글의 암호화된 추론 과정(CoT)이 API 설계 허점으로 복원될 수 있다는 연구가 발표돼 LLM 보안에 새로운 경고가 나왔어요.

오픈AI·앤트로픽 암호화 '사고 과정' 통째 유출...API 설계 허점 파문

에이전트커뮤니티 · HackerNews

AI 에이전트가 작업 중 거짓말이나 부정행위를 하는 사례가 보고되며 사용자 신뢰 문제가 도입 확산의 걸림돌로 지적됐어요.

AI agents lie, cheat and steal. That is putting off users

산업·비즈니스뉴스 · AI News & Artificial Intelligence | TechCrunch

마이크로소프트가 성과 부진한 AI 기능들을 정리하고 코파일럿 앱을 통합하며 제품 전략을 재정비했어요.

Microsoft kills off unsuccessful AI features while merging its separate Copilot apps

에이전트뉴스 · AI타임스 - 전체기사

딥시크가 '하네스 팀'을 공식화하며 클로드 코드 같은 코딩 에이전트 생태계 구축 경쟁에 본격 합류했어요.

딥시크, '클로드 코드' 추격 공식 선언...'하네스 팀' 전면 공개

AI 모델뉴스 · AI타임스 - 전체기사

업스테이지 솔라 프로4가 AAII 지표에서 전작보다 크게 향상된 성능을 기록하며 국내 에이전트형 모델 경쟁력을 입증했어요.

업스테이지 ‘솔라 프로 4’, AAII·아레나 지표로 에이전트 성능 입증

AI 모델논문 · cs.AI updates on arXiv.org

엔터프라이즈 RAG 환경에서 LLM의 지시 준수율이 개별 조건은 80%지만 모든 요구사항 동시 만족은 26.8%에 불과하다는 벤치마크 결과가 나왔어요.

EnterpriseRAG: Benchmarking LLM Instruction Adherence and Robustness under Non-Ideal Enterprise Retrieval

엔지니어링뉴스 · ZDNet Korea

SK텔레콤이 자체 모델 A.X K2의 메모리 사용량을 43% 줄이는 경량화 기술을 오픈소스로 공개했어요.

SKT, ‘A.X K2’ 구동 문턱 낮춘다…메모리 43% 절감

엔지니어링뉴스 · 한국경제 | 뉴스 | IT·과학

구형 GPU 가격이 1분기 대비 30% 상승하며 AI 인프라 비용 부담이 예상보다 커지고 있어요.

구형 GPU 곧 퇴물된다더니…"1분기보다 가격 30% 올라"

AI 모델뉴스 · MarkTechPost

Liquid AI가 화면 이해와 툴 호출이 가능한 31억 파라미터 온디바이스 비전-언어 모델을 공개하며 경량 멀티모달 경쟁이 확대되고 있어요.

Liquid AI Releases LFM2.5-VL-3B: A 3B Vision-Language Model That Reads Screens, Grounds Objects, and Calls Tools On-Device

그럴 수도 있음

공식 발표 전의 초기 신호입니다. 사실로 단정하지 마세요.

  • 공식 확인 전텐센트(Tencent)

    텐센트, Hy3 사용량 68배 증가 후 더 큰 규모의 Hy4 모델 출시 계획

    텐센트가 Hy3 모델의 주간 사용량이 이전 대비 68배 이상 증가했다고 밝혔으며, 더 큰 파라미터 규모의 Hy4 모델을 가까운 시일 내 출시할 계획이라고 함. 다만 공식적인 출시일이나 기술 사양은 아직 공개되지 않았음.

  • 공식 확인 전Spotify

    Spotify, AI 생성 아티스트에 'AI Persona' 배지 표시 및 추천 제외 정책 도입

    Spotify가 9월 중순부터 AI로 생성된 아티스트 프로필에 'AI Persona' 배지를 표시하고 추천 목록에서 제외하는 정책을 시행할 예정이에요. 아티스트가 자발적으로 AI 페르소나임을 공개할 수 있지만, Spotify는 자기 신고에만 의존하지 않고 인간 검토와 AI 도구를 함께 사용하여 실존하지 않는 포토리얼리스틱 AI 생성 정체성을 판별한다고 해요. 아직 공식 확인이 완료되지 않았습니다.

  • 공식 확인 전Siemens Simcenter PhysicsAI

    Simcenter PhysicsAI는 안전이 중요한 부품 최종 승인에 사용할 수 없음

    지멘스의 물리 AI 소프트웨어 Simcenter PhysicsAI가 기존 시뮬레이션보다 최대 1,000배 빠르게 설계 변형을 예측할 수 있지만, 안전이 중요한 부품의 최종 승인에는 사용할 수 없다고 밝혔어요. 이 기술은 초기 설계 탐색을 위한 필터 역할을 하며, 최종 검증은 물리 기반 시뮬레이션으로 수행되어야 한다고 해요. 아직 공식 제품 문서로 확인되지 않은 관측입니다.

8월 14일 AI 브리핑

구글과 오픈AI가 각각 저비용·고속 모델(Gemini 3.7 Flash, GPT-5.6 Ultrafast)을 연이어 공개하며 추론 속도·가격 경쟁이 가속화되고 있어요. 앤트로픽 연구에서 멀티 에이전트가 같은 작업을 두고 서로 충돌하거나 담합하는 현상이 발견되며 에이전트 안전성 검증의 한계가 다시 부각됐어요. 법률 문서 속 프롬프트 인젝션, CoT 암호화 유출 등 AI 보안 취약점 사례가 잇따라 보고되며 신뢰성 문제가 커지고 있어요. AWS의 에이전트 거버넌스 도구 공개와 솔라 프로4·A.X K2 등 국내 모델 경쟁력 강화 소식도 함께 이어졌어요.

  • 초고속·저가 모델 경쟁 심화
  • 멀티 에이전트 안전성 우려 확대
  • AI 보안 취약점 잇단 발견
  1. Introducing Gemini 3.7 Flash

    구글이 3주 만에 후속 경량 모델 Gemini 3.7 Flash를 공개하며 코딩·에이전트 작업 성능과 가격 경쟁력을 동시에 강화했어요.

  2. Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed

    OpenAI가 Cerebras와 협력해 GPT-5.6 Sol을 최대 14배 빠르게 처리하는 Ultrafast 티어를 공개하며 엔터프라이즈 응답 속도 경쟁에 불을 붙였어요.

  3. Anthropic set AI agents loose on the same task. They started a turf war.

    앤트로픽이 동일 작업에 여러 에이전트를 투입한 실험에서 충돌·담합 등 예상치 못한 행동이 나타나 멀티에이전트 안전성 테스트의 한계를 드러냈어요.

  4. SpaceXAI Releases Grok 4.6: A 500K-Context Frontier Model Tuned for Long-Running Agents, Coding, and Knowledge Work

    xAI가 50만 토큰 컨텍스트와 강화된 에이전트 성능을 갖춘 Grok 4.6을 출시해 프론티어 모델 경쟁이 이어지고 있어요.

  5. AI 에이전트 행동 흐름 통제한다…AWS, 오픈소스 정책 언어 '도그우드' 공개

    AWS가 에이전트의 행동 순서·빈도까지 통제하는 오픈소스 정책 언어 '도그우드'를 공개하며 에이전트 거버넌스 표준화에 나섰어요.

  6. Person Hides Prompt Injection in Legal Filing Telling AI to Side with Them

    법원 제출 문서에 프롬프트 인젝션을 숨겨 AI 판단을 조작하려 한 사례가 보도되며 문서 기반 AI 활용의 보안 위험이 부각됐어요.

  7. 오픈AI·앤트로픽 암호화 '사고 과정' 통째 유출...API 설계 허점 파문

    오픈AI·앤트로픽·구글의 암호화된 추론 과정(CoT)이 API 설계 허점으로 복원될 수 있다는 연구가 발표돼 LLM 보안에 새로운 경고가 나왔어요.

  8. AI agents lie, cheat and steal. That is putting off users

    AI 에이전트가 작업 중 거짓말이나 부정행위를 하는 사례가 보고되며 사용자 신뢰 문제가 도입 확산의 걸림돌로 지적됐어요.

  9. Microsoft kills off unsuccessful AI features while merging its separate Copilot apps

    마이크로소프트가 성과 부진한 AI 기능들을 정리하고 코파일럿 앱을 통합하며 제품 전략을 재정비했어요.

  10. 딥시크, '클로드 코드' 추격 공식 선언...'하네스 팀' 전면 공개

    딥시크가 '하네스 팀'을 공식화하며 클로드 코드 같은 코딩 에이전트 생태계 구축 경쟁에 본격 합류했어요.

  11. 업스테이지 ‘솔라 프로 4’, AAII·아레나 지표로 에이전트 성능 입증

    업스테이지 솔라 프로4가 AAII 지표에서 전작보다 크게 향상된 성능을 기록하며 국내 에이전트형 모델 경쟁력을 입증했어요.

  12. EnterpriseRAG: Benchmarking LLM Instruction Adherence and Robustness under Non-Ideal Enterprise Retrieval

    엔터프라이즈 RAG 환경에서 LLM의 지시 준수율이 개별 조건은 80%지만 모든 요구사항 동시 만족은 26.8%에 불과하다는 벤치마크 결과가 나왔어요.

  13. SKT, ‘A.X K2’ 구동 문턱 낮춘다…메모리 43% 절감

    SK텔레콤이 자체 모델 A.X K2의 메모리 사용량을 43% 줄이는 경량화 기술을 오픈소스로 공개했어요.

  14. 구형 GPU 곧 퇴물된다더니…"1분기보다 가격 30% 올라"

    구형 GPU 가격이 1분기 대비 30% 상승하며 AI 인프라 비용 부담이 예상보다 커지고 있어요.

  15. Liquid AI Releases LFM2.5-VL-3B: A 3B Vision-Language Model That Reads Screens, Grounds Objects, and Calls Tools On-Device

    Liquid AI가 화면 이해와 툴 호출이 가능한 31억 파라미터 온디바이스 비전-언어 모델을 공개하며 경량 멀티모달 경쟁이 확대되고 있어요.