코멘토 로고

AI 브리핑

매일 AI 업계의 핵심만 골라 전해드려요

8월 18일 (화)

요약

  • ·첫째, DeepSeek Harness와 OpenAI Codex 개편처럼 에이전트 프레임워크와 도구 경쟁이 오픈소스·성능 최적화 양쪽에서 빠르게 진행되고 있어요.
  • ·둘째, Groq의 네오클라우드 전환과 Anthropic의 프리미엄 매출 1위 소식은 AI 인프라·비즈니스 구조가 재편되는 흐름을 보여줘요.
  • ·셋째, 법률 RAG 환각률과 엔터프라이즈 데이터 질의 정답률(22~26%) 연구는 RAG·에이전트 시스템의 신뢰성이 아직 갈 길이 멀다는 걸 확인시켜줘요.
  • ·넷째, GPT 5.6 Sol 비전 모델 출시와 국내 솔라·라이너의 B2B 확장 소식은 모델 성능과 실사용 적용이 함께 빠르게 넓어지고 있음을 보여줘요.
에이전트 프레임워크·도구 경쟁 심화AI 인프라·비즈니스 구조 재편RAG·엔터프라이즈 질의 신뢰성 과제

주요 뉴스13

에이전트뉴스 · MarkTechPost

MIT 라이선스로 모든 구성요소를 플러그인화한 프로바이더 중립 에이전트 하네스가 나와 에이전트 생태계 표준 경쟁이 본격화됐어요.

DeepSeek AI Releases DeepSeek Harness in Developer Preview: An MIT-Licensed Agent Harness Where Everything is a Plugin

에이전트뉴스 · AI타임스 - 전체기사

코덱스가 로딩 속도 94%, 메모리 88%를 줄이며 장시간 코딩 에이전트 작업의 체감 성능을 크게 끌어올릴 예정이에요.

오픈AI, 코덱스 대대적 개편 예고… 로딩 속도 94%·메모리 사용량 88% 감축

AI 모델커뮤니티 · HackerNews

OpenAI가 자사 최고 성능 비전 모델 GPT 5.6 Sol을 공개하며 멀티모달 경쟁이 한층 치열해졌어요.

GPT 5.6 Sol is the best "vision" model OpenAI ever released

엔지니어링뉴스 · AI News & Artificial Intelligence | TechCrunch

AI 칩 기업 Groq가 네오클라우드로 사업을 전환하며 3.5억 달러를 유치, AI 인프라 시장 재편 신호가 뚜렷해졌어요.

Groq raises $350M to fuel its pivot from AI chips to neocloud

에이전트논문 · cs.CL updates on arXiv.org

최상위 법률 RAG 시스템도 최악의 경우 응답의 절반에서 환각이 발생해, 도메인 RAG 신뢰성이 여전한 과제임을 보여줘요.

How Much Do Legal RAG Systems Still Hallucinate?

AI 모델논문 · cs.AI updates on arXiv.org

엔터프라이즈 데이터에 대한 자연어 질의 정답률이 22~26%에 불과해, 구조화된 시맨틱 계획 방식이 상대적으로 우수함을 확인했어요.

SemPlan: Benchmarking Structured Semantic Planning for LLM-Based Queries over Enterprise Data

에이전트뉴스 ·

Snowflake가 시맨틱 뷰 기반 컨텍스트 레이어로 에이전트의 데이터 접근 정확도와 속도를 높이는 방식을 공개했어요.

Building a Context Layer for AI Agents | Snowflake

AI 모델커뮤니티 · HackerNews

Anthropic이 가장 비싼 가격에도 매출 1위를 차지해, 프리미엄 전략이 AI 모델 시장에서도 통한다는 신호를 보여줘요.

Anthropic becomes the 'Apple of AI': Most revenue despite being most expensive

엔지니어링뉴스 · Hugging Face - Blog

하드웨어나 모델 교체 없이 GPU 클러스터 작업 스케줄링 순서만 바꿔 활용률을 33%포인트 높인 사례예요.

Same Cluster, 33 Points More Utilization: What Changed Was the Order

AI 모델뉴스 · Artificial Intelligence

NVIDIA Nemotron 3.5 Lightning이 SageMaker JumpStart에서 배포 가능해져, 대규모 에이전트 워크로드용 MoE 모델 선택지가 넓어졌어요.

NVIDIA Nemotron 3.5 Lightning now available in Amazon SageMaker JumpStart

연구·논문커뮤니티 · HackerNews

1,500만 건의 제미나이 대화를 분석해 직장인들의 실제 AI 활용 패턴을 대규모로 파악한 첫 시도예요.

What 15M Gemini conversations tell us about AI at work

산업·비즈니스뉴스 · AI타임스 - 전체기사

업스테이지가 다음 AI 검색 요약에 자사 솔라 모델을 100% 적용하며 국내 LLM 실사용 확대의 대표 사례를 만들었어요.

업스테이지 “다음 AI 요약에 ‘솔라’ 전면 적용...실사용 확대”

산업·비즈니스뉴스 · AI타임스 - 전체기사

라이너가 B2C AI 검색 역량을 B2B 엔터프라이즈로 확장하는 전담 조직을 신설해 국내 AI 검색 시장 경쟁이 확대되고 있어요.

B2C AI 검색 노하우 B2B로 확장… 라이너, 전담 조직 'AX 디비전' 출범

그럴 수도 있음

공식 발표 전의 초기 신호입니다. 사실로 단정하지 마세요.

  • 공식 확인 전Google Health Coach / Gemini

    Google Health Coach가 Abbott Lingo 혈당 데이터 통합

    Google과 Abbott이 다년 계약을 체결하여 Gemini 기반 Google Health Coach가 Abbott의 연속혈당측정기 Lingo 데이터를 Google Health 앱에 통합할 예정이에요. Health Coach는 혈당 데이터와 활동, 수면 등 다른 건강 정보를 함께 활용해 영양, 운동, 회복 관련 추천을 제공하며, Google Health Premium 구독자에게 연내 제공될 계획이에요. 다만 이는 아직 공식 출시 전 미확인 관측 신호이며, Google은 Health Coach가 의료 목적이 아니며 AI 응답이 부정확하거나 불완전할 수 있다고 경고하고 있어요.

  • 공식 확인 전Microsoft Copilot

    Microsoft Copilot 음성 모드에서 Mico 캐릭터 제거

    마이크로소프트가 코파일럿 음성 모드에 등장하던 감정 표현 캐릭터 'Mico'를 더 이상 표시하지 않기로 했다고 알려졌어요. Mico는 Learn Live 플랫폼으로 이동할 예정이라고 해요. 아직 공식 확인이 없습니다.

  • 공식 확인 전텐센트(Tencent)

    텐센트, Hy3 사용량 68배 증가 후 더 큰 규모의 Hy4 모델 출시 계획

    텐센트가 Hy3 모델의 주간 사용량이 이전 대비 68배 이상 증가했다고 밝혔으며, 더 큰 파라미터 규모의 Hy4 모델을 가까운 시일 내 출시할 계획이라고 함. 다만 공식적인 출시일이나 기술 사양은 아직 공개되지 않았음.

8월 18일 AI 브리핑

첫째, DeepSeek Harness와 OpenAI Codex 개편처럼 에이전트 프레임워크와 도구 경쟁이 오픈소스·성능 최적화 양쪽에서 빠르게 진행되고 있어요. 둘째, Groq의 네오클라우드 전환과 Anthropic의 프리미엄 매출 1위 소식은 AI 인프라·비즈니스 구조가 재편되는 흐름을 보여줘요. 셋째, 법률 RAG 환각률과 엔터프라이즈 데이터 질의 정답률(22~26%) 연구는 RAG·에이전트 시스템의 신뢰성이 아직 갈 길이 멀다는 걸 확인시켜줘요. 넷째, GPT 5.6 Sol 비전 모델 출시와 국내 솔라·라이너의 B2B 확장 소식은 모델 성능과 실사용 적용이 함께 빠르게 넓어지고 있음을 보여줘요.

  • 에이전트 프레임워크·도구 경쟁 심화
  • AI 인프라·비즈니스 구조 재편
  • RAG·엔터프라이즈 질의 신뢰성 과제
  1. DeepSeek AI Releases DeepSeek Harness in Developer Preview: An MIT-Licensed Agent Harness Where Everything is a Plugin

    MIT 라이선스로 모든 구성요소를 플러그인화한 프로바이더 중립 에이전트 하네스가 나와 에이전트 생태계 표준 경쟁이 본격화됐어요.

  2. 오픈AI, 코덱스 대대적 개편 예고… 로딩 속도 94%·메모리 사용량 88% 감축

    코덱스가 로딩 속도 94%, 메모리 88%를 줄이며 장시간 코딩 에이전트 작업의 체감 성능을 크게 끌어올릴 예정이에요.

  3. GPT 5.6 Sol is the best "vision" model OpenAI ever released

    OpenAI가 자사 최고 성능 비전 모델 GPT 5.6 Sol을 공개하며 멀티모달 경쟁이 한층 치열해졌어요.

  4. Groq raises $350M to fuel its pivot from AI chips to neocloud

    AI 칩 기업 Groq가 네오클라우드로 사업을 전환하며 3.5억 달러를 유치, AI 인프라 시장 재편 신호가 뚜렷해졌어요.

  5. How Much Do Legal RAG Systems Still Hallucinate?

    최상위 법률 RAG 시스템도 최악의 경우 응답의 절반에서 환각이 발생해, 도메인 RAG 신뢰성이 여전한 과제임을 보여줘요.

  6. SemPlan: Benchmarking Structured Semantic Planning for LLM-Based Queries over Enterprise Data

    엔터프라이즈 데이터에 대한 자연어 질의 정답률이 22~26%에 불과해, 구조화된 시맨틱 계획 방식이 상대적으로 우수함을 확인했어요.

  7. Building a Context Layer for AI Agents | Snowflake

    Snowflake가 시맨틱 뷰 기반 컨텍스트 레이어로 에이전트의 데이터 접근 정확도와 속도를 높이는 방식을 공개했어요.

  8. Anthropic becomes the 'Apple of AI': Most revenue despite being most expensive

    Anthropic이 가장 비싼 가격에도 매출 1위를 차지해, 프리미엄 전략이 AI 모델 시장에서도 통한다는 신호를 보여줘요.

  9. Same Cluster, 33 Points More Utilization: What Changed Was the Order

    하드웨어나 모델 교체 없이 GPU 클러스터 작업 스케줄링 순서만 바꿔 활용률을 33%포인트 높인 사례예요.

  10. NVIDIA Nemotron 3.5 Lightning now available in Amazon SageMaker JumpStart

    NVIDIA Nemotron 3.5 Lightning이 SageMaker JumpStart에서 배포 가능해져, 대규모 에이전트 워크로드용 MoE 모델 선택지가 넓어졌어요.

  11. What 15M Gemini conversations tell us about AI at work

    1,500만 건의 제미나이 대화를 분석해 직장인들의 실제 AI 활용 패턴을 대규모로 파악한 첫 시도예요.

  12. 업스테이지 “다음 AI 요약에 ‘솔라’ 전면 적용...실사용 확대”

    업스테이지가 다음 AI 검색 요약에 자사 솔라 모델을 100% 적용하며 국내 LLM 실사용 확대의 대표 사례를 만들었어요.

  13. B2C AI 검색 노하우 B2B로 확장… 라이너, 전담 조직 'AX 디비전' 출범

    라이너가 B2C AI 검색 역량을 B2B 엔터프라이즈로 확장하는 전담 조직을 신설해 국내 AI 검색 시장 경쟁이 확대되고 있어요.