GPT-5.6 Sol 개선, 무료 유저엔 Luna 배정
오픈AI가 ChatGPT Plus·Pro 사용자에게 개선된 GPT-5.6 Sol과 사고 깊이 조절 슬라이더를 제공하고, 무료 사용자 기본 모델을 GPT-5.6 Luna로 전환해 텍스트 대화 무제한을 예고했다. 내부 평가에서 GPT-5.6 Sol의 사실 오류 포함 응답이 GPT-5.5 Instant 대비 68% 줄었다고 밝혔다.
AI 모델·서비스·로보틱스의 새로운 소식
오픈AI가 ChatGPT Plus·Pro 사용자에게 개선된 GPT-5.6 Sol과 사고 깊이 조절 슬라이더를 제공하고, 무료 사용자 기본 모델을 GPT-5.6 Luna로 전환해 텍스트 대화 무제한을 예고했다. 내부 평가에서 GPT-5.6 Sol의 사실 오류 포함 응답이 GPT-5.5 Instant 대비 68% 줄었다고 밝혔다.
Anthropic이 Fable 5의 생물학 안전 분류기를 개선해 오탐(false positive)을 약 85% 줄였다. 단, 바이러스학·독성학·분자 설계 등 이중 활용 영역은 여전히 Opus 5로 우회된다.
앨런AI가 실제 수학 과외 세션 462개를 기반으로 한 AI 튜터 평가 프레임워크 'TutorMoments'를 공개했다. 교사 주석가 27명이 표시한 1,500개 이상의 핵심 판단 시점을 활용해 LLM이 언제 도와주고 언제 물러서야 하는지를 측정한다.
깃허브 코파일럿 사용량 메트릭 API가 에이전트 앱 활동을 개별 에이전트 단위로 추적하는 기능을 추가했다. 기업·조직 단위의 1일 및 28일 보고서 모두에 적용된다.
구글 제미나이가 Google Maps·Flights·Hotels 실시간 데이터와 Gmail·Photos·YouTube의 개인 정보를 연결해 사용자별 여행 일정을 자동으로 짜준다. 예약 폼 자동 입력과 항공권 검색 대행까지 지원하는 에이전트 기능 'Gemini Spark'도 함께 소개됐다.
문샷 AI가 'Kimi Agent Swarm'을 공개했다. Kimi K2.5 모델 기반으로 최대 100개의 서브 에이전트를 동시에 배포하고, 1,500회 이상의 툴 호출을 순차 실행 대비 4.5배 빠르게 처리한다.
아마존은 'Build on Trainium' 프로그램을 통해 30개 대학 34개 연구팀에 AWS Trainium 컴퓨팅 크레딧을 제공한다고 발표했다. 이번 수혜자들은 책임 AI(Responsible AI) 주제로 제안서를 제출한 연구자들이다.
마이크로소프트가 제로 트러스트 평가 도구에 AI 전용 점검 항목을 추가하고, 제로 트러스트 워크숍에 DevSecOps 필라(15개 통제 그룹, 91개 태스크)를 신설했다고 2026년 8월 4일 발표했다.
Amazon Bedrock AgentCore에서 실행되는 AI 에이전트가 사용자 PC의 Excel 파일·로컬 MCP 서버에 접근할 수 있도록 웹소켓·네이티브 메시징 기반 MCP 브리지 아키텍처를 공개했다. 내부 운영 사례에서는 출시 후 1년간 4만 1,000건 이상의 대화가 이루어졌다.
AI 에이전트가 API 값을 직접 치르는 구조를 공개했다. 계정 지갑이 한도를 정하고 가상 지갑이 그 안에서 쓴다. 다만 지금 열린 건 핸들 선점 하나뿐이다.
승인제 얼리액세스가 8월 4일 풀렸다. 엔드포인트 하나에 모드 세 개, 초당 0.17달러부터. 같은 백본이 아우디 생산 라인의 로봇을 움직인다.
방송사 창고에 잠든 수십만 시간 분량의 테이프를 태그 없이 검색 가능하게 만드는 통합 솔루션으로, 1시간 분량 영상의 메타데이터 생성에 평균 3~4분이면 충분하다.
Hedra, WaveSpeed, fal, Runware 등 4개 API를 레이턴시·비용·운영 안정성 기준으로 분석한 실무 가이드가 2026년 8월 공개됐다. WaveSpeed와 fal은 각각 1,000개 이상의 모델을 지원한다.
구글이 지난달 30일 개인용 AI 에이전트 스파크를 한국 등 160개국 이상으로 넓혔다. 클라우드에서 돌아 노트북을 닫아도 작업이 이어지는데, 정작 핵심인 크롬 자동 조작은 아직 미국뿐이다.
구글 딥마인드가 7월 30일 로봇의 다리와 몸통, 손가락을 하나의 모델로 움직이는 '제미나이 로보틱스 2'를 공개했다. 물뿌리개를 옮기는 데는 성공했지만 전구를 끼우는 성공률은 36%에 그쳤다.
왜 AI와의 대화는 늘 반 박자 늦었을까. 오픈AI가 무전기 같던 음성 AI를 전화처럼 만들기 위해 6개월간 시스템을 갈아엎은 이야기를 공개했다.
설정 오류로 인터넷에 연결된 테스트 환경에서 Claude 모델 3종이 외부 실제 기업 인프라를 침해한 사실이 드러났다. Anthropic은 14만 건 이상의 평가 세션을 검토한 끝에 4월부터 발생한 3건의 사고를 확인했다.
격리돼 있어야 할 평가 환경에 외부 인터넷 경로가 열려 있었다. 앤스로픽은 14만여 건의 평가 기록을 전수 조사했다.
마지막 기사입니다.