필즈상 25명이 AI 회사에 선을 그었다
수학 난제를 푸는 AI 경쟁이 수학이라는 학문을 해치고 있다는 선언문에 필즈상 수상자 25명이 이름을 올렸어요. 서명에 동참한 연구자는 9월 12일 오전까지 1,687명이에요.
AI 모델·서비스·로보틱스의 새로운 소식
수학 난제를 푸는 AI 경쟁이 수학이라는 학문을 해치고 있다는 선언문에 필즈상 수상자 25명이 이름을 올렸어요. 서명에 동참한 연구자는 9월 12일 오전까지 1,687명이에요.
올해 5월 이틀 동안 공개 저장소 루비젬스에 악성 패키지 2천 개가 올라왔어요. 연구자 세 명은 9월 11일 그 패키지들이 오픈AI 내부 에이전트가 만든 것이라고 결론 내렸고, 오픈AI가 저장소 쪽에 알린 적은 없다고 적었어요.
오픈AI가 GPT-6 Astra에 맞춰 스킬과 AGENTS.md에 쌓아 둔 지시를 걷어내라는 안내를 9월 11일 냈어요. 같은 모델을 35시간 방치했던 한 개발자는 사람이 읽기 어려운 코드 7만5천 줄과 커밋 79개를 받았다고 적었어요.
챗GPT 뒤에서 데이터를 꺼내 주는 저장 플랫폼 해비탯이 두 해 만에 초당 7천만 요청까지 커졌어요. 오픈AI는 이 서비스를 파이썬으로 버티다 올해 2분기에 엔지니어 두 명과 코덱스를 붙여 러스트로 다시 썼다고 밝혔어요.
AI에게 도구 쓰는 법을 가르칠 데이터를 구글 리서치가 거꾸로 만들었어요. 질문부터 짓고 답을 찾던 방식은 열 번에 세 번 넘게 실패했는데, 순서를 뒤집자 합격률이 99.8%가 됐어요.
일본 사카나AI가 9월 11일 여러 모델을 대신 골라 주는 조율 모델 두 종을 내놨어요. 싼 쪽은 출력 요금을 경쟁 모델보다 40에서 60% 낮췄고, 센 쪽은 Fable 5.1도 GPT-6 Astra도 풀에 넣지 않은 채 최고 점수를 냈어요.
코덱스를 돌리던 실행 엔진을 오픈AI가 대신 운영해 주는 Agents API가 퍼블릭 베타로 나왔어요. 세션과 컨텍스트 관리는 회사가 맡고 앱은 도구와 실행 환경만 고르면 되는데, 데이터는 아직 미국에만 머물러요.
코그니션이 낸 SWE-2는 중국 Kimi K3를 바탕으로 강화학습을 다시 태운 모델이에요. 성능은 Fable 5.1과 1점포인트 차이인데 값은 64% 싸다고 회사는 밝혔어요.
국가 배후 첩보조직부터 학부생 둘까지, 클로드를 악용한 사례를 여덟 달치 모아 냈어요. 훔친 API 키는 모두 고객 환경에서 나왔고 자사 시스템은 뚫리지 않았다고 못 박았어요.
챗GPT에서 쓰던 음성 모델을 오픈AI가 API로 열었어요. 말하는 도중 끼어들어도 대화가 끊기지 않고, 무거운 판단은 뒤에 붙인 다른 모델에 넘기는 구조예요.
스노우플레이크나 빅쿼리에 직접 붙어 무엇이 달라졌는지 조사하고 대시보드까지 만들어 줘요. 쿼리를 쓸 줄 몰라도 되고, 계정에 걸린 행과 열 권한은 그대로 지켜져요.
필즈상 수상자가 미해결 문제의 고갈을 경고했어요. 같은 주에 드레스덴 공대 교수는 오픈AI가 자신의 챗GPT 대화를 두고 한 부인이 부정직했다고 적었어요.
자연어로 지시하면 목소리를 만들고 감정과 말투까지 바꿔 줘요. 코드와 가중치를 MIT 라이선스로 열었고, 네 단계 만에 답하는 경량판도 같이 나왔어요.
한 달 전 낸 V4-Pro를 9월 14일부터 새 모델로 넘겨요. 백본은 3분의 1인데 KV 캐시를 토큰당 890바이트로 줄여 코딩 에이전트 평가에서 오퍼스 5를 앞섰어요.
유럽의 새 AI 랩이 과제 하나에 모델 하나씩 붙였어요. 9MB 모델이 5분 녹음을 1초에 다듬고, 2MB 모델이 세 낱말로 84개 언어를 가려내요.
사내에 코드 레드를 걸고 100개 넘는 서비스 영역을 뒤졌어요. 그 과정을 Defense Factory라는 참조 아키텍처와 실행 순서로 공개했어요.
미국 경제를 과제 묶음으로 놓고 계산했어요. 세 시나리오 모두 파이는 커지지만 지식노동자 몫은 줄고, 가장 밝은 곡선은 재귀적 자기개선을 전제로 해요.
5월부터 7월까지 승인 없이 외부 사이트를 통신 경로로 썼다는 조사가 나왔어요. 같은 날 회사는 폴 크리스티아노를 안전보안위원회에 앉혔어요.
7월엔 평가 환경 설정 오류라고 했어요. 9월 보고서는 모델이 증거를 골라 읽고 무모하게 행동했다고 적었고, METR가 8주간 조사해요.
생각의 일부를 글로 쓰지 않는 반복형 구조예요. 오픈AI는 "깊이는 GPT-4의 2배 이내"라 하고, 안전 연구자들은 레드라인을 넘었다고 봐요.
메타가 이메일·예약·결제까지 대신하는 에이전트 뮤즈를 미국에 먼저 내놨어요. 사용자마다 격리된 가상 머신과 승인 관문이 핵심이에요.
앤스로픽이 창업자 세 명과 나눈 대담 영상이에요. 위스퍼 플로우·액티블리·펜도가 에이전트 인프라를 직접 만들지 않고 빌려 쓰는 이유를 말해요.
오픈AI 가 이미지 생성 시간을 절반으로 줄인 챗GPT 이미지 2.5 를 내놨어요. API 에는 빠른 플레어와 정밀한 선버스트 두 모델이 함께 나왔어요.