METAL

金炫国

김현국

AI

OpenAI要求开发者精简Codex指令

OpenAI于9月11日发布指引,要求针对GPT-6 Astra清掉堆积在skills和AGENTS.md里的指令。同一周,一位开发者把同一个模型放任运行35小时,收获了7.5万行人难以阅读的代码和79次提交。

作者 김현국

110

AI

OpenAI用Python扛住每秒七千万次请求

为ChatGPT取数据的存储平台Habitat在两年间涨到每秒七千万次请求以上。OpenAI表示,这项服务一直靠Python撑着,直到今年第二季度由两名工程师配合Codex用Rust重写。

作者 김현국

90

AI

谷歌先造出答案,再给它配上问题

谷歌研究院把教AI用工具的训练数据反着做了。先写问题再找答案的老办法十次里有三次多会失败,把顺序倒过来后合格率升到99.8%。

作者 김현국

70

AI

Sakana AI发布两款替你挑模型的模型

Fugu Max把每项任务交给能解决它的最轻量模型,输出价格比同类低40%到60%。Fugu Ultra v2则在模型池里没有Fable 5.1和GPT-6 Astra的情况下拿到最高分。

作者 김현국

20

AI

OpenAI 把 Codex 的运行框架开放成 API

驱动 Codex 的那套运行框架,如今由 OpenAI 代为运营,以 Agents API 的形式进入公开测试。会话与上下文管理交给 OpenAI,应用只需挑选工具和执行环境,只是数据目前仍只留在美国。

作者 김현국

70

AI

美国编码模型建在中国模型之上

Cognition 推出的 SWE-2 以中国的 Kimi K3 为底座,再做了一轮强化学习。公司称其性能与 Fable 5.1 只差一个百分点,价格却便宜 64%。

作者 김현국

80

研究室

我问的是Kimi,回答的却是Claude

Anthropic发布了一份154页的报告,披露了七家中国AI实验室的未经授权蒸馏行为。但正如该公司自己承认的那样,蒸馏本身是合法的——真正的问题不在被盗的账户,而在你的对话里。

作者 김현국

330

AI

Anthropic 公开八个月的 Claude 滥用案例

从疑似国家背景的间谍团伙到两名本科生,公司把八个月里滥用 Claude 的案例集中公布。它强调被盗的 API 密钥全部来自客户环境,自家系统未被攻破。

作者 김현국

110