腾讯混元公开EvolveScaler论文
腾讯混元团队9月15日公开了信息演化数据框架EvolveScaler的论文和项目页面。用先以代码定义状态、再渲染成自然语言的数据测试14个模型,在最长难度层级上avg@5中位数跌至11.3。
一家中国人工智能模型开发公司。它以极低成本打造出顶尖水平的模型,震惊了业界,并将模型权重完整开源。其代表模型为DeepSeek-V4-Pro。V4-Pro于2026年8月正式发布,具备可将推理强度调节为三个等级的功能。同月,OpenAI和Anthropic相继推出降价新品,被普遍认为是针对中国低价模型攻势做出的应对。与此同时,2026年8月有报道称,原本针对谷歌Gemma设计的越狱提示词同样对DeepSeek V4 Flash有效,同期还有人指出DeepSeek-V4-Flash-0731模型在长上下文任务中会出现卡顿现象。
当前排名 (1M)
15位
最近 30 天排名走势
2026.08.20 – 2026.09.18 · 最高 6位 · 最低 15位 · 当前 15位
腾讯混元团队9月15日公开了信息演化数据框架EvolveScaler的论文和项目页面。用先以代码定义状态、再渲染成自然语言的数据测试14个模型,在最长难度层级上avg@5中位数跌至11.3。
中国国家主席习近平9月13日在新德里举行的金砖国家领导人第十八次会晤上表示,中国将牵头建立金砖国家人工智能开源社区。这是他提出的五项合作倡议中的第一项,其中智能制造一项还提到了"标准和规范"这样的字眼。
Anthropic发布了一份154页的报告,披露了七家中国AI实验室的未经授权蒸馏行为。但正如该公司自己承认的那样,蒸馏本身是合法的——真正的问题不在被盗的账户,而在你的对话里。
一个月前才推出的 V4-Pro,将从 9 月 14 日起把请求全部交给新模型。骨干只有三分之一大,却把 KV 缓存压到每个 token 890 字节,在编码智能体评测上压过了 Opus 5。
从北京坐两小时高铁,内蒙古乌兰察布已经建起上百座数据中心。低廉的电价、寒冷的冬天,还有富余的风电,把中国AI企业吸引到了这片高原上,但水资源短缺和煤电依赖这两个问题也随之浮出水面。透过一座城市,读懂中国AI基础设施的算账逻辑。
Z.ai敲响的上市锣、用Kimi K3重写的点单系统、免费畅饮的DeepSeek、WAIC期间300人的派对。这里是创业者、开发者、投资人反复相聚的地方,正在成为中国AI生态圈的生活化基础设施。