Granite 4.2
IBM 研究院发布的开源语言模型系列,推出3B、8B、30B三种规模,首次具备了先思考后回答的能力。
简单来说
Granite 4.2 是 IBM 研究院语言模型系列的最新版本。IBM 把它做成了3B、8B、30B三种规模,并全部免费开放供大家使用。这里的数字表示模型的大小:数字越大,模型能学习和记住的东西就越多,但运行所需的计算资源也越多。
在此之前,Granite 一直像一个忠实执行指令的助手。但从4.2版本开始,它养成了一个新习惯——在给出答案之前,先在脑子里把思路理一理。这就好比解数学题时,不直接写答案,而是先一步一步写出解题过程,最后再给出答案。三种规模都具备了这种思考习惯,但真正训练去动手做事——比如修改代码、操作终端等——的只有8B和30B,最小的3B跳过了这项训练。
两个较大的模型依次练习了修复软件、操作命令行、在网络上搜索等任务,由此培养出真正会使用工具的实力。所以尽管它们都叫Granite 4.2,3B只是一个善于对话的模型,而8B和30B则既能对话,又能处理实际工作。
在报道中是这样出现的
常见的说法类似「IBM Granite 4.2,只教会了8B和30B使用工具」。核心在于,即便名字相同,不同规模的模型实际能力也不一样,所以如果认为「用Granite 4.2的话,不管哪个规模都能一样修改代码」,那就是一种误解。3B会思考,但没有接受过工具使用方面的训练。
亲手试一试
如果能运行Granite 4.2的8B或30B版本,可以试着让它解一道数学题或修复一个代码漏洞。观察它是否会先写出解题过程,再给出答案——这正是新增的推理习惯的体现。也可以把同样的问题拿去问3B,比较一下它在没有工具的情况下是如何回答的。
相关词条
出现过这个词的报道
- 美国利率上升动摇AI热潮,AMD发布新款EPYC、GPT-5.6降价商业 · 2026.08.18
- Together AI、IBM、NVIDIA 在IBM Cloud部署B300集群商业 · 2026.08.12
- Qwen新模型Qwen3.8-Flash-Next发布,75GB内存即可本地运行AI · 2026.08.27
- 本地LLM社区指出8B~12B新模型断档AI · 2026.08.11
- DeepSeek v4 Flash 0731,RTX 4090与Tesla P40组合本地运行成功AI · 2026.08.10
- Together AI,在印度最大AI工厂部署1万块B300 GPU商业 · 2026.08.14
