AI & Machine Learning 2026年8月26日 Ars Technica IBM的Granite 4.2:乐于住在你硬盘上的AI IBM的新Granite 4.2模型旨在让AI推理感觉不那么像云端的奢侈品,而更像车库里的爱好。 0 0 分享 X / Twitter LinkedIn 复制链接 Image: Ars Technica IBM推出了其开源权重大型语言模型家族中的最新型号,这些模型设计用于下载和自托管。新发布的Granite 4.2提供3B、8B和30B参数版本。 与之前的版本一样,IBM在这里采用了仅解码器的方法。这些新版本原生支持128,000个令牌的上下文窗口。8B和30B变体(不是3B)还经过了代理强化学习块;它们接受了扩展能力的训练,如使用终端、搜索网络或使用外部工具。3B模型也支持工具,但没有相同程度的专门训练。 除了这些调整之外,这次发布特别值得注意,因为正如IBM自己所写:“Granite 4.2是Granite语言模型家族中专注于推理的版本。” 当领域内的研究人员或开发人员说一个模型具备推理能力时,他们并不是指我们通常谈论人类推理时所假设的那种意义;模型并不是有意识地理解问题。相反,他们指的是功能性推理,特别是通过“思维链”和将中间结果向前传递多个步骤。 对用户来说,这意味着在某些情况下响应更严谨、更准确,但通常响应时间更慢,计算需求更高。 IBM的Granite模型家族很少因为最快或最具侵略性创新而登上头条。相对于本地企业空间中的其他竞争对手,如Nvidia的Nemotron,其卖点似乎是可预测的部署——这正是你期望IBM这些天优先考虑的事情。 最近关于来自Anthropic或OpenAI等公司的前沿云模型的成本和计算紧缩有大量讨论。在许多领域,个人开发者和企业组织都在探索本地模型作为更便宜的替代方案。 这也导致了对模型路由器的兴趣增加——这些AI工具的主要工作是解释用户提示、任务或项目,并将它们路由到适当规模的模型,以平衡性能、速度和成本。 这样的模型在爱好者、AI研究人员和个人开发者中也很受欢迎,因为它们可以在本地硬件上进行修补,而无需按令牌支付API费用。