首页 资讯 科技 财商 汽车 文娱 家电 生活

北京, 2025年3月4日 /美通社/ -- IBM于2月底推出其 Granite 大型语言模型家族的最新一代产品 Granite 3.2,持续推动小型、高效、企业专用的 AI,为实际应用创造效益。

IBM 推出 Granite 3.2 大语言模型,体现 IBM 发展企业专用、小型、高效与实用 AI 的策略。
IBM 推出 Granite 3.2 大语言模型,体现 IBM 发展企业专用、小型、高效与实用 AI 的策略。

所有 Granite 3.2 模型均采用宽松的 Apache 2.0 开源授权条款,可在 Hugging Face 下载。部分模型现已在 IBM watsonx.ai、Ollama、Replicate 和 LM Studio 上提供,预计不久将支援 RHEL AI 1.5,为企业与开源社区注入更强大的 AI 能力。

主要亮点

IBM 持续推动企业专用的小型 AI 模型策略,并已在测试中展现高效能。例如,Granite 3.1 8B 模型在 Salesforce 大型语言模型CRM基准测试中获得高分,显示其在实际应用中的准确度和可靠性。

IBM Granite 模型家族拥有广大的合作伙伴生态体系,许多领先的软件公司已将Granite模型嵌入其技术。Granite 3.2 是 IBM 在推动企业专用小型 AI 方面的重要进展,体现了 IBM 致力于提供小型、高效、实用 AI 的产品策略。

CrushBank 首席技术官 David Tan 表示:"在 CrushBank,我们亲眼目睹了 IBM 开放、高效的人工智能模型如何为企业人工智能带来真正的价值--在性能、成本效益和可扩展性之间实现适当的平衡。Granite 3.2 通过新的推理功能更进一步,我们很高兴能在构建新的代理(智能体)解决方案时探索这些功能。"

Granite 3.2 是 IBM 产品组合和战略发展的重要一步,旨在为企业提供小型实用的 AI。虽然思维链在推理任务中表现强大,但它需要大量计算资源,并非所有任务都必须启用。因此,IBM 在 Granite 3.2 模型中加入了程式化开关功能,使用者可以根据需求开启或关闭推理模式;模型可在不启用推理的情况下运行较简单的任务,以降低不必要的计算成本。

此外,其他推理技术(例如推理扩展 Inference Scaling) 已显示 Granite 3.2 8B 模型能够在标准数学推理基准测试中,媲美甚至超越更大模型的性能。持续发展这项推理技术也是 IBM 研究团队的重点方向[4],以进一步提升 AI 的效能与应用范围。

除了 Granite 3.2 的指令、视觉和防护模型之外,IBM 也推出了新一代 TinyTimeMixers(TTM)时间序列模型,这些模型的参数少于1千万,具备长期预测能力,可进行长达两年的长期预测。这些模型为长期趋势分析提供强大工具,适用于金融与经济趋势分析、供应链需求预测,以及零售业的季节性库存规划。

IBM AI 研究副总裁 Sriram Raghavan 表示:"AI 的下一个时代将聚焦效率、整合与实际应用的影响力 — 企业应该能够在不过度消耗计算资源的情境下,取得强大的 AI 效益。IBM 最新的 Granite 模型发展专注于开放式解决方案,逐步推动 AI 的普及,使其更具成本效益,为现代企业创造更大价值。"

欲了解Granite 3.2 的技术细节,请参阅相关技术文章