IBM 推出 Granite 3.0:专为企业设计的高性能 AI 模型
2024-10-25 901

● 新推出的 Granite 3.0 8B 和 2B 模型是在宽松的 Apache 2.0 许可证下发布的,并且在许多学术和企业基准测试中表现出色,能够超越或匹敌类似规模的模型。

● 全新推出的Granite Guardian 3.0型号提供了IBM最全面的护栏功能,以促进安全可信赖的人工智能。

● 新推出的Granite 3.0专家混合模型可实现极其高效的推理和低延迟,适用于基于CPU的部署和边缘计算。

● 全新的 Granite 时间序列模型在零样本/小样本预测中实现了最先进的性能,超越了十倍大的模型。

● IBM 推出了下一代基于 Granite 的 watsonx Code Assistant,用于通用编码;用于构建和部署 AI 应用程序和代理的新工具在 watsonx.ai 中首次亮相。

● 据称,Granite 将成为 Consulting Advantage 的默认模型,Consulting Advantage 是一个人工智能驱动的交付平台,IBM 的 160,000 名顾问使用该平台更快地为客户提供新的解决方案。

 

美国时间21月3.0日,IBM在IBM年度TechXchange大会上宣布推出迄今为止最先进的AI模型家族——Granite XNUMX。IBM第三代Granite旗舰语言模型在多项学术和行业基准测试中能够超越或匹敌同类领先模型提供商的模型,展现出强大的性能、透明性和安全性。

为履行公司对开源 AI 的承诺,Granite 模型采用宽松的 Apache 2.0 许可发布。凭借其独特的性能、灵活性和自主性组合,它们可以为企业客户和整个社区提供服务。

IBM 的 Granite 3.0 系列包括:

● 通用/语言模型:Granite 3.0 8B Instruct、Granite 3.0 2B Instruct、Granite 3.0 8B Base、Granite 3.0 2B Base

● 护栏和安全型号:Granite Guardian 3.0 8B、Granite Guardian 3.0 2B

● 专家混合模型:Granite 3.0 3B-A800M Instruct、Granite 3.0 1B-A400M Instruct、Granite 3.0 3B-A800M Base、Granite 3.0 1B-A400M Base


新的 花岗岩 3.0 8B、2B语言模型被设计为企业级AI的“主力”模型,能够在检索增强生成(RAG)、分类、摘要、实体提取、工具使用等任务中提供强大的性能,这些紧凑而通用的模型旨在与企业数据进行微调,并无缝集成到各种业务环境或工作流中。

许多大型语言模型 (LLM) 都是在公开数据上进行训练的,而绝大多数企业数据仍未得到利用。通过将小型 Granite 模型与企业数据相结合,尤其是使用 IBM 和 RedHat 于 3 月推出的革命性对齐技术 InstructLab,IBM 认为企业可以以极低的成本实现与大型模型相当的任务特定性能(基于在几个早期概念验证中观察到的成本范围比大型尖端模型低 23 到 XNUMX 倍)。

Granite 3.0 的发布再次彰显了 IBM 致力于打造透明、安全和可信的 AI 产品的承诺。Granite 3.0 技术报告和负责任使用指南提供了用于训练这些模型的数据集的描述,详细说明了应用的过滤、清理和处理步骤,并全面展示了模型在主要学术和企业基准测试中的性能结果。

至关重要的是,IBM 为 watsonx.ai 上的所有 Granite 模型提供知识产权赔偿,旨在增强企业客户将企业数据集成到模型中的信心。

提高标准:Granite 3.0 基准测试


Granite 3.0 语言模型在原始性能方面也表现出良好的效果。

在Hugging Face的OpenLLM排行榜定义的标准学术基准测试中,Granite 3.0 8B Instruct模型的整体性能平均领先于Meta和Mistral等类似规模的开源模型的最新性能。在IBM的高级AttaQ安全基准测试中,Granite 3.0 8B Instruct模型在所有测量的安全维度上都领先于Meta和Mistral的模型。

在检索增强生成 (RAG)、工具使用和网络安全等核心企业任务中,Granite 3.0 8B Instruct 模型的平均性能优于 Mistral 和 Meta 等类似规模的开源模型。

Granite 3.0 模型使用来自 12 种不同自然语言和 12 种不同编程语言的超过 116 万亿个 token 进行训练,采用新颖的两阶段训练方法,利用数千个实验结果来优化数据质量、数据选择和训练参数。到今年年底,3.0 8B 和 2B 语言模型预计将支持扩展的 128K 上下文窗口和多模态文档理解功能
.

IBM 通过提供 Granite 专家混合专家 (MoE) 机构模型 Granite 3.0 1B-A400M 和 Granite 3.0 3B-A800M,展示了性能和推理成本的完美平衡。这些更小、更轻量的模型可用于低延迟应用程序和基于 CPU 的部署。

IBM 还宣布了其预训练 Granite 时间序列模型的更新版本,早期版本于今年早些时候发布。这些新模型基于三倍多的数据进行训练,并在所有三个主要时间序列基准测试中表现良好,超越了谷歌和阿里巴巴等公司十倍大的模型的性能。更新后的模型还提供了更大的建模灵活性,并支持外部变量和滚动预测。

Granite Guardian 3.0:开启负责任的 AI 新时代

作为此次发布的一部分,IBM 还推出了全新的 Granite Guardian 型号系列,允许应用程序开发人员通过检查用户提示和 LLM 响应来检测各种风险,从而实现安全护栏。Granite Guardian 3.0、8B 和 2B 型号提供了当今市场上最全面的风险和危险检测功能。

除了社会偏见、仇恨、毒性、亵渎、暴力和越狱等危险维度外,这些模型还提供一系列独特的检索增强生成 (RAG) 特定检查,例如事实性、上下文相关性和答案相关性。在针对 19 个安全和 RAG 基准的广泛测试中,Granite Guardian 3.0 8B 模型在危险检测方面的平均准确率高于 Meta 的所有三代 Llama Guard 模型。其在幻觉检测方面的整体性能也与专门的幻觉检测模型 WeCheck 和 MiniCheck 相当。

虽然 Granite Guardian 模型源自相应的 Granite 语言模型,但它们可以与任何开放或专有 AI 模型一起使用来实现安全保障。

Granite 3.0 型号的可用性

整个 Granite 3.0 模型套件和更新的时间序列模型可以在 HuggingFace 上根据宽松的 Apache 2.0 许可证下载。新的 Granite 3.0 8B 和 2B 语言模型以及 Granite Guardian 3.0 8B 和 2B 模型的指令变体现已在 IBM 的 watsonx 平台上可供商业使用。一些 Granite 3.0 模型还将作为 NVIDIA NIM 微服务提供,并通过 Google Cloud 的 Vertex AI Model Garden 与 HuggingFace 的集成提供。

为了给开发人员提供多种选择和易用性,并支持本地和边缘部署,Ollama 和 Replicate 上也提供了一系列 Granite 3.0 模型。最新一代 Granite 模型扩展了 IBM 强大的开源 LLM 产品目录。IBM 与 AWS、Docker、Domo、Qualcomm Technologies, Inc.(通过其 Qualcomm? AI Hub)、Salesforce 和 SAP 等生态系统合作伙伴合作,将多种 Granite 模型集成到这些合作伙伴的产品中,或在其平台上提供 Granite 模型,从而为全球企业提供更多选择。

从助手到代理:实现企业级人工智能的未来

IBM 正在通过一系列技术推动企业级 AI 的发展,从模型和助手到针对公司独特数据和用例调整和部署 AI 所需的工具。IBM 还为未来的 AI 代理铺平了道路,这些代理可以在动态商业环境中自我引导、反思并执行复杂任务。

IBM 不断发展其 AI 助手技术组合,从通过低代码工具和自动化帮助公司构建自己的助手的 Watsonx Orchestrate,到针对特定任务和领域(例如客户服务、人力资源、销售和营销)的各种预构建助手。世界各地的组织已经使用 Watsonx Assistant 来帮助他们构建 AI 助手,以执行各种任务,例如回答客户或员工的日常问题、对大型机和旧式 IT 应用程序进行现代化改造、帮助学生探索潜在的职业道路或为购房者提供数字抵押贷款支持。

IBM 还宣布即将发布下一代 watsonx Code Assistant,它由 Granite 代码模型提供支持,可以为 C、C++、Go、Java 和 Python 等语言提供通用编码帮助,并为企业级 Java 应用程序提供高级应用程序现代化功能。Granite 的代码功能现在也可以通过 IBM Granite.Code Visual Studio Code 扩展来访问。

IBM 还计划发布新工具,帮助开发人员使用 watsonx.ai 更有效地构建、定制和部署 AI,包括代理框架、与现有环境的集成以及针对 RAG 和代理等常见用例的低代码自动化。

IBM 专注于开发具有更高自主性、复杂推理能力和多步骤问题解决能力的 AI 代理技术。Granite 3.0 8B 模型的初始版本支持关键代理功能,例如高级推理和高度结构化的聊天模板以及用于实现工具使用工作流的提示样式。IBM 还计划在 IBM watsonx Orchestrate 中引入新的 AI 代理聊天功能,利用代理功能协调 AI 助手、技能和自动化,帮助用户提高整体团队生产力 [viii]。IBM 计划在 2025 年继续将代理功能构建到其产品组合中,包括针对特定领域和用例的预构建代理。

扩展 AI 驱动的交付平台,利用 AI 增强 IBM 顾问的能力

IBM 还宣布了其 AI 驱动交付平台 IBM Consulting Advantage 的重大扩展。该多模型平台包含 AI 代理、应用程序和方法(如可重复使用的框架),使 160,000 名 IBM 顾问能够以更快、更好的方式以更低的成本为客户提供价值。

作为扩展的一部分,Granite 3.0 语言模型将成为 Consulting Advantage 的默认模型。借助 Granite 的性能和效率,IBM Consulting 将能够帮助 IBM 客户最大限度地提高生成式 AI 项目的投资回报。

此次扩展的另一个关键部分是推出了 IBM Consulting Advantage for Cloud Transformation and Management 和 IBM Consulting Advantage for Business Operations。它们均包含特定领域的 AI 代理、应用程序和方法,并融合了 IBM 的最佳实践,使 IBM 顾问能够帮助客户加速云和 AI 转型任务(例如代码现代化和质量工程)或跨领域(例如财务、人力资源和采购)实施转型和运营。

关于IBM

IBM 是混合云、人工智能和企业服务的全球领导者,帮助超过 175 个国家和地区的客户从其数据中获取业务洞察,简化业务流程,降低成本,并在行业中取得竞争优势。金融服务、电信和医疗保健等关键基础设施领域的 4,000 多家政府和企业实体依靠 IBM 的混合云平台和 Red Hat OpenShift 快速、高效、安全地实现数字化转型。IBM 在人工智能、量子计算、行业云解决方案和企业服务方面的突破性创新为我们的客户提供了开放和灵活的选择。对企业诚信、透明治理、社会责任、包容文化和服务精神的长期承诺是 IBM 业务发展的基石。

whatsapp

WhatsApp

Whatsapp:+8618073002950