IBM此次推出的并非原始模型,而是经过深度优化的版本——内部测试显示,延迟最多可降低75%,吞吐量提升高达50%。其核心在于量化技术:通过压缩模型体积与内存占用,显著提升处理速度,同时降低运行成本与能耗。具体提升幅度因批处理量而异,但35%至75%的延迟缩减,足以让数据分析师更快获得关键洞察。

随着模型目录持续扩充,客户在AI模型选择与灵活部署方面的能力同步增强。IBM近日正式宣布,由Mistral AI开发的广受欢迎的开源大模型Mixtral-8x7B已正式入驻watsonx人工智能与数据平台。这一举措并非孤立事件——同一周内,IBM还上线了ELYZA开源日语LLM模型以及Meta的Llama-2系列。未来数月,更多第三方模型将陆续加入平台。
Mixtral-8x7B的技术架构值得单独探讨。它融合了稀疏建模与专家混合(Mixture of Experts)技术:稀疏建模使模型仅提取数据中最关键的特征,避免冗余计算;专家混合则将多个擅长不同任务的子模型(即“专家”)组合协同工作。正是这种设计,使其能够快速处理海量数据,输出与上下文高度相关的精准洞察。
IBM为Mixtral-8x7B提供了企业级优化版本,并强调此举与其开放、多模型战略一脉相承。通过与Meta、Hugging Face等合作伙伴的深度协作,IBM正持续扩展watsonx.ai模型目录,引入更多语言、行业场景与功能。客户可根据自身业务领域(如金融)的具体需求、性价比目标以及信任原则,从目录中挑选最合适的模型。
IBM软件公司产品管理与增长高级副总裁Kareem Yusuf博士对此直言:“客户要求在模型部署时拥有充分的选择权与灵活性——无论是针对独特用例还是具体业务需求。通过在watsonx上提供Mixtral-8x7B及其他模型,我们不仅赋予了客户可选性,更构建了一个强大的生态系统,让AI构建者与业务领导者能够利用这些工具推动不同行业和领域的创新。”
当然,所有关于未来方向与意图的声明仅代表当前目标与目的,如有更改或撤回,恕不另行通知。
关于IBM
IBM是全球领先的混合云、人工智能及企业服务提供商,服务覆盖超过175个国家和地区的客户,帮助其从数据中挖掘商业洞察、优化流程、降低成本并赢得竞争优势。超过4000家政府与企业实体——涵盖金融、电信、医疗等关键基础设施领域——依托IBM混合云平台与红帽OpenShift实现安全高效的数字化转型。在人工智能、量子计算、行业云解决方案以及企业服务方面的突破性创新,为客户提供了开放而灵活的选择。对企业诚信、透明治理、社会责任、包容文化和服务精神的长期承诺,始终是IBM业务发展的基石。
