导语:8月14日,人工智能与算力基础设施领域出现多项进展。智谱发布五点三版通用语言模型,称新版本在保留原有基座模型的基础上,借助后训练提升整体智能表现,重点强化编程、终端操作和智能体命令行等能力。与此同时,有消息称苹果正与阿里巴巴合作,为中国市场训练专属大型语言模型;英伟达则宣布面向人工智能工厂网络的共封装光学交换机产品进入全面量产。
智谱五点三版聚焦后训练与编程表现
智谱介绍,五点三版模型与五点二版相比,基座模型本身没有变化,此次升级主要通过加强后训练和扩展训练方式,进一步提升模型的智能表现上限。与直接更换底层模型相比,这一路径更强调对既有模型能力的调校,以及让模型在具体任务中表现得更加稳定。
编程能力是本次发布的重点。智谱表示,在其内部自建的体验评测中,五点三版模型的表现较五点二版提升约五成。在终端操作、智能体命令行等公开测试中,该模型也取得了开源模型中的领先成绩。不过,素材并未披露具体评测名称、测试样本规模或完整对比结果,相关表现仍需结合更多公开数据进行判断。
编程成为大模型实用性的重要指标
随着大模型逐渐进入软件开发、代码生成、程序调试和工具调用等工作流程,模型能否准确理解任务、拆解步骤并执行连续操作,已经成为衡量其实际应用价值的重要维度。相比单轮问答,编程和智能体任务通常涉及更长的操作链条,也对模型的指令遵循、错误修正和工具协同能力提出了更高要求。
智谱称,计划在模型发布两周后开放相关模型权重,为开发者提供使用和适配条件。权重开放后,开发者可以围绕本地部署、行业微调和应用集成开展进一步探索。模型在真实项目中的稳定性、资源消耗以及与不同开发工具的兼容情况,也将成为后续观察重点。
消息称苹果与阿里巴巴合作训练中国专属模型
另据三位知情人士透露,苹果已经针对中国市场训练一款大型语言模型,训练工作得到阿里巴巴支持。由于相关信息尚未公开,知情人士没有透露姓名,苹果与阿里巴巴之间的具体合作方式、模型规模及发布时间也尚未披露。苹果和阿里巴巴方面的进一步安排,仍有待后续信息确认。
如果上述消息得到进一步证实,这可能意味着苹果在中国市场的人工智能策略正在发生调整。此前,苹果被认为更倾向于借助第三方模型,为当地用户提供人工智能相关功能。面向中国市场专门训练模型,则显示其可能在本地需求、服务适配和相关能力建设方面投入更多资源。
中国市场在数据合规、产品服务和生态合作等方面具有自身特点。对国际科技企业而言,人工智能功能能否落地,不仅取决于模型的技术能力,还涉及数据处理方式、服务可用性以及本地合作伙伴的支持。苹果若推进相关布局,后续仍需观察其产品形态和正式发布节奏。
英伟达共封装光学产品进入量产阶段
在算力基础设施方面,英伟达同日宣布,其面向人工智能工厂网络的以太网光子产品已经进入全面量产阶段。该产品采用共封装光学技术,将光学器件与交换相关部件进行更紧密的集成,目标是服务人工智能工厂网络中的高速数据传输需求。
人工智能模型规模持续扩大后,数据中心内部的网络连接和数据交换承载着更高压力。除计算芯片外,交换机、光互联等基础设施也成为影响系统整体效率的重要环节。英伟达此次宣布产品进入全面量产,反映出人工智能基础设施的竞争正从单一芯片性能,延伸至网络、互联和系统级产品的协同建设。
产业链竞争转向系统能力
从模型升级、平台合作到网络产品量产,8月14日披露的三项进展覆盖了人工智能产业的不同环节。智谱关注模型在编程和智能体场景中的任务能力,苹果的相关消息指向国际企业在中国市场的本地化布局,英伟达则继续推进服务人工智能工厂的网络基础设施。
这些动态也表明,人工智能产业的竞争正在同时围绕模型效果、应用适配、生态合作和算力网络展开。未来,模型能否形成稳定的开发者生态,企业能否在不同市场完成合规且可用的产品部署,以及基础设施能否支撑更大规模的计算需求,仍将是行业持续关注的方向。