智源回顾 FlagOS 三轮跨芯适配:代码已开放,性能仍待外部复现
智源研究院称,FlagOS 在四天内为三款新模型提供了跨芯版本;公开代码与上游修复可查,跨硬件性能仍主要依据项目方测试。
智源研究院 9 月 1 日发布的技术说明称,众智 FlagOS 在四天内针对 Qwen3.8-Flash-Next、GLM-5.3-Flash 和 Hy4 preview 完成三轮跨芯片适配,并提供面向不同硬件的模型版本和部署说明。三款模型的架构与量化路径不同:前者需要补足新算子,GLM 版本依赖推理插件处理芯片差异,Hy4 preview 则涉及大模型权重压缩。这是对 8 月底工程进展的回顾,不是本期当日发布。
这套流程把 FlagGems 算子库、FlagTree 编译器、推理框架插件与 FlagRelease 发版链路连接起来,目标是减少每款模型在每种芯片上重复开发。部分组件代码可以在公开仓库检查;智源通告提及的一项 vLLM 长上下文精度修复,也可在上游 PR 看到于 8 月 30 日合并。但代码存在、单项修复合并,与三款模型在全部列出的芯片上达到同等性能,是不同层级的证据。
对开发者而言,关键问题不只是“发布当天适配”,还包括可下载版本、模型卡、依赖版本、精度对齐方法及实际业务负载。智源披露的跨芯覆盖与测试结果应按项目方口径引用;本文未在各芯片上自行安装并复测,也未取得第三方统一基准。因此,本次进展可视为开放软件栈的工程案例,不能据此断言已解决所有异构算力的兼容与性能问题。
资料来源与责任信息
已完成人工复核。