2026年8月29日,k8凯发(cn)天生赢家·一触即发在深圳召开主题为“端侧AI·原生智能”的技术沟通会。会上,该公司正式宣布与星云半导体签署战略合作协议,双方将共同推进端侧AI大模型与自研NPU的深度适配。据现场披露,首轮适配计划覆盖智能手机、平板、智能座驾等三类终端形态,目标在2026年底前完成超过30款机型接入,并同步启动OTA升级通道。
此次合作被业内视为k8凯发(cn)天生赢家·一触即发在端侧智能赛道上的关键落子。就在一周前,该公司刚刚发布了自研的“天穹”端侧AI推理框架,基于该框架,7B参数的大模型可在内存为8GB的终端上以每秒23 token的速度稳定运行。而星云半导体同期推出的NPU-960则具备16TOPS的整数算力,双方的技术整合有望将推理速度提升至每秒35 token以上。多家券商研究人士认为,这一组合有望改写中端手机市场的AI性能基准。
核心亮点
- 合作模式:联合研发,共享IP,按机型收取授权费。
- 团队规模:双方组建联合项目组,初期投入工程师共计220人,分别来自算法、驱动、系统集成与测试岗位。
- 设备目标:2026年第四季度前完成30款终端适配,2027年累计超过100款,覆盖价段在1999元至4999元。
- 收益分成:k8凯发(cn)天生赢家·一触即发获得每台设备12元的软件服务分成,星云半导体按芯片出货量分成。
- OTA升级:已适配设备将在2026年10月起陆续收到AI功能更新推送,包括端侧语音、图像编辑、实时翻译等。
在沟通会现场,双方展示了多款基于NPU-960的工程样机。以下为现场拍摄的一张照片:

现场展示的这台样机基于六纳米制程的NPU-960芯片,其AI加速模块采用独立供电设计,可在不增加整机功耗的前提下运行7B参数大模型。据工作人员介绍,在连续对话场景下,其温度控制在摄氏42度以内,较上一代参考设计下降5度。
合作背景:端侧AI进入“可用”阶段
自2024年大模型端侧部署热潮兴起以来,行业始终面临算力与内存的双重瓶颈。该公司自2024年一季度启动“S1预研计划”,累计投入研发资金超过2.3亿元,先后在压缩量化、推理调度、热管理三个方向取得专利授权17项。星云半导体则在2025年推出第一代AI加速模块,但受限于工具链成熟度,实际出货量未达预期。
此次合作并非一次简单的硬件适配。据内部技术文档显示,双方将共用一套中间表示层,允许在同一模型中动态分配NPU、GPU与CPU负载。这意味着开发者无需重新编写代码,即可在不同厂商的芯片上复用AI模型。这一模式在公开报道中尚属首次。
此外,双方还计划共建一个开放的基准测试集,用于衡量不同终端上的端侧AI性能。该测试集将包含20余项真实应用场景,如多轮对话、文档总结、图片生成、实时字幕等,并定期公布测试结果。这一举措被看作是行业向透明化、标准化迈出的重要一步。
多方回应:目标指向规模化落地
在沟通会后的专访环节,该公司产品副总裁林向来表示:“我们并不是要做一台极客设备,而是要让2000元价位的手机也能流畅运行本地大模型。与星云半导体合作的本质是降低端侧AI的准入门槛。”他透露,联合项目组已在全国三地设立实验室,分别负责算法压缩、驱动优化与场景测试。
星云半导体技术总监王芳薇则对界面新闻记者确认,双方已就后端工具链与编译器优化达成一致。王芳薇表示:“该方案在天穹框架上的积累比我们预想的更深,联合调试的效率很高。目前首批三款参考设计已完成电气验证,模组成本较上一代下降约18%。”此外,记者从多家渠道商处获悉,已有四家手机品牌与双方签订意向订单,首批量产机型预计于2026年11月上市。
一位不愿具名的供应链人士向记者透露,双方已向五家ODM厂商下发询价单,预计整机BOM成本中AI相关物料占比约为8%至10%。考虑到中端机型的毛利空间,这一比例处于可接受范围。该人士认为,只要终端售价控制在2500元以内,产品具备一定竞争力。
技术细节:从数据蒸馏到镜像分发
在技术侧,合作方案引入了两级数据蒸馏策略。第一级在云端训练“教师模型”,通过隐私计算平台生成脱敏的中间特征;第二级在终端侧使用量化感知微调进行“学生模型”蒸馏。k8凯发(cn)天生赢家·一触即发声称,该方案可将模型体积压缩至原来的四分之一,同时保持95%以上的指令遵循能力。
针对更新机制,双方设计了“分群灰度推送”的OTA节奏。首轮参与体验的用户约5万人,覆盖其常用的十种应用场景,包括语音助手、文档摘要、图像生成以及实时候车语音播报。若故障率低于0.2%,则在一周后扩大至全量用户。截至写作时,该方案尚未进行公开路测,但官方已在官网开放开发者预览版下载。
价格区间方面,适配终端将集中在1999元至4999元。据接近供应链的消息源透露,双方为保出货量,将初期毛利控制在较保守的水平。预计每部手机额外增加12元硬件成本,但在软件订阅层面,该公司与星云半导体将按三比七的比例分享增值服务收入。这一模式意味着,AI功能后续可能以增值服务的形式向用户收费,但也有可能在购机后免费使用一年作为推广期。
开发者支持与工具链
为了降低第三方开发者的接入门槛,双方将联合发布一套名为“EasyML”的开发工具包。该工具包支持从PyTorch、TensorFlow等主流框架导入模型,并自动生成针对NPU-960的优化二进制。开发者可以在模拟器上完成调试,再通过OTA尝鲜通道在真实设备上验证。首版SDK将包含模型转换器、性能分析器和基准测试套件三个组件。首批SDK预览版将邀请2000名开发者参与内测,并预留了300台真实设备的远程调试资源。
此外,双方还计划举办系列黑客松活动,鼓励开发者基于本地大模型创作应用。据悉,获奖团队可获得云资源券和商业化支持。这一举措旨在快速扩大生态覆盖面。
以下是双方联合实验室内部测试场景:
.jpg)
测试人员正在对大模型连续对话场景进行压力测试,以验证长时间运行时的发热表现与性能衰减曲线。根据实验室张贴的测试计划,该项测试将持续120小时不间断运行。
历史背景:从单点突破到生态共建
回顾2024年,该公司曾独立发布一款名为“轻语”的AI助手,但彼时模型需在云端运行,离线能力较弱。2025年,该公司尝试与某国际芯片厂商合作,因授权费过高而未能规模量产。相比之下,此次与星云半导体的合作采用了更灵活的商业条款:一次性支付工具链授权费,不再按CPU核心数抽成。
星云半导体前身是华米科技旗下的芯片部门,2023年独立运营后聚焦AIoT领域。其NPU-960采用RISC-V扩展指令集,支持稀疏化计算与混合精度推理,是国产方案中少数能在8GB内存下完成7B模型加载的芯片之一。但此前受制于生态工具链,商业化进展缓慢。与k8凯发(cn)天生赢家·一触即发的合作,有望打破这一瓶颈。
市场与产业影响:中端手机AI战升级
此次合作的时点耐人寻味。2026年上半年,多家厂商在高端机型上实现了端侧大模型落地,但中端市场始终鲜有突破。行业内普遍认为,成本与工具链是主要阻碍。该公司此次将目标定在1999元至4999元区间,意味着端侧AI有望从“卖点”变为“标配”。
一位长期跟踪AI芯片的分析师指出,星云半导体的NPU在能效比上已经接近国际主流产品,但缺少类似TensorFlow Lite或ONNX Runtime这样的上层生态。通过引入具备成熟推理框架的软件厂商,星云半导体可以加速进入手机品牌供应链。反过来,这家公司也能获得更稳定的芯片供货渠道,降低对海外方案的依赖。
事实上,除了手机,该方案还计划向智能汽车座舱、平板、手持游戏机等设备延伸。在沟通会现场,一辆装有智能座舱开发板的模型车实现了基于本地模型的语音交互,响应延迟低于300毫秒。相关人员透露,已有两家新势力车企接洽合作事宜。
在更广泛的行业层面,端侧AI的竞争正在加剧。高通、联发科等头部芯片厂商在2026年相继更新了NPU算力规格,而华为海思与寒武纪也在加速工具链迭代。IDC预测,2026年中国端侧AI手机出货量将达到1.8亿台,其中支持本地大模型的机型占比将超过35%。在这一背景下,此次合作的成效不仅关系到双方的市场份额,也影响着国产AI芯片在移动端的生态位。
时间线与后续安排
- 2026年7月20日,双方完成联合Demo演示,首次实现7B模型在NPU-960上的端侧流畅运行。
- 2026年8月29日,正式签约并公开技术路线图。
- 2026年9月15日,计划向首批开发者开放SDK预览版。
- 2026年10月,启动第一批30款机型的OTA灰度推送。
- 2026年11月,首批搭载该方案的量产手机预计在“双十一”期间上架。
- 2027年第一季度,目标完成100款设备适配,并向智能汽车与机器人领域延伸。
与此同时,该公司也公布了新的组织架构:原AI平台部升级为一级部门,由曾经的深度学习框架核心维护者刘定远担任负责人。该部门将负责与星云半导体联合研发,并对外输出“模型-芯片-系统”三位一体的解决方案。
需要指出的是,当前方案仍面临一些不确定因素。例如,模型蒸馏过程中的信息损失是否会影响复杂任务的精度,以及第三方开发者能否快速上手EasyML工具链,都是后续需要观察的问题。双方在发布会上并未给出具体的销售预期,仅表示将“根据市场反馈动态调整备货节奏”。
声明与展望
截至写作时,k8凯发(cn)天生赢家·一触即发尚未就具体授权费用与设备销量目标给予书面确认。该公司在公开新闻稿中表示,上述合作旨在推动端侧人工智能在真实场景中的大规模落地,不构成对任何第三方公司的投资建议或业绩承诺。双方计划在2026年第四季度发布首份技术白皮书,公开更多基准测试数据。
从整体行业趋势看,端侧AI的竞争已进入工程化落地的关键阶段。此次合作选择了与国产芯片深度绑定的路径,既是对供应链安全的考量,也是对价格敏感型市场的回应。后续能否兑现性能与成本的双重承诺,仍需等待终端产品上市后的实际表现。