2025年世界人工智能大会(WAIC)上,深圳AI企业云天励飞正式宣布全面聚焦AI推理芯片,将围绕边缘计算、云端大模型推理和具身智能三大场景构建国产算力体系。这家拥有十年芯片研发积淀的企业,正以“All In”姿态押注AI推理时代的爆发机遇。
云天励飞并非芯片领域新兵。过去十年间,其五代NPU芯片持续迭代升级,从2015年推出首代边缘端SoC Nova100,到2023年发布DeepEdge10系列,逐步突破国产工艺瓶颈。此次成为聚焦核心的DeepEdge10系列,是国产芯片技术的集大成者:采用国产14nm Chiplet工艺与RISC-V核,首创“算力积木”架构,支持芯片如积木般灵活组合,可覆盖8T-256T算力范围。针对不同场景,该系列已衍生出四款芯片产品:最小尺寸的10C适配AIoT设备,10标准版与Max版支撑边缘多模态大模型,Edge200则专攻千亿级大模型推理加速。
云天励飞敢于“All In”的底气,源于其在技术领域创下的四个“国产工艺首个”:首个D2D Chiplet商用设计、首个C2C Mesh MoE推理架构、首个128T算力商用平台、首个集成国产大核RISC-V的AI芯片。这些技术突破已在实际应用中落地见效。目前,DeepEdge系列芯片平台已适配DeepSeek-R1、通义千问等近10个主流大模型,在机器人、边缘网关、服务器等领域实现规模化应用。例如,搭载DeepEdge200的深穹X6000加速卡可流畅运行千亿参数模型;基于该芯片的DeepSeek推理一体机,在跑满671B MoE模型时吞吐量达500 tokens/s,性能表现行业领先。
行业数据显示,AI产业正从“训练时代”加速迈向“推理时代”。IDC与浪潮信息联合报告指出,2024年AI推理工作负载占比已达67%,预计2028年将提升至73%。“训练如发电,推理如用电。”云天励飞董事长陈宁形象比喻,“未来基础大模型可能仅存数个,但调用模型的终端将指数级增长。”这一趋势已在终端市场显现:从特斯拉车载Grok4语音交互系统到销量超5万台的儿童AI拍学机,智能终端对推理芯片的依赖日益加深。
企业发展态势为其战略转型提供坚实支撑。财报数据显示,2024年云天励飞营收达9亿元,同比增长81.3%;2025年第一季度增速更是超过160%。今年6月,公司签署16亿元算力服务订单,将提供约4000PFLOPS的异构算力;7月初宣布的赴港二次上市计划,则彰显其进军国际市场的野心。面向未来,云天励飞正全力研发第二代“算力积木”架构,计划通过近存计算、3D混合键合等五大创新,将单芯片算力扩展至数千TOPS,持续领跑国产AI推理芯片赛道。
发表评论
登录
手机
验证码
手机/邮箱/用户名
密码
立即登录即可访问所有OFweek服务
还不是会员?免费注册
忘记密码其他方式
请输入评论内容...
请输入评论/评论长度6~500个字
暂无评论
暂无评论