资讯池
小鹏在单颗图灵芯片上运行完整通用大模型 推理速度超20Tokens/秒
日期: 2026-08-27 18:27来源: 科创板日报域名: finance.eastmoney.com
溯源
重要性:背景级 · 53·对象槽:unmatched·对象关系:sector_transmission·影响对象:sector:芯片、sector:算力、sector:大模型·来源/栏目:东方财富·抓取时间:2026-08-27 18:27:01·信任分层:优先源
小鹏 汽车 通用智能中心负责人刘先明今日下午透露,小鹏已通过XLLM架构,在单颗图灵芯片上运行完整的通用大模型。该架构可在较短时间内对通用大模型进行优化,使其能够在单颗图灵芯片上高效运行,推理平均每秒生成超过20个Tokens,可用于类似ChatGPT、豆包的推理及应用。小鹏将其视为图灵芯片从 汽车 、 机器人 进一步向本地算力场景扩展的一项探索