跳到正文

大模型 FPGA · 推理 IP · IP 授权 · FPGA 原型验证 · ASIC 流片

大模型 FPGA 原型验证:从推理 IP 授权到流片的路径

燔石半导体技术团队 · 发布

大模型 FPGA 原型验证是在流片之前,把推理内核 IP 部署到 FPGA 评估板上,用真实模型和真实接口跑通整条链路。它让工程样机先于 ASIC 落地,把模型映射、量化精度、接口和系统集成的问题提前暴露,为流片决策提供实测依据。

为什么先上 FPGA

ASIC 流片周期长、成本高,错一次就是几个月和一笔不小的费用。FPGA 可以在几天内把同一套推理内核跑起来,用真实模型、真实接口、真实数据验证:模型映射对不对,量化后的精度掉了多少,接口带宽够不够,系统软件怎么接。

对产品团队来说,FPGA 评估板就是第一台工程样机。它可以拿去做用户测试、拿去给客户演示、拿去跑现场数据,而这时 ASIC 还在设计阶段。

推理 IP 授权包含什么

燔石的推理内核 IP 有四类:FS-Fusion 多模态融合、FS-Attention 混合注意力、FS-MoE 稀疏混合专家、FS-Linear 线性注意力与新型架构。同一套内核既可以落到客户自己的 ASIC,也可以部署到 FPGA。

授权通常包含内核 IP、FPGA 评估板、模型映射与接口适配,以及项目设计导入支持。IP 的支持范围、资源占用、性能目标和授权方式,需要结合目标器件和模型做项目评估。

典型节奏

第一步,确认目标模型、性能目标、功耗范围和接口需求,判断走哪条技术路线。第二步,在 FPGA 评估板上部署推理内核,跑通模型并测量精度与吞吐。第三步,围绕评估结果做系统集成和现场验证,形成工程样机。第四步,模型定型后决定 ASIC 方案:授权 IP 集成到客户自己的芯片,或者直接采用燔石的量产 ASIC。

这个过程中最重要的决策点是「模型冻结」。冻结之前,一切都在 FPGA 上迭代;冻结之后,才进入掩膜与流片。

什么样的团队适合 IP 授权

已经有自己的 SoC 或计划做自己的芯片、希望把大模型推理能力集成进去的团队;模型还在演进、需要先出工程样机的团队;以及希望在 FPGA 上直接交付小批量产品的团队。相反,如果模型已经定型、量产规模大,直接采用量产 ASIC 更省事。

把问题带到你的项目里

发来目标模型、性能与功耗目标,我们回复适配路线与评估方案。

申请样机