跳到正文

FS-Attention

混合注意力
推理 IP

原生支持混合注意力新结构(Hybrid Attention)的高端大语言模型。

FS-Attention 混合注意力推理 IP示意图
图 1 · FS-Attention 混合注意力推理 IP

数据流

原生支持混合注意力新结构(Hybrid Attention)的高端大语言模型。

token全局注意力头softmax滑窗注意力头localKV 缓存on-chip下一 tokenQwen3 / 3.5 · SmolLM2
图 2 · FS-Attention 数据流示意

原生支持

适配 Qwen3 / 3.5(0.6B 至 9B)与 SmolLM2

部署载体

ASIC 流片与 FPGA 原型部署,可结合项目进行接口与系统适配。

授权包含

推理内核 IP、FPGA 评估板、模型映射与接口适配、项目设计导入支持。

IP 支持范围、接口、资源占用、性能目标和授权方式需要结合目标器件与模型进行项目评估。

咨询 FS-Attention 授权

告诉我们目标器件、模型与接口,我们回复 IP 支持范围与评估计划。

咨询 IP 授权