福科创新联合华中科技大学发布tuilika推理卡,打造高性能AI算力新标杆

2026-09-23 10:41:21 fouinn
北京福科创新科技有限公司(以下简称"福科创新")今日正式宣布,其联合华中科技大学计算机学院深度研发的高性能AI推理加速卡——tuilika推理卡,现已面向市场全面开放合作。该产品基于XCVU35P FPGA芯片打造,实现了从芯片底层到应用层的全栈优化,为AI推理与轻量级训练场景提供高性价比的算力解决方案。

核心产品亮点

tuilika推理卡采用赛灵思UltraScale+系列旗舰级FPGA芯片XCVU35P,基于16nm FinFET工艺,支持工业级宽温运行(-40℃~100℃),具备262.5万个LUT、525万个触发器及1024个DSP切片,为AI计算提供强大底层算力支撑。产品提供单芯标准版与多芯集群版两种配置方案,灵活适配不同规模算力需求:
  • 单芯标准版:PCIe 4.0全高全长设计,典型功耗75W,专注高并发低延迟推理场景,7B模型(INT8)推理速度达1200-1500 Token/秒,平均延迟低于20ms。

  • 多芯集群版:支持2~4颗VU35P集成,板内400Gbps+高速互联,4芯集群7B模型(INT8)推理速度可达4500-5000 Token/秒,支持高并发对话,同时支持7B及以下模型全参数训练、13B模型LoRA微调。

全栈技术优势

依托华中科技大学在计算机体系结构领域的深厚技术积累,福科创新实现了从芯片到应用的全栈能力覆盖:
  • 定制化加速引擎:针对大模型推理优化的硬件算子库,覆盖Transformer、Attention、MatMul等核心算子,推理效率提升40%以上。

  • 低延迟调度算法:自研多任务并行调度框架,有效解决多模型、多用户并发时的资源争抢问题,端到端延迟降低30%。

  • 全栈应用适配:原生支持PyTorch、TensorFlow,适配vLLM、TGI等主流推理框架,兼容Llama 2、Qwen、Baichuan等开源大模型,支持混合精度量化。

多元应用场景

tuilika推理卡已覆盖企业服务、科研教育、行业边缘等多元场景:
  • 企业级AI服务:智能客服、内容生成、知识问答,单服务器可支持500+并发会话。

  • 科研与教育算力:为高校AI实验室科研、教育平台智能答疑提供算力支撑,可承载百万级学生用户。

  • 工业质检:实时图像推理,缺陷检测延迟低于10ms,适配产线高速检测需求。

关于福科创新

北京福科创新科技有限公司成立于2020年,是一家专注于科技推广和应用服务的高新技术企业,致力于通过技术创新为行业客户提供优质的算力产品与技术服务。公司始终坚持以自主研发为核心驱动力,持续深耕AI算力领域,推动国产高性能计算方案的落地与应用。


首页
产品
新闻
联系