资讯正文
首页  > 资讯  > 网商动态  >正文

积算科技上线赤兔推理引擎服务,创新解锁FP8大模型算力

2025-07-30来源:供应商网作者:佚名责任编辑:李萧

积算科技上线赤兔推理引擎服务,创新解锁FP8大模型算力

北京2025年7月30日 /美通社/ -- 近日,北京积算科技有限公司(以下简称"积算科技")宣布其算力服务平台上线赤兔推理引擎。积算科技PowerFul-AI应用开发平台与赤兔合作,打造高性价比的模型轻量化部署方案。用户通过远程算力平台预置的模型镜像与AI工具,仅需50%的GPU算力即可解锁大模型推理、企业知识库搭建、智能体开发,加速大模型在智能问答、报告生成、客服助手、智能体等典型行业场景的落地。


赤兔推理引擎由北京清程极智科技有限公司(以下简称"清程极智")开发,并联合清华大学团队发布开源版本。其核心价值在于,打破了FP8模型原生部署时GPU必须支持FP8精度的要求。通过底层算子优化(如GeMM、MoE的指令级重构)和编译技术创新,赤兔早在今年三月即***实现在非FP8精度卡上原生运行FP8高精度模型,并确保推理过程几乎零精度损失。

积算科技联合清程极智,完成了赤兔推理引擎在积算科技PowerFul-AI应用开发平台上的验证测试。测试结果表明,赤兔推理引擎在积算科技PowerFul-AI平台上运行稳定、性能表现优异,满足双方兼容性认证的各项标准,能够快速完成DeepSeek、Qwen等大模型推理部署,并支持基于非FP8精度GPU卡实现FP8模型部署,相比于使用BF16精度部署,GPU算力需求减半。以部署DeepSeek-R1-671B为例,原需4台8卡机2560GB显存,现仅需2台8卡机1280GB显存即可满足要求。

积算科技PowerFul-AI平台携手赤兔推理引擎,将为AI大模型应用开发打造"成本减半、零性能损耗"的解决方案,提供构建企业知识库开发、智能体搭建等功能,助力企业用户灵活快速构建大模型通用应用及个性化端到端解决方案。

PowerFul-AI是积算科技的大模型应用落地解决方案,能够为AI大模型落地应用提供高效、易用、安全的端到端开发平台,帮助企业及科研机构高效开发部署AI大模型应用。目前,PowerFul-AI已经全面适配DeepSeek R1、DeepSeek V3等模型。用户只需选择镜像和模型文件,并配置模型所需的算力资源,即可快速完成模型部署,实现DeepSeek的"分钟级"上线。

积算科技诞生于全球生成式AI浪潮,专注于智能算力服务市场,致力于成为中国***价值的智能算力服务商,聚焦互联网、运营商、高校、新能源汽车等领域的多家头部客户提供算力服务。公司拥有万卡级***智能算力资源池,提供裸金属、智能算力系统、专属智能算力系统等算力服务产品,适用于大模型训练与推理、算法研究、大数据分析、自动驾驶、智能科学计算等多元场景。其运维和服务团队具备大规模智能算力系统设计建设、大模型开发应用及性能优化能力,可提供全栈大模型应用开发服务支持,并根据客户需求提供灵活服务模式。

免责声明
本文仅代表作者个人观点,本站未对其内容进行核实,请读者仅做参考,如若文中涉及有违公德、触犯法律的内容,一经发现,立即删除,作者需自行承担相应责任。涉及到版权或其他问题,请及时联系我们 kefu@gys.cn。

看完这篇没看够?点击https://m.gys.cn/zixun/获取更新资讯。

相关资讯
CreateAI将携游戏及最新AI工具参加ChinaJoy2025-07-31
aiMotive与Socionext签署协议,加速ADAS SoC开发2025-07-31
全新SuperX XN9160-B200 AI服务器发布2025-07-31
Tata Communications与AWS在印度打造先进AI优化网络2025-07-31
MetaOptics Ltd成为全球首家寻求公开上市的超透镜公司2025-07-31
澳鹏携全新技术平台矩阵参加WAIC 20252025-07-30
InterDigital与三星签署一项新的专利许可协议2025-07-30
《电力系统转型:在高可再生能源系统中提供具有竞争力和弹性的电力》报告发布2025-07-30
《财富》杂志公布了2025年《财富》全球500强2025-07-30
积算科技算力服务平台上线赤兔推理引擎2025-07-30
积算科技上线赤兔推理引擎服务,创新解锁FP8大模型算力2025-07-30
共话AI时代下的广告机遇,2025第九届麒麟国际创意节圆满举办2025-07-30
众合云科人力资源副总裁林枚获评「2025卓越女性HR经理人」2025-07-30
2025中国科创投资夏季峰会圆满落幕2025-07-30
立邦为广州白云站"量体裁衣",打造大湾区交通枢纽新标杆2025-07-30
南方电网公司在2025世界人工智能大会展出多项人工智能成果2025-07-30
亚马逊云科技 AI 联赛:在全新终极 AI 对决中学习、创新和竞争2025-07-30
三一创新光伏项目落地津巴布韦,非洲绿色能源布局再扩大2025-07-30
永续引擎•2025可持续产业赋能开放日圆满落幕2025-07-30
和铂医药将在2025年ESMO大会公布HBM4003联合替雷利珠单抗治疗微卫星稳定型转移性结直肠癌的2025-07-30