当前位置:首页 > 芯闻号 > 美通社全球TMT
[导读]北京2025年7月30日 /美通社/ -- 近日,北京积算科技有限公司(以下简称"积算科技")宣布其算力服务平台上线赤兔推理引擎。积算科技PowerFul-AI应用开发平台与赤兔合作,打造高性价比的模型轻量化部署方案。用户通过远程算力平台预置的模型镜像与AI工...

北京2025年7月30日 /美通社/ -- 近日,北京积算科技有限公司(以下简称"积算科技")宣布其算力服务平台上线赤兔推理引擎。积算科技PowerFul-AI应用开发平台与赤兔合作,打造高性价比的模型轻量化部署方案。用户通过远程算力平台预置的模型镜像与AI工具,仅需50%的GPU算力即可解锁大模型推理、企业知识库搭建、智能体开发,加速大模型在智能问答、报告生成、客服助手、智能体等典型行业场景的落地。

积算科技上线赤兔推理引擎服务,创新解锁FP8大模型算力


赤兔推理引擎由北京清程极智科技有限公司(以下简称"清程极智")开发,并联合清华大学团队发布开源版本。其核心价值在于,打破了FP8模型原生部署时GPU必须支持FP8精度的要求。通过底层算子优化(如GeMM、MoE的指令级重构)和编译技术创新,赤兔早在今年三月即首次实现在非FP8精度卡上原生运行FP8高精度模型,并确保推理过程几乎零精度损失。

积算科技联合清程极智,完成了赤兔推理引擎在积算科技PowerFul-AI应用开发平台上的验证测试。测试结果表明,赤兔推理引擎在积算科技PowerFul-AI平台上运行稳定、性能表现优异,满足双方兼容性认证的各项标准,能够快速完成DeepSeek、Qwen等大模型推理部署,并支持基于非FP8精度GPU卡实现FP8模型部署,相比于使用BF16精度部署,GPU算力需求减半。以部署DeepSeek-R1-671B为例,原需4台8卡机2560GB显存,现仅需2台8卡机1280GB显存即可满足要求。

积算科技PowerFul-AI平台携手赤兔推理引擎,将为AI大模型应用开发打造"成本减半、零性能损耗"的解决方案,提供构建企业知识库开发、智能体搭建等功能,助力企业用户灵活快速构建大模型通用应用及个性化端到端解决方案。

PowerFul-AI是积算科技的大模型应用落地解决方案,能够为AI大模型落地应用提供高效、易用、安全的端到端开发平台,帮助企业及科研机构高效开发部署AI大模型应用。目前,PowerFul-AI已经全面适配DeepSeek R1、DeepSeek V3等模型。用户只需选择镜像和模型文件,并配置模型所需的算力资源,即可快速完成模型部署,实现DeepSeek的"分钟级"上线。

积算科技诞生于全球生成式AI浪潮,专注于智能算力服务市场,致力于成为中国最具价值的智能算力服务商,聚焦互联网、运营商、高校、新能源汽车等领域的多家头部客户提供算力服务。公司拥有万卡级先进智能算力资源池,提供裸金属、智能算力系统、专属智能算力系统等算力服务产品,适用于大模型训练与推理、算法研究、大数据分析、自动驾驶、智能科学计算等多元场景。其运维和服务团队具备大规模智能算力系统设计建设、大模型开发应用及性能优化能力,可提供全栈大模型应用开发服务支持,并根据客户需求提供灵活服务模式。

本站声明: 本文章由作者或相关机构授权发布,目的在于传递更多信息,并不代表本站赞同其观点,本站亦不保证或承诺内容真实性等。需要转载请联系该专栏作者,如若文章内容侵犯您的权益,请及时联系本站删除( 邮箱:macysun@21ic.com )。
换一批
延伸阅读

重庆2026年2月11日 /美通社/ -- 2026年是国家"十五五"规划的开局之年,也是成渝地区双城经济圈建设由"积厚成势"迈向"成型成势"的关键节点。为抢占...

关键字: 智能体 人工智能 模型 节点

上海2026年2月11日 /美通社/ -- 2026年2月6日,智云上海AI STORE服务站(漕河泾)揭牌及签约仪式在桂平路391号新漕河泾国际商务中心B座1楼漕河泾共梦引擎空间隆重举行。上海梵数智算算力科技有限公司旗...

关键字: AI STORE 电信 模型

NLRP3是一个经过验证的抗炎靶点,可介导促炎细胞因子IL-1β和IL-18的释放。ISM5059通过靶向NLRP3,从源头阻断炎症级联反应,有望用于全身性炎症疾病治疗。 和英矽智能已经取得FDA临床试验批件的...

关键字: ISM ARMA 人工智能 模型

宁波2026年2月2日 /美通社/ -- 当前,以大模型为"大脑"的智能体正掀起新一轮生产力变革。我们期待它们能像人一样理解任务、规划步骤、执行操作,成为企业的"数字员工"。 然...

关键字: 模型 AI 智能体 离散

上海2026年2月2日 /美通社/ -- 日前,在2026年美国气象学会年会上,英伟达正式推出Earth-2开放模型系列——面向人工智能气象领域的全开放、加速型模型与工具套件...

关键字: 模型 英伟达 AI NVIDIA

北京2026年1月29日 /美通社/ -- 1月22日,佛山市南海区"人工智能+医疗卫生"生态共建研讨会成功举办。市、区相关部门领导,佛山市南海区人民医院、浪潮信息、天锐医健等医疗机构及企业代表齐聚一...

关键字: AI 人工智能 模型 智慧医疗

上海2026年1月28日 /美通社/ -- 1月28日,领先的人工智能计算平台公司黑芝麻智能正式发布FAD2.0开放平台。此前,其核心算力平台——华山A2000高性能全场景通识辅助驾驶芯片已顺利通过美国商务部与国防部相关...

关键字: AD 模型 软件 芯片

杭州2026年1月26日 /美通社/ -- 寒尽江南春渐暖,智涌钱塘潮正兴。1月23日,以"向上生长•势不可挡"为主题的中控技术第二届工业AI产业落地共促大会于中控科技园隆重召开。大会邀请到...

关键字: AI 模型 BSP LAN

英矽智能创新的"MMAI Science Gym"训练框架可显著提升大语言模型(LLM)在生物化学领域的专精能力 经过训练后,原本在专业任务领域失败率高达 75%–95% 的 LLM,可在关键药物发现基准测试中...

关键字: 模型 SCIENCE AI BSP

香港2026年1月22日 /美通社/ -- 近日,香港航空宣布与阿里巴巴旗下飞猪及千问App达成深度AI战略合作。作为首批入驻千问App"AI订机票"功能的航司,香港航空将在飞猪AI及千问A...

关键字: APP AI 模型 阿里巴巴
关闭