开云(中国)Kaiyun·官方网站 - 登录入口跟着 Scaling Law 执续激动模子才气跃升-开yun云(中国)Kaiyun·官方网站 - 登录入口

发布日期:2026-09-05 05:12    点击次数:77

9 月 26 日开云(中国)Kaiyun·官方网站 - 登录入口,在 2025 东说念主工智能计较大会上,波澜信息公布,基于元脑 SD200 超节点 AI 奇迹器,DeepSeek R1 大模子 token 生成速率仅需 8.9 毫秒,创造国内大模子最快 token 生成速率;而最新发布的元脑 HC1000 超彭胀 AI 奇迹器,达成每百万 token 本钱初度击破 1 元。波澜信息对 AI 计较架构的执续更始,旨在惩处智能体产业化面对的交互速率和 token 本钱两大瓶颈,为多智能体协同与复杂任务推理的范围化落地,提供高速率、低本钱的算力基础要领。

跟着 Scaling Law 执续激动模子才气跃升,以 DeepSeek 为代表的开源模子极大的镌汰了更始门槛,加快智能体产业化的到来。智能体产业化的中枢三身分是才气、速率和本钱。其中模子才气决定了智能体的应用上限,交互速率决定了智能体的生意价值,token 本钱决定了智能体的盈利才气。

仅需 8.9 毫秒!元脑 SD200 引颈 token 生成速率当先参加“10 毫秒时期”

波澜信息最新公布,基于元脑 SD200 超节点 AI 奇迹器开动 DeepSeek R1 大模子,单 token 生成速率低至 8.9 毫秒,带动国内 AI 奇迹器 token 生成速率当先参加“10 毫秒时期”。

元脑 SD200 基于更始研发的多主机低延长内存语义通讯架构,在单机内达成了 64 路原土 AI 芯片的高速长入互连,单机可承载 4 万亿参数单体模子,或部署多个万亿参数模子构成的智能体应用,达成多模子协同实施复杂任务。为达成极低的通讯延长,元脑 SD200 收受精简高效的三层条约栈,原生守旧多种内存语义操作,幸免冗尾数据拷贝,将基础通讯延长降至百纳秒级,硬件化链路层重传与散布式刺目式流控进一步适配高微辞、低延长的 AI 推理场景。

元脑 HC1000,推理本钱初度击破 1 元 / 每百万 token

波澜信息重磅发布元脑 HC1000 超彭胀 AI 奇迹器,基于全新树立的全对称 DirectCom 极速架构,无损超彭胀盘算团聚海量原土 AI 芯片、守旧极大推理微辞量,推理本钱初度击破 1 元 / 每百万 token,为智能体梗阻 token 本钱瓶颈提供极致性能的更始算力系统。

元脑 HC1000 通过全面优化降本和软硬协同增效,更始 16 卡计较模组盘算、单卡“计较-显存-互连”平衡盘算,大幅镌汰单卡本钱和每卡系统分担本钱。同期,全对称的系统拓扑盘算守旧超大范围无损彭胀。据测算,元脑 HC1000 通过算网深度协同、全域无损期间,达成推感性能比拟传统 RoCE 提高 1.75 倍,单卡模子算力欺诈率最高提高 5.7 倍。

将来开云(中国)Kaiyun·官方网站 - 登录入口,智能体带来的推理算力需求将呈现出指数级的爆发式增长。波澜信息将通过软硬件协同盘算与深度优化,执续激动 AI 计较架构的更始与梗阻,不绝达成 token 生成“提速降本”,积极促进大模子、智能体等东说念主工智能期间与实体经济的深度会通,让东说念主工智能成为千行百业的坐褥力和更始力。

海量资讯、精确解读,尽在新浪财经APP





Powered by 开yun云(中国)Kaiyun·官方网站 - 登录入口 @2013-2022 RSS地图 HTML地图

Copyright Powered by365站群 © 2013-2024