PCIe显卡经内核与通信重构优化,DeepSeek推理吞吐提升近7倍
该动态指出通过内核补齐与通信重构等优化手段,PCIe显卡在运行DeepSeek模型时的推理吞吐量提升了近7倍,并声称1.5台6000D设备的表现可超越1台B300。需要说明的是,素材提供的信息较为简短,缺少具体的软硬件环境、完整测试基准以及技术实现的深度细节。
该动态指出通过内核补齐与通信重构等优化手段,PCIe显卡在运行DeepSeek模型时的推理吞吐量提升了近7倍,并声称1.5台6000D设备的表现可超越1台B300。需要说明的是,素材提供的信息较为简短,缺少具体的软硬件环境、完整测试基准以及技术实现的深度细节。
谷歌计划于10月1日发射名为MVP的实验卫星,作为其“捕日计划”的前期验证。该卫星搭载4枚TPU芯片,算力相当于一台普通服务器,由约1kW的太阳能面板供电,能在太空中直接处理并回答简单的AI查询。此项试验旨在检验计算硬件抵御太空辐射等严苛环境的能力,探索利用太空太阳能运行算力设施的可行性,为未来缓解地面数据中心面临的能耗与空间限制积累技术经验。
该资讯聚焦于大模型在推理过程中面临的显存不足、内存成本高及KV Cache持续膨胀的系统性难题,介绍了华为针对该瓶颈提出的全新应对方案。由于输入素材缺乏正文细节,其具体的技术实现路径、系统架构创新及实测性能优化数据暂未披露,主要展现了华为在解决大模型计算与存储资源制约方向上的最新探索动态。
中国私营企业S-AIDC成功将“超算一号”(Supercomputing-1)卫星送入轨道。该项目旨在构建以科技为导向的在轨空间计算能力,通过在太空中直接执行数据运算,大幅缩短对地观测数据的地面处理周期。这一进展展现了中国民营商业航天与高科技企业向天基算力基础设施领域延伸拓展的最新趋势。
9月23日,中央广播电视总台大型纪录片《超级工程—曙光8000》启播暨曙光8000技术解密活动在京举行。该纪录片首次将镜头转向国内超大规模算力基础设施,全景解密全国产十万卡AI超集群“曙光8000”的技术与建设历程。该四集纪录片将于9月25日起在CCTV-9纪录频道连续播出,展现中国在顶尖AI算力集群领域的重大工程突破。
报道聚焦于成立九年的中科类脑公司,指出其将过往的技术与业务积累整合并投入到“Token工厂”的建设与布局中,暗示其在大模型时代围绕算力资源与Token生成服务进行的转型与探索。由于输入素材未提供详细正文或摘要内容,关于该“Token工厂”的具体技术架构、产品形态、商业落地细节及最新进展等信息尚不明确,有待后续报道补充。
该内容探讨华为在AI算力基础设施领域的超节点技术布局,重点关注如何通过先进的互联与系统架构,将4096张计算卡高效协同、聚合成具备统一计算能力的“单台计算机”形态,以满足大模型时代的超大规模并行训练需求。由于提供的原文摘要信息不足,关于具体的互联协议、拓扑结构及软件栈支持等详细技术细节有待进一步查阅。
据消息披露,云存储与协作服务商 Dropbox 对其内部 Riviera 平台进行了升级,旨在增强对各类人工智能工作负载的支持能力。由于原始输入素材仅包含简略标题且缺乏具体正文内容,关于此次 Riviera 平台升级的技术架构细节、支持的具体 AI 任务类型、计算资源配置以及上线时间等详细信息,目前均无法进一步确认。
在2026华为全联接大会上,神州鲲泰正式推出基于鲲鹏与昇腾950技术路线的新一代算力产品矩阵。首批新品包括基于鲲鹏950的KunTai R722 K3均衡型服务器,以及搭载昇腾950DT的KunTai A989 I5标准服务器、KunTai A989 I5风冷超节点和KunTai PoD2000 A5液冷超节点,涵盖通用计算与AI智算集群方案,推动国产算力底座进入系统级竞争阶段。
在华为全联接大会2026上,华为副董事长、轮值董事长汪涛发表主题演讲,正式发布全球首个采用近封装光学(NPO)技术的超节点——昇腾960超节点。该超节点旨在突破互联瓶颈,大幅提升集群算力效率,为十万亿参数规模的超大模型训练与推理任务提供强大的算力基础设施支持,加速智能世界的底座构建。
华为全联接大会在上海开幕,华为副董事长、轮值董事长汪涛发表了“智启新未来,打造智能世界的硅基黑土地”主题演讲。大会聚焦探讨在人工智能浪潮背景下,产业界如何携手深化合作,共同建设强大的AI基础设施与算力底座,以应对智能时代的发展机遇与挑战。
全球数值预报正向1至5公里级迈进,异构计算成为关键算力支撑。近日,MCV数值模式依托国产曙光8000异构算力平台,成功实现全球公里级预报计算时效达标。该成果展示了国产异构算力在超高分辨率气象模拟等科学计算场景中的应用实践与突破,验证了国产超级计算基础设施支撑重大科研计算的可行性。
文章介绍了针对Kimi-K3模型构建高效DSpark训练系统的技术实践。通过结合投机采样技术(Speculators)与Mooncake分布式架构,团队在GB300 NVL72算力集群上成功实现了多节点DSpark的高效扩展与训练,大幅提升了大模型训练中的吞吐表现与集群算力利用效率。
2025年的夏天,如果说有什么比天气更热,那一定是“苏超”。从“苏超”赛场的内容破圈,到荔枝大模型的三年布局,再到与华为联合发布智能广告系统、发起“传媒智能助手”应用创新挑战赛,江苏广电总台正一步步揭开数智蝶变的幕后逻辑。江苏广电总台的AI布局,并非始于“苏超”的出圈瞬间。