DCAI
DC AI 热点

全部 AI 动态

9月25日2026-09-25
Buzzing HN · 中文精选✦ 精选AI 评分 75/10009:46

谷歌启动Suncatcher项目,拟将机器学习算力基础设施部署至太空

谷歌正推进名为“Suncatcher”的创新项目,计划将机器学习基础设施直接部署到太空环境中。该项目旨在探索利用太空独特环境(如太阳能资源和散热条件)承载AI算力与数据处理任务的可行性。目前公开信息有限,具体的发射规划、硬件配置、抗辐射技术细节以及实际部署时间表尚未完全披露,仍处于早期概念与试验阶段。

阅读原文 ↗推荐理由:谷歌探索将AI算力基础设施部署至太空的新路径,展示了下一代离地算力中心的前瞻性构想。# 谷歌# 太空算力# 机器学习# 数据中心# 基础设施
Google Developers · AI 筛选✦ 精选AI 评分 80/100收录 08:49

基于MaxText在TPU上复现OLMo 3 7B预训练:大规模训练案例研究

MaxText团队利用JAX/XLA在谷歌云TPU上从零成功复现了AI2的OLMo 3 7B大模型,在预训练及中期训练阶段的保留评估指标均精准对齐原PyTorch-GPU基准。该方案实现了高达57.4%的模型算力利用率(MFU),并在中途集群扩缩容及跨代TPU迁移中展现出极高鲁棒性。此外,团队通过保留验证发现并修复了导致训练损失虚低的数据加载器隐性记忆漏洞,验证了完备评估机制的重要性。

阅读原文 ↗推荐理由:展示了在Google Cloud TPU上跨生态、高算力利用率复现主流开源大模型的基础设施工程实践。# TPU# MaxText# OLMo 3# 大模型预训练# 算力基础设施
Google Developers · AI 筛选✦ 精选AI 评分 80/100收录 08:49

Google Cloud 在 vLLM 中原生支持 TPU,优化长上下文多模态嵌入推理

Google Cloud 已将 TPU 原生支持集成至开源推理框架 vLLM,开发者可通过 GKE 弹性扩展嵌入模型流水线。针对 Qwen3-Embedding-8B 等模型的 15K+ 超长上下文推理,工程团队引入了硬件安全张量对齐、JAX/XLA 编译预热及分块预填充的混合 StepPool 架构等专项优化,在实现与 GPU 基线近乎一致的数值精度的同时提升吞吐,相关配置方案已在 GitHub 开源。

阅读原文 ↗推荐理由:vLLM 原生集成 Google Cloud TPU 并在超长上下文嵌入推理上实现硬件级深度优化,对异构算力基础设施生态建设具有重要参考价值。# Google Cloud# Cloud TPU# vLLM# 推理优化# GKE
Cerebras 官方博客(网页)✦ 精选AI 评分 85/100收录 07:49

Cerebras推出CS-4晶圆级AI加速器:推理速度号称达GPU系统的30倍

Cerebras正式发布新一代晶圆级AI加速芯片系统CS-4,宣称其为业内速度最快的AI加速器。根据官方介绍,CS-4的推理速度相比传统GPU系统最高可提升达30倍,支持原生解耦推理架构,并能提供更高的处理吞吐量,旨在应对大规模AI工作负载对算力与延迟的苛刻要求。

阅读原文 ↗推荐理由:Cerebras发布新一代旗舰晶圆级AI芯片CS-4,主打大幅超越GPU的超高速AI推理吞吐性能。# Cerebras# CS-4# AI芯片# 硬件加速# AI推理
Cerebras 官方博客(网页)✦ 精选AI 评分 75/100收录 07:49

Cerebras 实现 GPT-5.6 Sol 高速推理:输出速度达每秒 750 tokens

文章介绍了 Cerebras 如何在不压缩模型规模、不牺牲模型智能水平的前提下,为 OpenAI 的 GPT-5.6 Sol 模型提供超高速推理服务。通过其特有的硬件架构与加速方案,该系统的模型输出速度最高可达到每秒 750 个 token,展示了 Cerebras 算力平台在大模型超低延迟生成和高吞吐服务方面的技术实力。

阅读原文 ↗推荐理由:展示了专用 AI 芯片架构在超大规模模型推理上的极速生成能力,具备显著的性能参考价值。# Cerebras# 大模型推理# AI芯片# 推理加速# 算力基础设施
Cerebras 官方博客(网页)✦ 精选AI 评分 80/100收录 07:49

Cerebras在Hot Chips大会详解CS-4系统与未来推理路线图

在Hot Chips 2026大会上,Cerebras详细介绍了其最新的CS-4系统和Nexus平台,并公布了后续CS-5与CS-6的硬件路线图。这些架构设计旨在为前沿大模型推理提供更高速、更高效率的算力支撑。通过持续演进的晶圆级芯片与系统集成方案,Cerebras进一步展示了其在超大规模AI推理基础设施方面的技术规划。

阅读原文 ↗推荐理由:Cerebras披露了最新的CS-4及后续芯片路线图,对AI超大规模推理算力架构的演进具有重要参考价值。# Cerebras# AI芯片# AI推理# 算力基础设施# 硬件路线图
Cerebras 官方博客(网页)✦ 精选AI 评分 78/100收录 07:49

Cerebras 加速 GPT-5.6 Sol:超快模式推理速度达每秒 750 Token

该内容展示了 Cerebras 算力平台如何为 OpenAI 的 GPT-5.6 Sol 模型提供支持。在 Ultrafast(超快)模式下,该方案实现了高达每秒 750 个输出 Token 的推理速度,主要面向对响应时间高度敏感的实时 AI 任务以及复杂智能体(Agent)工作流,显著降低推理延迟并提升交互效率。

阅读原文 ↗推荐理由:展现了 Cerebras 硬件在加速前沿大模型极速推理方面的性能突破,极具工程参考价值。# Cerebras# OpenAI# 推理加速# AI算力# 智能体
Cerebras 官方博客(网页)✦ 精选AI 评分 75/100收录 07:49

Cerebras 推出 CS-4 晶圆级系统,助力高速 AI 推理并释放模型潜力

该内容探讨了如何充分发挥所谓 GPT-5.6(包括 Sol、Terra 和 Luna)性能的方案。据介绍,Cerebras 依托其超大晶圆级芯片提供极速 AI 推理能力,最新推出的 Cerebras CS-4 系统在 AI 推理速度上据称比传统 GPU 最高可快达 30 倍。由于素材信息有限,关于该模型版本的具体细节与系统集成方式尚未详述。

阅读原文 ↗推荐理由:Cerebras 宣称其晶圆级芯片系统能提供比 GPU 快 30 倍的推理速度,展现了新型算力硬件在超高速推理场景的潜力。# Cerebras# 晶圆级芯片# AI推理# CS-4# 算力基础设施
Cerebras 官方博客(网页)✦ 精选AI 评分 75/100收录 07:49

Cerebras 携手 Upstage 将超高速 AI 推理算力引入韩国市场

AI 芯片创企 Cerebras 与韩国人工智能企业 Upstage 达成合作,共同将超高速 AI 推理服务引入韩国。该合作依托 Cerebras 的高性能算力架构,可实现高达每秒 2,000 个 token 的推理吞吐速度,旨在为韩国的企业级客户提供更低延迟、更高性能的实时生成式 AI 基础设施与应用支持。

阅读原文 ↗推荐理由:Cerebras 凭借其晶圆级芯片算力与区域头部 AI 企业合作落地超高速推理,展现了新兴 AI 芯片在企业级推理市场的竞争力拓展。# Cerebras# Upstage# AI推理# 算力基础设施# 企业级AI
Cerebras 官方博客(网页)✦ 精选AI 评分 75/100收录 07:49

Gemma 4 登陆 Cerebras:以超 1,800 tokens/s 实现极速多模态推理

Cerebras 宣布在其算力平台上支持 Gemma 4 31B 模型,推理生成速度超过每秒 1,800 个 token,将其超高速推理能力拓展至多模态领域。开发者可依托该低延迟算力支持,构建高响应速度的计算机视觉、文档解析、屏幕截图识别以及智能体(Agentic AI)工作流,显著提升端到端交互效率。

阅读原文 ↗推荐理由:展现了 Cerebras 晶圆级算力架构在大模型推理加速上的极高吞吐性能,拓展了多模态实时推理边界。# Cerebras# Gemma 4# AI推理# 多模态# 算力加速
Cerebras 官方博客(网页)✦ 精选AI 评分 75/100收录 07:49

Cerebras运行Kimi K2.6实测:推理速度达Gemini Flash五倍

根据性能对比测试,在 Cerebras 算力平台上运行的开源模型 Kimi K2.6,在智能水平上可比肩 Google Gemini 3.5 Flash。依托 Cerebras 晶圆级硬件加速架构,Kimi K2.6 的推理输出生成速度达到了后者的 5 倍,且具备更低的访问延迟和开源权重模型的部署灵活性。

阅读原文 ↗推荐理由:展现了 Cerebras 专用算力芯片在大模型超高速推理场景下的显著加速与低延迟优势。# Cerebras# Kimi# Gemini# AI芯片# 大模型推理
Cerebras 官方博客(网页)✦ 精选AI 评分 75/100收录 07:49

Cerebras 布局主权 AI:依托 CS-4 晶圆级芯片提供超快推理算力

文章阐释了主权 AI(Sovereign AI)的概念及其对各国的重要性,并介绍了芯片公司 Cerebras 如何助力国家级算力建设。Cerebras 依托其超大晶圆级芯片提供强大的 AI 推理能力,其推出的 Cerebras CS-4 系统宣称推理性能最高可达传统 GPU 的 30 倍,旨在为主权级 AI 基础设施提供自主、高效的硬件底层支持。

阅读原文 ↗推荐理由:Cerebras 结合主权 AI 趋势推广其 CS-4 晶圆级芯片,展现了非 GPU 架构在国家级算力与高速推理场景中的竞争态势。# Cerebras# 主权AI# AI芯片# 算力基础设施# AI推理
Cerebras 官方博客(网页)✦ 精选AI 评分 78/100收录 07:49

Cerebras为企业提供万亿参数推理支持,Kimi K2.6实测达981 token/秒

Cerebras宣布在其企业级测试中支持Kimi K2.6超大模型的极速推理,实测输出速度达到每秒981个Token。该方案旨在通过其专有算力芯片解决大模型推理的吞吐与延迟瓶颈,支持实时智能体编程及其他万亿参数级别的复杂AI工作负载,加速超大规模模型在企业级生产环境的高性能落地。

阅读原文 ↗推荐理由:Cerebras展现了其晶圆级芯片在超大参数模型上的极端推理吞吐表现,对低延迟企业级算力架构极具参考价值。# Cerebras# Kimi# AI芯片# 大模型推理# 算力基础设施
Cerebras 官方博客(网页)✦ 精选AI 评分 75/100收录 07:49

Cerebras 发布 CS-4 系统:宣称 AI 推理速度最高可达 GPU 的 30 倍

根据素材信息,Cerebras 依托其超大晶圆级芯片提供高速 AI 推理服务。其 Cerebras CS-4 系统在 AI 推理表现上据称最高可达到传统 GPU 的 30 倍。虽然输入标题涉及“生成优美的 UI”,但素材主体聚焦于芯片推理算力优势,关于 UI 生成的具体应用场景与技术结合细节在素材中信息不足。

阅读原文 ↗推荐理由:介绍了 Cerebras 晶圆级芯片 CS-4 在 AI 推理速度上大幅超越 GPU 的算力基础设施进展。# Cerebras# CS-4# AI推理# 算力基础设施# 晶圆芯片
vLLM 官方博客(网页)✦ 精选AI 评分 65/100收录 07:49

在 AMD GPU 上探索 vLLM 投机解码技术

本文主要探讨在 AMD GPU 硬件平台上利用 vLLM 推理框架实现投机解码(Speculative Decoding)的技术探索与优化。投机解码是一种有效降低大语言模型推理延迟的高级加速技术。结合 vLLM 与 AMD 算力生态,旨在提升大模型的生成吞吐量。由于原始素材仅提供标题,具体的实现细节、支持的硬件型号及性能评测数据等信息暂未披露。

阅读原文 ↗推荐理由:关注开源推理框架 vLLM 在 AMD GPU 算力平台上的投机解码实践与性能加速。# AMD# vLLM# 投机解码# GPU算力# 模型推理
IDC 圈·云与算力(网页)✦ 精选AI 评分 72/100收录 07:48

东南亚数据中心兴起“自带能源”模式,美项目落地菲律宾需3GW电力

随着算力建设规模激增,东南亚数据中心正转向“自带能源”(BYOP)模式以突破电力瓶颈。据悉,美国数据中心项目Pax Silica正规划落地菲律宾新克拉克城,该项目能源需求规模高达3GW。这一动向反映了超大规模算力基础设施在电网薄弱地区布局时,必须自行配套或解决巨额水电供应的新趋势。

阅读原文 ↗推荐理由:反映了东南亚算力基础设施建设面临的电力瓶颈及自带能源(BYOP)的新模式演进。# 东南亚# 数据中心# 算力基础设施# 能源配套# BYOP
IDC 圈·云与算力(网页)✦ 精选AI 评分 78/100收录 07:48

新加坡BDx在印尼启动640MW超大规模AI数据中心园区建设

总部位于新加坡的数据中心运营商BDx Data Centers正式在印度尼西亚西爪哇举行奠基仪式,启动一座规划容量达640兆瓦(MW)的人工智能数据中心园区建设。该项目重点面向AI高密算力需求,体现了印尼算力基础设施的快速扩张,也是东南亚地区规模最大的AI专用数据中心项目之一。

阅读原文 ↗推荐理由:640MW超大规模AI数据中心在印尼破土动工,是东南亚算力基础设施布局的重要风向标。# BDx# 印尼# AI数据中心# 算力基建# 东南亚
IDC 圈·云与算力(网页)✦ 精选AI 评分 60/100收录 07:48

泰国拟推数据中心监管新规:100兆瓦以上划定为超大规模设施

泰国国家经济和社会发展委员会(NESDC)秘书长丹努查·皮查亚南近日透露,泰国针对数据中心业务的新监管规定有望于2026年10月中旬前最终确定并正式实施。根据相关规划,新规将功率在100兆瓦以上的设施定为超大规模数据中心。该项政策意在进一步规范泰国本土数据中心产业发展,当前具体监管细则仍待后续官方进一步完善与公布。

阅读原文 ↗推荐理由:反映了东南亚区域针对超大规模算力基础设施监管政策的最新制度化动向。# 泰国# 数据中心# 超大规模数据中心# 算力基础设施# 行业监管
IDC 圈·云与算力(网页)✦ 精选AI 评分 65/100收录 07:48

国际算力产业每周观察:AWS永久关闭中东节点及GS韩国110亿美元规划

本期国际算力产业观察汇总了全球53条产业动态,热点集中在北美、欧洲等地区。重点事件包括AWS宣布永久关闭其中东节点,韩国GS集团提出110亿美元的算力与基建规划,马来西亚雪兰莪州针对数据中心设立30%本土供应链门槛,以及新泽西漏油事件和得州对数据中心用水违规的处罚等。由于原始摘要信息有限,更多区域细节有待展开。

阅读原文 ↗推荐理由:集中梳理了AWS节点调整、亚太大型算力投资及欧美环保监管等多项全球数据中心重要动态。# 数据中心# AWS# 算力基础设施# 海外动态# 行业周报
IDC 圈·云与算力(网页)AI 评分 58/100收录 07:48

从GW级园区到800VDC:全球AI数据中心全面转向电力与基建全局竞争

当前全球超大规模云厂商、AI芯片与基础设施企业正在加速算力产业的长期布局。头部玩家之间的核心竞争正从单纯追求GPU数量和单个项目规模,延伸至整体算力容量、电力资源保障、GW级园区规划、高性能网络、资本运作及800VDC等底层供电架构的全局部署,凸显出AI数据中心向电力基础设施深度演进的产业趋势。

阅读原文 ↗推荐理由:指出了AI算力竞争由单点算力规模向电力、园区与供电架构等基础设施全局演进的重要动向。# AI数据中心# 算力基础设施# 800VDC# 电力保障# 绿色算力
IDC 圈·云与算力(网页)✦ 精选AI 评分 68/100收录 07:48

马来西亚雪兰莪州推动数据中心采用30%本地供应链,扶持本土IC设计产业

马来西亚雪兰莪州正迎来数据中心基础设施的快速扩张。当地提出推动数据中心项目采用至少30%的本地供应链,旨在借助这一轮算力基建投资浪潮,带动本土半导体及信息技术生态发展,为当地集成电路(IC)设计公司等高附加值产业创造切实的新增市场需求与合作机会。

阅读原文 ↗推荐理由:展现了东南亚算力基建热潮中地方政府通过本地化采购配额扶持本土半导体产业的政策动向。# 数据中心# 马来西亚# 算力基础设施# 供应链# 半导体
ServeTheHomeAI 评分 55/10007:17

永擎推出SORANOD8-2L2T主板:适配AMD EPYC 8005 Sorano系列处理器

ServeTheHome 对永擎(ASRock Rack)旗下的新型服务器主板 SORANOD8-2L2T 进行了评测。该主板专为 AMD EPYC 8005 系列(代号 Sorano)处理器打造,提供了丰富的扩展与连接性接口,适用于边缘计算及密集型服务器等部署场景。具体规格参数与性能测试细节请参考评测原文。

阅读原文 ↗推荐理由:展示了针对 AMD EPYC 8005 平台的新型服务器主板硬件评测,对数据中心边缘算力部署具有一定参考价值。# 永擎# AMD EPYC# 服务器主板# 数据中心# 硬件评测
Data Center Knowledge✦ 精选AI 评分 65/10006:46

数据中心低频噪音引发关注:运营商需知与应对建议

本文关注数据中心运行过程中产生的次声波与低频噪音问题。随着计算基础设施规模持续扩张,数据中心噪音对周边社区的影响正受到越来越严格的审查与关注。为保障项目的顺利推进并缓和邻避效应,运营商必须采取主动的噪音抑制与缓解措施,并与周边社区展开透明沟通。该内容揭示了算力基础设施在物理环境与社会治理层面面临的新现实挑战。

阅读原文 ↗推荐理由:聚焦数据中心基础设施的环保与社区治理难题,为设施选址与运营合规提供了实用参考。# 数据中心# 基础设施# 低频噪音# 环境保护# 运营管理
TechCrunch AI✦ 精选AI 评分 72/10002:11

甲骨文就新墨西哥州Stargate数据中心发布不可抗力通知

甲骨文公司(Oracle)针对其位于新墨西哥州的Stargate数据中心发出了不可抗力通知。该通知允许甲骨文在设施未能达成2028年按期上线目标时推迟相关款项的支付。这表明该大型数据中心项目的建设推进可能正面临外部阻力或交付延误风险,进而对后续算力基础设施的投产节奏产生影响。

阅读原文 ↗推荐理由:涉及科技巨头核心数据中心建设的延期风险与财务条款调整,反映了当前大型算力基建面临的实际交付挑战。# 甲骨文# Stargate# 数据中心# 算力基建# 不可抗力
Buzzing HN · 中文精选✦ 精选AI 评分 60/10001:51

甲骨文援引“不可抗力”条款为其争议数据中心项目辩护

据外媒报道,甲骨文公司(Oracle)在一处引发争议的数据中心项目中援引了“不可抗力”(Force Majeure)条款,以此来规避潜在法律责任并为自身行为辩护。当前公开素材信息有限,关于该争议数据中心的具体地理位置、所涉纠纷原因、建设受阻的具体背景以及相关利益方的反应等详细情况,仍有待进一步披露。

阅读原文 ↗推荐理由:甲骨文数据中心建设涉及法律及争议纠纷,体现了数据中心扩张中的合规与建设风险。# 甲骨文# 数据中心# 不可抗力# 算力基础设施# 海外动态
The Decoder✦ 精选AI 评分 75/10001:45

谷歌推进Suncatcher项目,探索利用太阳能构建太空AI轨道数据中心

谷歌正推进名为“Suncatcher”的实验项目,旨在利用太阳能将AI基础设施部署在地球轨道上。一颗冰箱大小的实验卫星定于10月1日由SpaceX猎鹰9号火箭发射升空。然而该方案面临巨大挑战:匹配地面单座1吉瓦数据中心需约1万颗卫星,杰夫·贝索斯也预测轨道数据中心在成本上超越地面可能需要20年时间。

阅读原文 ↗推荐理由:谷歌探索将AI算力设施送入轨道的新途径,展示了未来突破能源与散热瓶颈的前沿设想。# 谷歌# 数据中心# 太空算力# 太阳能# AI基础设施
Data Center DynamicsAI 评分 55/10001:44

氮化镓能否助力供电?探讨GaN在数据中心的落地前景

该内容探讨了数据中心行业是否正在逐步兑现氮化镓(GaN)半导体技术的应用潜力,以应对日益增长的电力与能效挑战。氮化镓作为新一代功率半导体,在提升供电效率、缩小体积方面备受关注。因原文提供的信息较为简短,尚未披露具体的落地案例或技术评测细节。

阅读原文 ↗推荐理由:关注新一代半导体材料GaN对解决AI数据中心严峻电力瓶颈的潜在价值。# 数据中心# 氮化镓# GaN# 绿色算力# 基础设施
Hacker News · AI✦ 精选AI 评分 75/10000:41

AI基础设施建设正成为美国历史上规模最大的经济押注

《华尔街日报》报道指出,当前围绕人工智能的底层基础设施建设与资本支出规模急剧增长,正在演变为美国经济史上前所未有的重大投资押注。科技巨头与资本市场正将巨额资金倾注于数据中心、电力设施和算力芯片等领域,预期AI将驱动新一轮生产力革命。由于原始输入仅提供标题与链接,具体投资测算数据与经济风险分析需查阅原文。

阅读原文 ↗推荐理由:聚焦AI基建对美国宏观经济与资本市场的重大影响,揭示前所未有的产业投资热潮。# AI基建# 宏观经济# 算力投资# 数据中心# 产业动态
Google Developers · AI 筛选✦ 精选AI 评分 75/100收录 00:15

Google Colab 现已纳入 Google AI 订阅计划

Google Colab 正式整合进 Google AI 订阅方案中。订阅用户现可直接解锁 Colab 的高级计算资源,获得优先使用的计算加速器、高端 GPU 以及支持长时间模型训练的后台执行功能。该调整进一步打通了 Google 的 AI 订阅权益与开发工具链,方便开发者与研究人员更高效地开展深度学习与模型训练工作。

阅读原文 ↗推荐理由:Google 将 Colab 高级算力与后台执行权益整合进统一的 AI 订阅计划,直接利好开发者与研究人员。# Google# Colab# GPU# 算力# 开发者工具
9月24日2026-09-24
Hacker News · AI✦ 精选AI 评分 65/10023:58

甲骨文对其新墨西哥州AI数据中心项目援引不可抗力条款

据外媒报道,甲骨文(Oracle)已针对其位于美国新墨西哥州的AI数据中心项目援引了“不可抗力”(force majeure)条款。目前所提供的原始信息较为有限,尚未透露触发该条款的具体原因、工程受影响的具体阶段,以及对甲骨文算力扩张计划的后续影响,需关注后续详细披露。

阅读原文 ↗推荐理由:AI数据中心项目出现不可抗力停摆,反映出当前算力基础设施在电网供应或落地建设中面临的实际阻碍。# 甲骨文# AI数据中心# 算力基础设施# 不可抗力# 行业动态