AIDC
DC AI 热点

精选

当前热点完整榜单 →
1微软发布新版Copilot超级应用:整合聊天、编程与智能体能力82 热度 ⌁2前特斯拉Dojo高管创立的AI芯片初创公司估值达100亿美元80 热度 ⌁3Anthropic 与 Akamai 达成 116 亿美元云算力协议,年内算力支出承诺已超 5000 亿美元79 热度 ⌁4马斯克披露AI算力布局:Colossus集群拟部署超百万张英伟达GB300芯片78 热度 ⌁5谷歌启动Project Suncatcher:计划下周开展首个太空轨道数据中心测试78 热度 ⌁
9月25日2026-09-25
arXiv 机器学习✦ 精选AI 评分 72/10012:00

面向机制可解释性的流递归模型(SRM)

该研究针对机制可解释性技术难以随大语言模型规模与深度扩展的问题,提出了一种新型架构——流递归模型(SRM)。SRM 是对分层推理模型(HRM)的改进,通过将计算过程组织为多个相互交互的潜在流,在保持模型可扩展性的同时暴露其内部计算结构。该工作旨在通过设计天然具备可解释性结构的小型模型,为验证和理解模型内部行为提供新的探索路径。

阅读原文 ↗推荐理由:提出了一种面向机制可解释性的新型模型架构,通过多潜在流交互设计探索可扩展与透明性并存的路径。# 模型架构# 可解释性# SRM# 前沿研究# 大模型
arXiv 机器学习✦ 精选AI 评分 65/10012:00

无监督学习何时成败?基于子空间视角的重构异常检测几何分析

该研究探讨了基于重构的无监督异常检测在模型过度拟合异常或丢失正常变异时的失败机理。论文借助“子空间追求”(PoS)假说,从交集、并集和联接几何视角对失败模式进行理论表征:模型容量过大易引发联接盲区,容量不足则会导致交集偏好与正常保真度下降。研究证明紧凑的正常数据并集是最优保真范围,通常依赖非线性重构映射实现。

阅读原文 ↗推荐理由:从几何与子空间理论角度系统解析了重构型无监督异常检测的成败机理,具有扎实的理论分析价值。# 无监督学习# 异常检测# 子空间假说# 重构误差# 前沿研究
arXiv 人工智能✦ 精选AI 评分 75/10012:00

基于偏差引导的大模型智能体技能自我进化机制

该研究针对大语言模型智能体在复杂工具使用任务中的技能自我进化问题展开探索。论文指出,复杂任务通常存在多种有效解题路径,失败轨迹往往也包含前期的有效进展而非全盘皆错。因此,研究提出不应将失败轨迹强行与固定成功路径对齐或进行粗粒度反思,而应精确定位有效求解向错误偏离的转折点,通过偏差引导的方式实现智能体技能的高效自我进化与演进。

阅读原文 ↗推荐理由:提出了一种细粒度定位失败偏离点的智能体技能演进新思路,有助于提升复杂工具调用场景下的自适应能力。# 智能体# 大模型# 工具调用# 自我进化# 轨迹分析
arXiv 机器学习✦ 精选AI 评分 75/10012:00

LastOPD:解决隐状态同策略大模型蒸馏中的后期崩溃问题

该研究针对大模型同策略蒸馏(OPD)缺乏教师模型隐层思考过程的问题展开探索。尽管引入隐状态监督(Latent supervision)能对齐学生与教师模型的内部状态,但在将Qwen3-4B/8B蒸馏至Qwen3-1.7B-Base的实验中,研究人员发现该方法存在“早期增益、后期崩溃”的失效现象,MATH-500准确率虽迅速提升但随后崩溃。为此,论文提出了LastOPD方法以抑制此类崩溃。

阅读原文 ↗推荐理由:针对大语言模型同策略隐层蒸馏中性能崩溃问题提出解决方案,对模型轻量化与对齐训练具有参考价值。# 蒸馏# Qwen3# 大模型# 前沿研究
arXiv 机器学习✦ 精选AI 评分 68/10012:00

图像保真度不等同于场保真度:神经断层扫描中的热力学联合重建与误差定位

该论文针对科学断层扫描中神经场优化的核心难题展开研究。作者指出,由于2D到3D的正向映射为多对一关系,较低的2D图像误差并不能保证隐式3D物理场的准确性,且该隐式场在训练中缺乏直接监督。为此,研究团队提出了CoroNeRF框架,利用可微原子发射渲染器,直接从多视角、多谱线辐射强度中联合优化3D电子密度与温度场,并在日冕断层扫描场景中进行了测试与验证(注:原摘要结尾处有所截断)。

阅读原文 ↗推荐理由:探索了神经场技术在科学计算与3D物理场重构中的前沿应用,对解决多对一病态重构问题具有理论参考价值。# 神经场# NeRF# 断层扫描# 3D重建# AI for Science
arXiv 机器学习✦ 精选AI 评分 68/10012:00

基于电子先验与响应态学习的可迁移振动光谱表征研究

针对振动光谱预测在跨化学空间场景下易受局部立体电子环境扰动而导致精度下降的问题,研究提出 SO(3) 等变神经卡尔曼网络(SENK)。该框架构建了响应态级联结构,融合了用于学习 Hessian 矩阵、偶极导数及极化率导数的等变 Transformer 骨干网络,通过等变神经卡尔曼桥实现状态依赖精炼与可靠性感知,并结合 NBO 电子先验以提升光谱表征的可迁移性。

阅读原文 ↗推荐理由:提出结合电子先验与等变神经网络的新架构,解决了分子振动光谱预测中的跨空间迁移与精度难题。# AI for Science# 等变神经网络# Transformer# 光谱预测# 分子表征
arXiv 机器学习✦ 精选AI 评分 70/10012:00

基于埃尔米特多项式的谱图神经网络架构 HermNet 研究

该研究深入探讨了基于埃尔米特多项式构建的谱图神经网络,并提出了 HermNet 模型。该模型将节点级预测器与归一化埃尔米特传播相结合,依靠稀疏递推关系实现计算,既无需昂贵的特征值分解也不依赖可学习基底。研究还评估了坐标校准、响应归一化和高斯导数正则化等可选机制,并系统分析了在有限训练预算下,不同完备多项式基底在优化行为上的差异。

阅读原文 ↗推荐理由:提出了一种基于埃尔米特多项式且无需特征分解的高效谱图神经网络新架构 HermNet。# 图神经网络# HermNet# 谱图理论# 多项式基底# 模型架构
arXiv 机器学习✦ 精选AI 评分 68/10012:00

基于lp正则化的大语言模型LoRA自动秩分配方法

低秩适应(LoRA)已成为大语言模型中广泛应用的参数高效微调方法,但如何确定各适应矩阵的秩仍是核心挑战。针对现有自适应秩分配方法多依赖人工设计重要性评分的问题,该研究提出了lp-LoRA方法。该方法基于信号处理中经典的稀疏诱导技术,利用0

阅读原文 ↗推荐理由:提出了一种基于lp正则化的LoRA自动秩分配新方案,改进了大模型参数高效微调的优化理论与实现。# 大模型# LoRA# 微调# 模型架构# 稀疏正则化
IT之家 · AI 筛选✦ 精选AI 评分 68/10011:40

曝 OpenAI 或筹备 ChatGPT Pro Max 订阅档位,代码中现相关字段

开发者在 ChatGPT 网页端源代码中发现了“PROMAX”相关字段,业内据此推测 OpenAI 可能正筹备推出更高阶的订阅方案,月费或达 600 美元。目前 OpenAI 官方尚未证实该计划,产品命名、功能与定价仍存不确定性。此前由于系统压力加剧,OpenAI 已暂停了 200 美元档位的 Pro 订阅新增。这一潜在新档位或反映出其在算力负载与商业化层级上的新探索。

阅读原文 ↗推荐理由:反映了 OpenAI 应对算力压力与高端用户需求时潜在的商业化定价新策略。# OpenAI# ChatGPT# 投融资# 大模型
IT之家 · AI 筛选✦ 精选AI 评分 68/10011:02

新一代梅赛德斯-迈巴赫 S 级轿车上市:搭载端侧多模态大模型与高阶智驾

新一代梅赛德斯-迈巴赫 S 级轿车正式上市,售价 139.8 万元起。该车型首度搭载梅赛德斯-奔驰 MB.OS 架构与最新一代交互系统,在座舱中应用端侧多模态 VLM 大模型;智驾方面配备全新城区及高速领航辅助驾驶系统,支持车位到车位辅助与智能泊车,未来还将通过 OTA 率先升级搭载 Momenta R7 世界模型,加速大模型在高端智能汽车硬件上的量产落地。

阅读原文 ↗推荐理由:展示了端侧多模态大模型与智能驾驶世界模型在顶级豪华量产燃油车上的工程化落地。# 智能汽车# 自动驾驶# 大模型# 智能座舱# Momenta
IT之家 · AI 筛选✦ 精选AI 评分 78/10010:51

DeepSeek Harness 官方桌面版开发者预览偷跑上线

深度求索(DeepSeek AI)旗下智能体运行时框架 DeepSeek Harness 悄然上线官方桌面版开发者预览,版本号为 V0.1.7-rc.2。该桌面版免去了此前安装 Node.js 及终端运行的繁琐步骤,目前已支持 Windows x64 和 macOS Apple Silicon。应用内置标准模式、PTC 模式、极简模式和创造模式四种模式,支持智能体代码处理、批量调用工具和对话定制插件等功能。

阅读原文 ↗推荐理由:DeepSeek 官方 Agent 运行时框架推出开箱即用桌面客户端,大幅降低了本地智能体开发与使用门槛。# DeepSeek# 智能体# DeepSeek Harness# 桌面端
AITNT · AI头条(网页)✦ 精选AI 评分 75/10010:15

Meta发布掌上独立AI硬件Muse Charm,由前苹果设计主管操刀

Meta在Connect大会上推出了便携式掌上AI设备Muse Charm,由前苹果界面设计主管Alan Dye操刀设计。该设备配备2英寸触摸屏和5G调制解调器,能够脱离手机独立运行AI助手Muse,类似AI版本的“拓麻歌子”电子宠物形态。设备计划于今年12月假日购物季正式开售,进一步拓展了消费级独立AI硬件的应用场景与终端形态。

阅读原文 ↗推荐理由:Meta推出由前苹果知名设计师操刀的独立掌上AI硬件,展现了消费级AI终端形态的新探索。另有 1 家信源报道# Meta# Muse Charm# 智能硬件# 端侧AI
AITNT · AI头条(网页)✦ 精选AI 评分 85/10010:14

OpenAI升级ChatGPT语音功能,支持通过语音指令执行复杂工作任务

OpenAI宣布为ChatGPT Voice上线语音执行任务功能,通过接入模型与插件体系,用户可直接通过语音指令查验邮件、制作PPT、搭建网站及追回重复扣费等。该项能力已深度整合进此前推出的ChatGPT Work Agent中,新版本应用已同步面向全球用户推送,标志着语音交互进一步向具备实际操作能力的智能体演进。

阅读原文 ↗推荐理由:OpenAI将语音助手与Agent工作流深度结合,展现了语音端到端任务执行的重要应用工程进展。# OpenAI# ChatGPT# 智能体# 语音# AI办公
AITNT · AI头条(网页)✦ 精选AI 评分 75/10010:14

科大讯飞发布全国产算力训练语音识别大模型Spark-ASR-2.0

科大讯飞推出基于全国产算力训练的语音识别大模型Spark-ASR-2.0,该模型依托语音基座大模型Spark-Audio-1.0-Preview构建。新版本在方言免切换识别、嘈杂环境应对、上下文纠错以及口语书面化规范等方面实现显著提升,同时整体推理成本较上一代仅增加10%。目前,该模型已落地讯飞输入法,并通过讯飞开放平台对外提供API服务。

阅读原文 ↗推荐理由:科大讯飞基于全国产算力推出新一代语音识别大模型,在上下文理解与低成本推理上实现重要升级并已开放落地。# 科大讯飞# 语音# 算力# 大模型
AITNT · AI头条(网页)✦ 精选AI 评分 76/10010:14

Meta个人智能体Muse被指借鉴开源项目OpenClaw,官方承认深受启发

Meta旗下个人智能体应用Muse在上线12天后下载增速亮眼,但随后被曝光其关键核心文件SOUL.md及工作区组织逻辑与开源项目OpenClaw高度雷同。对此,Meta超级智能实验室产品负责人Nat Friedman公开承认,Muse在产品整体设计上确实深受OpenClaw启发,团队致力于将其进一步优化改造,打造为一个兼具安全易用性、可拓展至数十亿用户规模的版本。

阅读原文 ↗推荐理由:揭示了Meta近期爆款个人智能体产品的架构来源及其在消费级Agent生态中的落地探索。# Meta# 智能体# Muse# OpenClaw# 应用工程
AITNT · AI头条(网页)✦ 精选AI 评分 70/10010:14

前豆包PC端负责人齐俊元创业,发布主动式个人Agent操作系统Today

前豆包PC端负责人齐俊元正式发布主动式个人Agent操作系统“Today”。该系统具备Living Memory记忆能力与Proactive主动交互特性,能够深度连接用户的邮件、日历、笔记等常用办公应用。通过对上下文信息的持续记忆与分析,Today可自主为用户梳理工作节奏并主动推送个性化早晚报,标志着个人Agent正从被动响应转向主动服务的应用落地探索。

阅读原文 ↗推荐理由:知名AI产品负责人离职创业并推出主打主动交互与记忆能力的个人Agent操作系统,体现了Agent落地形态的新尝试。# 智能体# 个人操作系统
AITNT · AI头条(网页)✦ 精选AI 评分 70/10010:13

开源智能体项目Orbital发布:支持上下文资产迁移与多模型用量透明管理

开源智能体项目Orbital主张“Context is yours”,旨在解决用户上下文资产被主流厂商Agent锁定的痛点。该项目能将散乱的交互会话沉淀为可自由迁移的项目记忆,助力用户拿回数据自主权。同时,配合观猹推出的Tokendance模型钱包,系统支持对DeepSeek、GLM、Kimi等70余个主流模型的Token用量进行透明化监控与管理,提升多模型协同与应用工程效率。

阅读原文 ↗推荐理由:直击智能体生态中上下文资产被大厂锁定的痛点,提供了实用的记忆迁移与多模型用量管理工具。# 智能体# Orbital# 上下文管理# Token管理
AITNT · AI头条(网页)✦ 精选AI 评分 75/10010:13

盘点梁文锋署名技术论文:聚焦底层架构与核心算子创新

该文梳理了梁文锋在学术论文中的署名脉络。过去三年中,梁文锋极少作为第一作者或通讯作者出现在动辄上百人署名的旗舰模型整体报告中,而是将研究精力与署名重点投向最底层的原子技术,包括MLA注意力机制、MoE路由机制、mHC拓扑流形、DSpark推理算子以及DSec智能体沙盒等关键底层技术论文,展现了其对AI基础架构研发的深耕。

阅读原文 ↗推荐理由:梳理了梁文锋在MLA、MoE路由等关键底层模型架构与算子上的核心技术论文贡献。# 模型架构# MLA# MoE# 芯片
AITNT · AI头条(网页)✦ 精选AI 评分 65/10010:13

专访Eight Sleep创始人:AI智能床套的技术创新与预防医疗布局

Eight Sleep联合创始人介绍了其AI智能床套Pod的核心功能与商业布局。该产品集成了动态液冷温控与健康异常预警技术,目前正在推进美国FDA医疗认证申请。同时,创始人分享了开拓中国市场取得的高速增长态势,以及对高端硬件产品定价策略的思考,探讨了AI睡眠硬件从消费级产品演进为预防医疗入口的商业路径。

阅读原文 ↗推荐理由:展现了AI与智能温控硬件结合在睡眠健康及预防医疗领域的典型落地案例与商业化探索。# Eight Sleep# 智能硬件# 医疗AI# 数据中心# 预防医疗
IT之家 · AI 筛选✦ 精选AI 评分 75/10010:12

英伟达黄仁勋:前沿实验室若无法控制AI安全必须关停

英伟达首席执行官黄仁勋在接受《纽约时报》采访时表示,针对前沿AI模型的“越狱”攻击等行为,若前沿实验室无法保证AI安全与实验可控性,就必须停止实验乃至关闭实验室。他指出,AI实验一旦产生失控智能体将引发民事与刑事责任,相关机构必须承担后果。黄仁勋同时强调,当前不应陷入泛安全焦虑,而应将核心精力聚焦于AI实验本身的实际可控性上。

阅读原文 ↗推荐理由:英伟达掌门人就AI前沿模型安全与失控追责问题发表强硬观点,引发行业对安全治理边界的关注。# 英伟达# 安全# 治理# 智能体
AITNT · AI头条(网页)✦ 精选AI 评分 83/10010:12

七校联合开源世界动作模型OpenWAM,构建机器人动作模拟基座

新加坡国立大学、清华大学、北京大学等七所高校联合开源了机器人世界动作模型OpenWAM。该项目包含OpenWAM-Infra模块化基础设施、OpenWAM-Study受控实验及OpenWAM-α大规模预训练基座模型,旨在将视频生成中蕴含的世界动态物理先验与机器人动作学习相结合。实验表明,该模型在多个仿真基准和真实机器人平台上成功验证了预测环境演变并执行控制动作的能力。

阅读原文 ↗推荐理由:清华、北大等多所高校联合开源机器人世界模型,打通了视频生成先验与具身动作控制的结合。# OpenWAM# 具身智能# 世界模型# 开源基座
AITNT · AI头条(网页)✦ 精选AI 评分 68/10010:12

斑马智能发布面向智能终端的全模态端侧大模型AutoOmni 2.0

在2026云栖大会上,斑马智能正式发布了面向智能终端的全模态端侧大模型AutoOmni 2.0-23B-A3B。斑马智能提出,智能汽车是具身智能规模最大的中试场,将推动智能终端成为生成与处理Token的关键载体。公司强调,端侧AI基础设施的建设与成熟,将直接决定人工智能技术能否在真实物理世界中实现真正的深度落地与广泛应用。

阅读原文 ↗推荐理由:发布了聚焦智能汽车与具身智能终端的全模态端侧大模型,展现了端侧AI落地基础设施的最新探索。# 斑马智能# 大模型# 具身智能# 智能汽车# AutoOmni
AITNT · AI头条(网页)✦ 精选AI 评分 78/10010:11

GLM-5.3-Flash融合Kimi与DeepSeek注意力架构,大模型设计走向混合组合

GLM-5.3-Flash在同一模型架构中融合了Kimi的KDA线性注意力与DeepSeek的KPool-DSA稀疏注意力机制。这一架构创新表明,大模型底层Attention机制正经历演进,从以往不同机构各自独立押注的竞争性技术路线,转变为可在单一模型内按需分工、协同组合的模块化设计选项,为长文本处理与高效推理提供了新的工程实践范式。

阅读原文 ↗推荐理由:体现了大模型底层注意力机制从单一路线竞争向异构融合设计演进的重要技术趋势。# GLM# DeepSeek# Kimi# 注意力机制# 模型架构
AITNT · AI头条(网页)✦ 精选AI 评分 82/10010:11

华为发布昇腾950超节点,为十万亿级大模型训推提供底座

华为昇腾950超节点在华为全联接大会正式发布上市,定位为业界最大规模商用超节点。该方案通过灵衢互联、统一内存编址等关键技术创新,旨在打破算力、存储和通信三方面的技术瓶颈,解决超大规模集群互联难题,为十万亿级参数大模型的训练与推理场景提供高性能算力基础设施支撑。

阅读原文 ↗推荐理由:昇腾950超节点作为面向十万亿级大模型的大规模商用算力基础设施,展示了国产智算集群技术的重大突破。# 华为# 昇腾# 超节点# 算力# 大模型
AITNT · AI头条(网页)✦ 精选AI 评分 75/10010:11

诺因发布生成式学习框架GLOW,登顶三大具身智能榜单

诺因(Knowin)正式发布生成式学习框架GLOW。该框架凭借原生自回归架构、Harness闭环反馈系统以及RSI递归自我改进机制,在RoboDojo、LIBERO-Pro和Embodied Arena三大具身智能评测榜单中均斩获第一,性能表现超越GPT-6,推动机器人迈向“一教就会”的个性化家庭服务应用场景。

阅读原文 ↗推荐理由:展示了结合自回归与闭环反馈的具身智能新架构在多个基准测试中的领先表现。# 具身智能# 大模型# 评测# 世界模型
AITNT · AI头条(网页)✦ 精选AI 评分 72/10010:10

觅蜂科技推出物理AI数据众包平台“觅蜂派”,发力具身智能数据采集

觅蜂科技推出物理AI数据众包服务平台“觅蜂派”,采用众包模式让普通用户佩戴自研MEgo采集设备在真实场景中采集具身数据并赚取报酬。该平台目前已积累2万台设备和百万小时级物理数据,致力于解决具身智能领域高质量真实场景数据匮乏的痛点,并已向腾讯Robotics X实验室、蚂蚁灵波等客户提供服务。

阅读原文 ↗推荐理由:展示了具身智能领域通过众包与自研硬件解决物理世界高质量训练数据稀缺难题的创新实践。另有 1 家信源报道# 具身智能# 数据众包# 觅蜂科技# 智能硬件
AITNT · AI头条(网页)✦ 精选AI 评分 78/10010:08

高通发布新一代骁龙8旗舰SoC,全面转向面向Agent的芯片架构

在骁龙峰会上,高通CEO克里斯蒂亚诺・安蒙正式介绍了高通面向Agent时代的战略转型规划。高通同步推出了两款新一代旗舰手机SoC:第六代骁龙8超级至尊版(Snapdragon 8 Elite Extreme Gen 6)与第六代骁龙8至尊版(Snapdragon 8 Elite Gen 6)。这一代芯片针对端侧AI Agent应用场景进行了底层架构的重新设计与深度优化。

阅读原文 ↗推荐理由:高通旗舰移动芯片专为AI Agent应用重构底层设计,体现了端侧算力硬件向智能体驱动演进的重要风向。# 高通# 骁龙# 手机芯片# 智能体# 算力
AITNT · AI头条(网页)✦ 精选AI 评分 60/10010:07

当AI与自动化重塑工作流,个人如何在新职业生态中建立核心价值

学者马特·贝恩通过对传统手术与机器人手术的长达两年的观察研究指出,自动化技术的引入显著改变了工作模式。过去需要多名医生协作、为年轻学徒提供实践机会的手术流程,在机器人辅助下逐渐变为专家单人即可完成,导致传统技能传授路径受阻。这一现象引发了关于AI普及后,基础实践机会减少、人类职业技能如何重塑以及依靠何种不可替代能力获得市场回报的深层讨论。

阅读原文 ↗推荐理由:通过医疗机器人案例深入探讨了AI自动化对学徒传承机制与未来职场核心竞争力的系统性冲击。# AI替代# 手术机器人# 职业发展# 投融资# 技能培训
AITNT · AI头条(网页)✦ 精选AI 评分 72/10010:07

北大等团队开源强化学习数据策略框架DataFlex-RL,简化模型后训练对比

随着推理模型和可验证奖励强化学习(RLVR)在后训练中的重要性日益凸显,大模型训练中的数据策略安排变得愈发关键。为此,北大DCAI团队联合中国科学院大学、上海算法创新研究院以及中关村学院开源发布了DataFlex-RL。该框架旨在解决强化学习后训练中数据策略接入繁琐及效果对比不公平等痛点,为模型训练策略的标准化与高效评测提供支持。

阅读原文 ↗推荐理由:北大联合多家机构开源针对大模型强化学习后训练的数据策略框架,提升了后训练研究的对比规范与工程效率。# 强化学习# 大模型# 开源# 北京大学# 后训练
C114 通信网 · AI与算力(网页)✦ 精选AI 评分 62/100收录 09:49

中国联通探讨5G-A赋能具身智能的网络基础设施需求

据C114讯报道,市场研究机构Omdia参加了世界人形机器人大赛等相关活动。报道围绕中国联通的5G-A网络实战实践,深入探讨了具身智能及人形机器人发展对底层网络通信所提出的具体性能与架构要求。由于原始输入素材信息存在截断,关于中国联通具体的5G-A网络技术方案与支撑案例细节尚未完全披露。

阅读原文 ↗推荐理由:探讨了5G-A通信网络对人形机器人与具身智能规模化落地的支撑需求,具有一定行业参考价值。# 中国联通# 5G-A# 具身智能# 通信网络