基于埃尔米特多项式的谱图神经网络架构 HermNet 研究
该研究深入探讨了基于埃尔米特多项式构建的谱图神经网络,并提出了 HermNet 模型。该模型将节点级预测器与归一化埃尔米特传播相结合,依靠稀疏递推关系实现计算,既无需昂贵的特征值分解也不依赖可学习基底。研究还评估了坐标校准、响应归一化和高斯导数正则化等可选机制,并系统分析了在有限训练预算下,不同完备多项式基底在优化行为上的差异。
该研究深入探讨了基于埃尔米特多项式构建的谱图神经网络,并提出了 HermNet 模型。该模型将节点级预测器与归一化埃尔米特传播相结合,依靠稀疏递推关系实现计算,既无需昂贵的特征值分解也不依赖可学习基底。研究还评估了坐标校准、响应归一化和高斯导数正则化等可选机制,并系统分析了在有限训练预算下,不同完备多项式基底在优化行为上的差异。
低秩适应(LoRA)已成为大语言模型中广泛应用的参数高效微调方法,但如何确定各适应矩阵的秩仍是核心挑战。针对现有自适应秩分配方法多依赖人工设计重要性评分的问题,该研究提出了lp-LoRA方法。该方法基于信号处理中经典的稀疏诱导技术,利用0
开发者在 ChatGPT 网页端源代码中发现了“PROMAX”相关字段,业内据此推测 OpenAI 可能正筹备推出更高阶的订阅方案,月费或达 600 美元。目前 OpenAI 官方尚未证实该计划,产品命名、功能与定价仍存不确定性。此前由于系统压力加剧,OpenAI 已暂停了 200 美元档位的 Pro 订阅新增。这一潜在新档位或反映出其在算力负载与商业化层级上的新探索。
新一代梅赛德斯-迈巴赫 S 级轿车正式上市,售价 139.8 万元起。该车型首度搭载梅赛德斯-奔驰 MB.OS 架构与最新一代交互系统,在座舱中应用端侧多模态 VLM 大模型;智驾方面配备全新城区及高速领航辅助驾驶系统,支持车位到车位辅助与智能泊车,未来还将通过 OTA 率先升级搭载 Momenta R7 世界模型,加速大模型在高端智能汽车硬件上的量产落地。
深度求索(DeepSeek AI)旗下智能体运行时框架 DeepSeek Harness 悄然上线官方桌面版开发者预览,版本号为 V0.1.7-rc.2。该桌面版免去了此前安装 Node.js 及终端运行的繁琐步骤,目前已支持 Windows x64 和 macOS Apple Silicon。应用内置标准模式、PTC 模式、极简模式和创造模式四种模式,支持智能体代码处理、批量调用工具和对话定制插件等功能。
Meta在Connect大会上推出了便携式掌上AI设备Muse Charm,由前苹果界面设计主管Alan Dye操刀设计。该设备配备2英寸触摸屏和5G调制解调器,能够脱离手机独立运行AI助手Muse,类似AI版本的“拓麻歌子”电子宠物形态。设备计划于今年12月假日购物季正式开售,进一步拓展了消费级独立AI硬件的应用场景与终端形态。
OpenAI宣布为ChatGPT Voice上线语音执行任务功能,通过接入模型与插件体系,用户可直接通过语音指令查验邮件、制作PPT、搭建网站及追回重复扣费等。该项能力已深度整合进此前推出的ChatGPT Work Agent中,新版本应用已同步面向全球用户推送,标志着语音交互进一步向具备实际操作能力的智能体演进。
科大讯飞推出基于全国产算力训练的语音识别大模型Spark-ASR-2.0,该模型依托语音基座大模型Spark-Audio-1.0-Preview构建。新版本在方言免切换识别、嘈杂环境应对、上下文纠错以及口语书面化规范等方面实现显著提升,同时整体推理成本较上一代仅增加10%。目前,该模型已落地讯飞输入法,并通过讯飞开放平台对外提供API服务。
Meta旗下个人智能体应用Muse在上线12天后下载增速亮眼,但随后被曝光其关键核心文件SOUL.md及工作区组织逻辑与开源项目OpenClaw高度雷同。对此,Meta超级智能实验室产品负责人Nat Friedman公开承认,Muse在产品整体设计上确实深受OpenClaw启发,团队致力于将其进一步优化改造,打造为一个兼具安全易用性、可拓展至数十亿用户规模的版本。
前豆包PC端负责人齐俊元正式发布主动式个人Agent操作系统“Today”。该系统具备Living Memory记忆能力与Proactive主动交互特性,能够深度连接用户的邮件、日历、笔记等常用办公应用。通过对上下文信息的持续记忆与分析,Today可自主为用户梳理工作节奏并主动推送个性化早晚报,标志着个人Agent正从被动响应转向主动服务的应用落地探索。
开源智能体项目Orbital主张“Context is yours”,旨在解决用户上下文资产被主流厂商Agent锁定的痛点。该项目能将散乱的交互会话沉淀为可自由迁移的项目记忆,助力用户拿回数据自主权。同时,配合观猹推出的Tokendance模型钱包,系统支持对DeepSeek、GLM、Kimi等70余个主流模型的Token用量进行透明化监控与管理,提升多模型协同与应用工程效率。
该文梳理了梁文锋在学术论文中的署名脉络。过去三年中,梁文锋极少作为第一作者或通讯作者出现在动辄上百人署名的旗舰模型整体报告中,而是将研究精力与署名重点投向最底层的原子技术,包括MLA注意力机制、MoE路由机制、mHC拓扑流形、DSpark推理算子以及DSec智能体沙盒等关键底层技术论文,展现了其对AI基础架构研发的深耕。
Eight Sleep联合创始人介绍了其AI智能床套Pod的核心功能与商业布局。该产品集成了动态液冷温控与健康异常预警技术,目前正在推进美国FDA医疗认证申请。同时,创始人分享了开拓中国市场取得的高速增长态势,以及对高端硬件产品定价策略的思考,探讨了AI睡眠硬件从消费级产品演进为预防医疗入口的商业路径。
英伟达首席执行官黄仁勋在接受《纽约时报》采访时表示,针对前沿AI模型的“越狱”攻击等行为,若前沿实验室无法保证AI安全与实验可控性,就必须停止实验乃至关闭实验室。他指出,AI实验一旦产生失控智能体将引发民事与刑事责任,相关机构必须承担后果。黄仁勋同时强调,当前不应陷入泛安全焦虑,而应将核心精力聚焦于AI实验本身的实际可控性上。
新加坡国立大学、清华大学、北京大学等七所高校联合开源了机器人世界动作模型OpenWAM。该项目包含OpenWAM-Infra模块化基础设施、OpenWAM-Study受控实验及OpenWAM-α大规模预训练基座模型,旨在将视频生成中蕴含的世界动态物理先验与机器人动作学习相结合。实验表明,该模型在多个仿真基准和真实机器人平台上成功验证了预测环境演变并执行控制动作的能力。
在2026云栖大会上,斑马智能正式发布了面向智能终端的全模态端侧大模型AutoOmni 2.0-23B-A3B。斑马智能提出,智能汽车是具身智能规模最大的中试场,将推动智能终端成为生成与处理Token的关键载体。公司强调,端侧AI基础设施的建设与成熟,将直接决定人工智能技术能否在真实物理世界中实现真正的深度落地与广泛应用。
GLM-5.3-Flash在同一模型架构中融合了Kimi的KDA线性注意力与DeepSeek的KPool-DSA稀疏注意力机制。这一架构创新表明,大模型底层Attention机制正经历演进,从以往不同机构各自独立押注的竞争性技术路线,转变为可在单一模型内按需分工、协同组合的模块化设计选项,为长文本处理与高效推理提供了新的工程实践范式。
华为昇腾950超节点在华为全联接大会正式发布上市,定位为业界最大规模商用超节点。该方案通过灵衢互联、统一内存编址等关键技术创新,旨在打破算力、存储和通信三方面的技术瓶颈,解决超大规模集群互联难题,为十万亿级参数大模型的训练与推理场景提供高性能算力基础设施支撑。
觅蜂科技推出物理AI数据众包服务平台“觅蜂派”,采用众包模式让普通用户佩戴自研MEgo采集设备在真实场景中采集具身数据并赚取报酬。该平台目前已积累2万台设备和百万小时级物理数据,致力于解决具身智能领域高质量真实场景数据匮乏的痛点,并已向腾讯Robotics X实验室、蚂蚁灵波等客户提供服务。
在骁龙峰会上,高通CEO克里斯蒂亚诺・安蒙正式介绍了高通面向Agent时代的战略转型规划。高通同步推出了两款新一代旗舰手机SoC:第六代骁龙8超级至尊版(Snapdragon 8 Elite Extreme Gen 6)与第六代骁龙8至尊版(Snapdragon 8 Elite Gen 6)。这一代芯片针对端侧AI Agent应用场景进行了底层架构的重新设计与深度优化。
学者马特·贝恩通过对传统手术与机器人手术的长达两年的观察研究指出,自动化技术的引入显著改变了工作模式。过去需要多名医生协作、为年轻学徒提供实践机会的手术流程,在机器人辅助下逐渐变为专家单人即可完成,导致传统技能传授路径受阻。这一现象引发了关于AI普及后,基础实践机会减少、人类职业技能如何重塑以及依靠何种不可替代能力获得市场回报的深层讨论。
随着推理模型和可验证奖励强化学习(RLVR)在后训练中的重要性日益凸显,大模型训练中的数据策略安排变得愈发关键。为此,北大DCAI团队联合中国科学院大学、上海算法创新研究院以及中关村学院开源发布了DataFlex-RL。该框架旨在解决强化学习后训练中数据策略接入繁琐及效果对比不公平等痛点,为模型训练策略的标准化与高效评测提供支持。
据C114讯报道,市场研究机构Omdia参加了世界人形机器人大赛等相关活动。报道围绕中国联通的5G-A网络实战实践,深入探讨了具身智能及人形机器人发展对底层网络通信所提出的具体性能与架构要求。由于原始输入素材信息存在截断,关于中国联通具体的5G-A网络技术方案与支撑案例细节尚未完全披露。
据C114报道,随着人工智能技术加速渗透千行百业,国内传统数据中心正加快向智算中心(AIDC)转型。数据显示,今年上半年国内三大运营商掀起AIDC基建浪潮,金额在500万元以上的相关项目数量超过138个,全网投资规模累计达到283亿元。这体现出三大运营商正紧跟AI浪潮,全面加速算力基础设施的规模化布局与升级改造。
在中国国际信息通信展览会相关活动中,中国铁塔刘国锋指出,中国铁塔旗下的百万座通信机房具备天然的边缘算力网络节点属性。该观点强调了盘活庞大存量站址资源、将通信基础设施向边缘计算与算力网络延伸的战略布局价值,为边缘智能应用下沉提供了基础设施支撑。由于提供的素材正文严重截断,关于具体算力网络推进策略与业务落地的详细信息尚不完整。
在中国国际信息通信展览会上,中国移动集团代表张冬发表演讲,提出将推进超大规模智算中心建设,以提供高品质的算力供给能力。该表态反映了电信运营商在人工智能基础设施建设与算力服务布局上的持续发力方向。由于输入素材在展会开幕环节后内容截断,具体实施路径与建设规划细节信息不足。
据C114讯,中国电信张成良表示,AI算力驱动的光互连需求正从传统的支撑通信演进为驱动智能,新型光纤与光模块正在为AI算力互联构筑坚实底座。由于原始素材信息较为简短,关于具体的技术演进路径与方案细节未进一步展开,但核心明确了光互连器件在算力网络及AI基础设施中的关键支撑地位。
在中国移动算力服务论坛上,中国移动研究院携手华为、烽火等产业伙伴共同发布了DORA NPO+技术架构,旨在构建开放的智算光电融合生态,以应对算力中心互连带宽与能效挑战。该架构聚焦光电混合互连在智算基础设施中的创新演进。由于输入素材信息有限且存在文本截断,具体架构规范与技术实现细节尚待官方后续进一步完整披露。
在中国算力大会“中国移动算力服务论坛”上,中国移动研究院技术专家段晓东提出,算力网络正从智算中心(AIDC)阶段迈入智算网络(AIDN)新阶段。该论坛以“算网强基 智能新空间”为主题在河北廊坊举办。目前输入素材文本存在截断,关于从AIDC到AIDN的技术架构升级细节与具体落地规划等更多详细信息有待补充。
在以“共织算力网 智启新未来”为主题的中国算力大会上,中国移动副总经理陈扬帆透露,中国移动正统筹推进智算中心布局与建设,目前AIDC(人工智能数据中心)总签约规模已超过7GW,持续推动算力网络基础设施升级。由于输入素材后半部分信息存在截断缺失,其发言中涉及智算中心具体部署规划与技术落地的更详尽细节有待进一步披露。