斑马智能发布面向智能终端的全模态端侧大模型AutoOmni 2.0
在2026云栖大会上,斑马智能正式发布了面向智能终端的全模态端侧大模型AutoOmni 2.0-23B-A3B。斑马智能提出,智能汽车是具身智能规模最大的中试场,将推动智能终端成为生成与处理Token的关键载体。公司强调,端侧AI基础设施的建设与成熟,将直接决定人工智能技术能否在真实物理世界中实现真正的深度落地与广泛应用。
在2026云栖大会上,斑马智能正式发布了面向智能终端的全模态端侧大模型AutoOmni 2.0-23B-A3B。斑马智能提出,智能汽车是具身智能规模最大的中试场,将推动智能终端成为生成与处理Token的关键载体。公司强调,端侧AI基础设施的建设与成熟,将直接决定人工智能技术能否在真实物理世界中实现真正的深度落地与广泛应用。
GLM-5.3-Flash在同一模型架构中融合了Kimi的KDA线性注意力与DeepSeek的KPool-DSA稀疏注意力机制。这一架构创新表明,大模型底层Attention机制正经历演进,从以往不同机构各自独立押注的竞争性技术路线,转变为可在单一模型内按需分工、协同组合的模块化设计选项,为长文本处理与高效推理提供了新的工程实践范式。
华为昇腾950超节点在华为全联接大会正式发布上市,定位为业界最大规模商用超节点。该方案通过灵衢互联、统一内存编址等关键技术创新,旨在打破算力、存储和通信三方面的技术瓶颈,解决超大规模集群互联难题,为十万亿级参数大模型的训练与推理场景提供高性能算力基础设施支撑。
诺因(Knowin)正式发布生成式学习框架GLOW。该框架凭借原生自回归架构、Harness闭环反馈系统以及RSI递归自我改进机制,在RoboDojo、LIBERO-Pro和Embodied Arena三大具身智能评测榜单中均斩获第一,性能表现超越GPT-6,推动机器人迈向“一教就会”的个性化家庭服务应用场景。
觅蜂科技推出物理AI数据众包服务平台“觅蜂派”,采用众包模式让普通用户佩戴自研MEgo采集设备在真实场景中采集具身数据并赚取报酬。该平台目前已积累2万台设备和百万小时级物理数据,致力于解决具身智能领域高质量真实场景数据匮乏的痛点,并已向腾讯Robotics X实验室、蚂蚁灵波等客户提供服务。
在骁龙峰会上,高通CEO克里斯蒂亚诺・安蒙正式介绍了高通面向Agent时代的战略转型规划。高通同步推出了两款新一代旗舰手机SoC:第六代骁龙8超级至尊版(Snapdragon 8 Elite Extreme Gen 6)与第六代骁龙8至尊版(Snapdragon 8 Elite Gen 6)。这一代芯片针对端侧AI Agent应用场景进行了底层架构的重新设计与深度优化。
学者马特·贝恩通过对传统手术与机器人手术的长达两年的观察研究指出,自动化技术的引入显著改变了工作模式。过去需要多名医生协作、为年轻学徒提供实践机会的手术流程,在机器人辅助下逐渐变为专家单人即可完成,导致传统技能传授路径受阻。这一现象引发了关于AI普及后,基础实践机会减少、人类职业技能如何重塑以及依靠何种不可替代能力获得市场回报的深层讨论。
随着推理模型和可验证奖励强化学习(RLVR)在后训练中的重要性日益凸显,大模型训练中的数据策略安排变得愈发关键。为此,北大DCAI团队联合中国科学院大学、上海算法创新研究院以及中关村学院开源发布了DataFlex-RL。该框架旨在解决强化学习后训练中数据策略接入繁琐及效果对比不公平等痛点,为模型训练策略的标准化与高效评测提供支持。
据C114讯报道,市场研究机构Omdia参加了世界人形机器人大赛等相关活动。报道围绕中国联通的5G-A网络实战实践,深入探讨了具身智能及人形机器人发展对底层网络通信所提出的具体性能与架构要求。由于原始输入素材信息存在截断,关于中国联通具体的5G-A网络技术方案与支撑案例细节尚未完全披露。
据C114报道,随着人工智能技术加速渗透千行百业,国内传统数据中心正加快向智算中心(AIDC)转型。数据显示,今年上半年国内三大运营商掀起AIDC基建浪潮,金额在500万元以上的相关项目数量超过138个,全网投资规模累计达到283亿元。这体现出三大运营商正紧跟AI浪潮,全面加速算力基础设施的规模化布局与升级改造。
在中国国际信息通信展览会相关活动中,中国铁塔刘国锋指出,中国铁塔旗下的百万座通信机房具备天然的边缘算力网络节点属性。该观点强调了盘活庞大存量站址资源、将通信基础设施向边缘计算与算力网络延伸的战略布局价值,为边缘智能应用下沉提供了基础设施支撑。由于提供的素材正文严重截断,关于具体算力网络推进策略与业务落地的详细信息尚不完整。
在中国国际信息通信展览会上,中国移动集团代表张冬发表演讲,提出将推进超大规模智算中心建设,以提供高品质的算力供给能力。该表态反映了电信运营商在人工智能基础设施建设与算力服务布局上的持续发力方向。由于输入素材在展会开幕环节后内容截断,具体实施路径与建设规划细节信息不足。
据C114讯,中国电信张成良表示,AI算力驱动的光互连需求正从传统的支撑通信演进为驱动智能,新型光纤与光模块正在为AI算力互联构筑坚实底座。由于原始素材信息较为简短,关于具体的技术演进路径与方案细节未进一步展开,但核心明确了光互连器件在算力网络及AI基础设施中的关键支撑地位。
在中国移动算力服务论坛上,中国移动研究院携手华为、烽火等产业伙伴共同发布了DORA NPO+技术架构,旨在构建开放的智算光电融合生态,以应对算力中心互连带宽与能效挑战。该架构聚焦光电混合互连在智算基础设施中的创新演进。由于输入素材信息有限且存在文本截断,具体架构规范与技术实现细节尚待官方后续进一步完整披露。
在中国算力大会“中国移动算力服务论坛”上,中国移动研究院技术专家段晓东提出,算力网络正从智算中心(AIDC)阶段迈入智算网络(AIDN)新阶段。该论坛以“算网强基 智能新空间”为主题在河北廊坊举办。目前输入素材文本存在截断,关于从AIDC到AIDN的技术架构升级细节与具体落地规划等更多详细信息有待补充。
在以“共织算力网 智启新未来”为主题的中国算力大会上,中国移动副总经理陈扬帆透露,中国移动正统筹推进智算中心布局与建设,目前AIDC(人工智能数据中心)总签约规模已超过7GW,持续推动算力网络基础设施升级。由于输入素材后半部分信息存在截断缺失,其发言中涉及智算中心具体部署规划与技术落地的更详尽细节有待进一步披露。
谷歌正推进名为“Suncatcher”的创新项目,计划将机器学习基础设施直接部署到太空环境中。该项目旨在探索利用太空独特环境(如太阳能资源和散热条件)承载AI算力与数据处理任务的可行性。目前公开信息有限,具体的发射规划、硬件配置、抗辐射技术细节以及实际部署时间表尚未完全披露,仍处于早期概念与试验阶段。
业内数据显示,国内大模型日均Token调用量较2024年初增长数十倍,推动AI基础设施需求持续激增。在此背景下,AI Infra正从单纯依赖GPU加速转向系统性竞争,CPU作为调度与计算中枢的价值被重新审视,逐步重回计算中心地位。由于原素材内容被截断,关于CPU具体架构演进与产业竞争格局的详细细节仍有待进一步补充说明。
随着AI算力集群规模向万卡、十万卡及超节点集群演进,底层光互联技术成为算力扩展的关键。Photon Bridge CCO指出,当前AI光互连中的外置激光源(ELS)面临量产瓶颈,并提出了打破行业“不可能三角”的解决思路,旨在推动大规模算力基础设施的高效光互连落地。由于输入素材部分截断,具体的技术路径细节与工艺突破方案有待进一步披露。
文章指出通信网络正从“联人联物”向“联智能体”演进,下一代核心网正加速走向AI原生架构。在3GPP第112届全体会议推动6G标准化的背景下,意图驱动接口与数据分析平台(DAP)等被确立为下一代网络的核心关键特征,以支撑未来AI智能体的高效协同与网络自主自治。由于输入素材信息较为有限,更多具体技术路线与产业落地细节尚待进一步补充。
当地时间9月23日,OpenAI首席执行官萨姆·奥尔特曼(Sam Altman)在联合国发表主题演讲。奥尔特曼在演讲中探讨了人工智能的未来走向,指出AI的发展既可能催生如同“文艺复兴”般的繁荣与创新,也可能带来类似于“工业革命”时期的巨大社会冲击与动荡。当前公开素材内容有限,未披露演讲的具体政策倡议或技术治理细节。
据《金融时报》报道,最新披露的法庭文件显示,OpenAI与苹果公司关于ChatGPT的合作关系正逐渐出现破裂。OpenAI于周三表示,双方此前的合作落地情况远不及预期。由于当前输入素材信息有限,关于该法庭文件涉及的具体诉讼背景、合作受阻的深层原因及后续影响等详细内容尚不充分,有待进一步官方信息披露。
据外媒报道,微软正逐步淡化“Copilot+ PC”品牌,2026 年推出的新款 Surface 电脑已不再使用该标签。该类别于 2024 年由微软联合高通推出以设立 AI 硬件基准,但因核心功能 Recall 被曝严重安全隐患并被迫推迟上线,品牌声誉受到影响。目前多家 OEM 厂商及微软自身正减少使用该标识,微软高管确认后续产品虽弃用该名称,但仍将符合既定的硬件标准。
据外媒报道,微软可能正在逐步放弃此前重点推广的“Copilot Plus PC”品牌标签。微软曾联合高通大力宣传该品牌,用以界定具备充足端侧 AI 算力的新一代个人电脑设备。然而在推出后,这一品牌策略并未达到预期成效,双方似乎已默认该品牌名存实亡。目前关于微软未来在端侧 AI 硬件认证上的后续调整或替代方案,报道中尚未披露更多具体细节。
在重庆辖区上市公司投资者集体接待日上,长安汽车高管表示正推进20Ah氧聚复合固态电池验证,并加速具身智能与低空经济布局。公司力争在2028年实现人形机器人量产,并在2030年推出商用航线飞行汽车。此前长安天枢智能机器人公司负责人表示,其路径是逐步覆盖物流搬运、安防等场景,最终实现用机器人造车、卖车、上车以及造机器人的完整闭环生态。
Meta 为其智能眼镜产品线新增了一款仅支持音频的新款雷朋眼镜,起售价为 349 美元。该设备移除了摄像头,整体重量更轻,支持播放音乐、接打电话以及与 AI 智能体交互。针对外界关于该产品是应对带摄像头版本隐私争议的猜测,Meta CEO 扎克伯格明确否认,指出硬件产品需提前数年研发,无摄像头版本早在多年前便已立项筹备,绝非近期受舆论压力影响的仓促调整。
马斯克在社交平台发文表示,其团队有望在两到三个月内开发出具备高水准能力的大模型。面对与 Anthropic 和 OpenAI 的竞争质疑,马斯克回应称自身 AI 研发起步较晚但具备强劲加速度,预计约 6 个月内确立行业领跑地位。此外,他指出过剩智能对于特定任务意义有限,并强调硬件与短时间内快速上线部署海量算力的工程交付能力是核心挑战与优势。
MaxText团队利用JAX/XLA在谷歌云TPU上从零成功复现了AI2的OLMo 3 7B大模型,在预训练及中期训练阶段的保留评估指标均精准对齐原PyTorch-GPU基准。该方案实现了高达57.4%的模型算力利用率(MFU),并在中途集群扩缩容及跨代TPU迁移中展现出极高鲁棒性。此外,团队通过保留验证发现并修复了导致训练损失虚低的数据加载器隐性记忆漏洞,验证了完备评估机制的重要性。
Google Cloud 已将 TPU 原生支持集成至开源推理框架 vLLM,开发者可通过 GKE 弹性扩展嵌入模型流水线。针对 Qwen3-Embedding-8B 等模型的 15K+ 超长上下文推理,工程团队引入了硬件安全张量对齐、JAX/XLA 编译预热及分块预填充的混合 StepPool 架构等专项优化,在实现与 GPU 基线近乎一致的数值精度的同时提升吞吐,相关配置方案已在 GitHub 开源。
谷歌宣布为 Gemini 3.8 Live 推出 Live Avatar 功能,为原生实时对话模型提供接近实时的视觉呈现。该功能融合视频生成与语音技术,具备精准唇形同步、自然面部表情,并支持在97种语言间无缝切换。依托高级推理与异步工具调用能力,该虚拟人可在后台执行复杂任务的同时保持对话不中断。目前企业支持自定义形象,且所有生成音视频均嵌入 SynthID 隐形水印以保障安全。