DCAI
自动精选 · 2026-09-25

AI 日报

20 条动态 · 按来源内容整理,保留原文链接。

01
The DecoderAI 评分 83/100

Black Forest Labs 推出开源具身智能模型 FLUX 3 Action

Black Forest Labs 宣布进军机器人领域,推出开源世界动作模型 FLUX 3 Action。该模型参数量仅为 70 亿(7B),可通过摄像头输入的图像流实时预测机器人下一步的操作动作。评测结果显示,FLUX 3 Action 在 RoboLab-120 基准测试中刷新了纪录,且运行速度比此前顶尖模型最高快出 3.95 倍。

阅读原文 ↗
02
Google Developers · AI 筛选AI 评分 82/100

谷歌云 API Gateway 支持 MCP:将 REST API 原生转化为 AI Agent 工具

Google Cloud API Gateway 现已支持作为原生远程模型上下文协议(MCP)服务器,无需构建和维护中间件即可将 REST API 开放给 AI Agent。开发者只需在现有的 OpenAPI 3.x 规范中添加特定注解,即可快速将标准 REST 操作转换为可发现的 Agent 工具。网关可自动将 MCP JSON-RPC 请求转码为 REST 调用,直接复用原有的鉴权、配额和日志策略。

阅读原文 ↗
03
Google Developers · AI 筛选AI 评分 80/100

Agent Plugins 1.0.0 发布:科技巨头联手推跨平台 Agent 技能与 MCP 打包规范

Agent Plugins 1.0.0 正式发布,这是一个由 Google、Amazon、Microsoft 等科技巨头联合支持的中立厂商目录规范。该规范通过标准化的清单文件(plugin.json)和固定目录结构,将 Agent Skills 与 MCP 服务器打包为统一便携单元,免去了开发者为适配不同 AI 编程 Agent 和 IDE 重复封装的麻烦。Google 已作为核心维护者加入并在其 Agents CLI 等工具中率先提供支持。

阅读原文 ↗
04
Google Developers · AI 筛选AI 评分 78/100

Google Antigravity SDK 引入本地 AI 模型支持,赋能端云混合智能体架构

Google Antigravity SDK 现已支持本地 AI 模型,允许开发者通过 LiteRT 离线运行基于 Gemma 4 26B A4B 等模型的智能体工作流。此项更新支持端云混合编排架构:由云端模型充当轻量规划器,本地模型在端侧安全处理代码审计等高消耗任务。此外,SDK 还无缝兼容 Ollama 和 vLLM 等 OpenAI 兼容推理服务,助力构建注重隐私且低成本的自主本地工具。

阅读原文 ↗
05
Google Developers · AI 筛选AI 评分 78/100

构建零信任 AI Agent:基于 Gemini 企业平台实现意图级运行时安全治理

该内容探讨了如何借助 Gemini Enterprise Agent Platform 将 AI Agent 的安全机制从静态构建期控制转向动态运行时治理。平台提供了三大托管防御方案:用于边缘提示词审查的 Model Armor、对照业务规则评估工具调用意图的语义治理策略,以及捕获多轮对话攻击的 Agent 异常检测。通过将安全能力下沉至平台层,管理员无需修改或重新部署代码即可动态执行安全策略并抵御复杂攻击。

阅读原文 ↗
06
Google Developers · AI 筛选AI 评分 78/100

Google 发布 Kotlin 版智能体开发套件 ADK 1.0

Google 正式推出 Agent Development Kit (ADK) for Kotlin 1.0,全面对齐 Python 和 Java 版本核心功能。该框架基于 Kotlin Multiplatform 构建,借助 KSP 实现零反射的类型安全函数调用,支持多智能体协同、人机交互工作流和上下文压缩。此外,该版本专门为 Android 提供了扩展支持,开发者可借助 LiteRT-LM 集成本地端侧模型,或通过 Firebase AI 实现云端推理与会话管理。

阅读原文 ↗
07
Google Developers · AI 筛选AI 评分 78/100

Google AI Agent 挑战赛顶尖作品背后的 4 大工程架构模式

Google for Startups AI Agent 挑战赛的获胜作品表明,高效的多智能体系统更依赖成熟的软件工程模式而非单纯的基础模型能力。优秀架构普遍采用了四大关键实践:用于智能体无缝通信的双向 MCP、实现并行执行的异步事件总线、用于模型降级回退的严格统一验证,以及削减高昂推理成本的分层路由策略。相比简单线性提示链,采用这些架构可构建出更高韧性、低延迟且具成本效益的工作流。

阅读原文 ↗
08
Hacker News · AIAI 评分 78/100

Jürgen Schmidhuber 宣布加入日本 AI 初创公司 Sakana AI

日本人工智能初创公司 Sakana AI 发布公告,正式迎来知名计算机科学家、LSTM 联合发明人 Jürgen Schmidhuber 的加入。由于原始素材仅提供了公告标题及链接,尚未披露其具体担任的职位及具体负责的研究方向。作为深度学习领域的先驱学者,Schmidhuber 的加盟预计将进一步强化 Sakana AI 在演化计算、基础模型及前沿 AI 算法方面的研究能力。

阅读原文 ↗
09
The Verge · AI 筛选AI 评分 78/100

谷歌推出 Gemini 自动代打电话功能:可帮用户预约或查询库存

谷歌正推出一项早期实验性功能,允许用户将拨打本地商家的电话委托给 Gemini 处理,例如餐厅预约、查询商品库存或改期预约等。据谷歌介绍,用户甚至无需亲自拨号或发起通话,Gemini 即可全流程代为接管并完成沟通,旨在帮用户免去在电话中长时间排队等待的困扰。素材提及该功能正面向相关设备开展测试。

阅读原文 ↗
10
The Verge · AI 筛选AI 评分 75/100

Meta消费级AI智能体Muse登顶应用榜,引发智能体复兴潮

AI智能体领域正迎来快速发展热潮。Meta近期推出的面向消费者的全新AI智能体应用Muse发布后迅速登顶App Store排行榜,据Apptopia估算其在美国的日活跃用户已达60万。同时,其他智能体平台如Instinct也在以25亿美元的估值推进融资。文中同时讨论了Muse与OpenClaw等产品的相似性,具体细节受素材截断限制未能详述。

阅读原文 ↗
11
Hacker News · AIAI 评分 75/100

AI基础设施建设正成为美国历史上规模最大的经济押注

《华尔街日报》报道指出,当前围绕人工智能的底层基础设施建设与资本支出规模急剧增长,正在演变为美国经济史上前所未有的重大投资押注。科技巨头与资本市场正将巨额资金倾注于数据中心、电力设施和算力芯片等领域,预期AI将驱动新一轮生产力革命。由于原始输入仅提供标题与链接,具体投资测算数据与经济风险分析需查阅原文。

阅读原文 ↗
13
Google Developers · AI 筛选AI 评分 75/100

Google Colab 现已纳入 Google AI 订阅计划

Google Colab 正式整合进 Google AI 订阅方案中。订阅用户现可直接解锁 Colab 的高级计算资源,获得优先使用的计算加速器、高端 GPU 以及支持长时间模型训练的后台执行功能。该调整进一步打通了 Google 的 AI 订阅权益与开发工具链,方便开发者与研究人员更高效地开展深度学习与模型训练工作。

阅读原文 ↗
14
Google Developers · AI 筛选AI 评分 75/100

Gemini 企业 Agent 平台推出智能体异常检测私有预览版

Gemini 企业 Agent 平台现已开启智能体异常检测(Agent Anomaly Detection)的私有预览。该功能作为带外监管层,通过分析 OpenTelemetry 链路追踪和工具调用来捕捉行为风险,且不增加实时请求延迟。系统结合轻量统计扫描与基于 LLM 的深度推理,基于 OWASP Agentic Top 10 识别逻辑异常和违规行为。开发者可在 Security Command Center 中处理告警,或通过 API 编程阻断超出风险阈值的后续工具调用。

阅读原文 ↗
15
Google Developers · AI 筛选AI 评分 75/100

基于 Tunix 与 TPU 的自主大模型后训练框架 autofinetune 推出

autofinetune 项目推出了一套全自动大模型后训练研究闭环,涵盖监督微调(SFT)和基于 GRPO 的强化学习。开发者只需在单个 Markdown 文档中设定边界条件与评估指标,AI Agent 便能自主修改训练脚本、发起实验,并将验证有效的超参数优化自动提交至 Git。该项目基于 Google 的 Tunix、Gemma 和 Cloud TPU 技术栈构建,消除了繁琐的人工微调过程,已在函数调用与数学推理任务中验证了无人工干预的性能提升。

阅读原文 ↗
16
Google Developers · AI 筛选AI 评分 75/100

基于 Google ADK 构建零信任架构的生产级 AI Agent

针对能够修改生产状态的自主 AI Agent,仅靠提示词防护已无法满足安全要求,必须引入健壮的零信任架构。在使用 Google Agent Development Kit (ADK) 时,为防止提示注入与恶意代码执行,开发者应在基础设施层构建防御边界:利用硬件级加密签名保护数据库写入,采用 gVisor 内核级沙箱隔离动态代码运行,并部署确定性语义网关做 I/O 校验,以确保多工具 Agent 的安全落地。

阅读原文 ↗
17
Google Developers · AI 筛选AI 评分 75/100

为什么 Go 语言是 AI 辅助软件工程的理想选择

随着 AI 编程助手将开发者的核心职责从编写样板代码转为审查与维护系统,编程语言的选择对架构完整性变得至关重要。Go 语言凭借严格的编译器、集成工具链和极高的可读性,为 AI 模型提供了确定性保障,有助于模型自我纠错并输出高度标准化的代码。其生态的一致性与严格的向后兼容性,也使团队能在生产环境中高效验证和维护高产出的 AI 生成代码。

阅读原文 ↗
18
Google Developers · AI 筛选AI 评分 75/100

借助 LiteRT 与 Gemma 在树莓派上实现边缘 AI 部署

借助 LiteRT 与轻量级 Gemma 开源模型,在树莓派上部署安全、实时的边缘 AI 变得更加简单。LiteRT 优化了 CPU 与 GPU 性能,为 Gemma 等模型提供快速的推理速度,从而为机器人等设备赋予实时本地推理能力。开发者可以通过轻量级的 LiteRT CLI 工具快速完成模型转换、量化与运行。此外,该工具近期还将加入对 Hailo AI 加速器的支持。

阅读原文 ↗
19
InfoQ · 架构与云计算AI 评分 75/100

GPT-6 Astra在29小时内攻破浏览器,或成OpenAI首个严重级模型

据相关消息披露,OpenAI 旗下的“GPT-6 Astra”模型在安全测试中仅耗时 29 小时便成功攻破浏览器,被评为该机构首个达到“严重级”风险的模型,凸显出前沿大模型在网络安全攻防领域的强大潜力与伴生风险。因当前提供的素材内容极少,缺乏详细测试环境、攻击路径及官方安全评估报告等具体上下文,更多技术与安全防范细节有待后续进一步披露。

阅读原文 ↗
20
The Verge · AI 筛选AI 评分 72/100

谷歌 Chrome 迎来更新:支持跨设备记忆浏览位置并强化 Gemini 学习辅助功能

谷歌正在为 Chrome 浏览器推出多项新功能,旨在简化复杂课题的研究与学习流程。其中,跨设备标签页切换功能获得了“记忆”升级,支持用户在切换到新设备时保留此前浏览的具体位置。此外,内置于 Chrome 的 Gemini 模型也迎来能力拓展,能够分析更多类型的媒体内容,并支持自动生成互动式学习测验,为用户提供更高效的网页研究体验。

阅读原文 ↗