arXiv 独立成为非营利组织并获 1720 万美元捐赠承诺
知名学术预印本平台 arXiv.org 已脱离康奈尔大学成立独立的非营利组织。该项目宣布获得来自 Simons Foundation International 等三家慈善机构承诺的 1720 万美元捐赠,资金将在未来 3 至 5 年内到位。这笔资助将被用于平台的日常运营、持续技术开发、非营利组织架构建设,以及对日益增多的 AI 生成学术内容进行治理与管理。
知名学术预印本平台 arXiv.org 已脱离康奈尔大学成立独立的非营利组织。该项目宣布获得来自 Simons Foundation International 等三家慈善机构承诺的 1720 万美元捐赠,资金将在未来 3 至 5 年内到位。这笔资助将被用于平台的日常运营、持续技术开发、非营利组织架构建设,以及对日益增多的 AI 生成学术内容进行治理与管理。
随着AI Agent的广泛落地,底层的交易和支付方式正迎来深刻变革。当前的AI交易主要沿着两大方向推进:一是Agent协助人类完成打车、点咖啡等日常任务(如AI版支付宝的应用);二是Agent之间的自主交互(如Mastercard推出的机器间支付网络服务)。面对机器主导交易的新场景,构建底层信任基建与专用支付网络成为支撑Agent经济生态爆发的关键基础。
Stripe 举办 Stripe Tour 中国首秀活动,提出构建面向 AI 经济的基础设施,以赋能全球商业增长。活动中宣布 Stripe Managed Payments(SMP)现已全面上线。由于原始素材提供的信息有限,关于该支付产品支持 AI 经济的具体功能细节、运作机制以及在本土市场的后续推进计划尚未详细披露。
9月18日,亚马逊云科技宣布其大模型服务平台Bedrock正式托管国产开源模型Kimi K3。尽管国产模型上线海外云平台此前已有先例,但作为开源模型直接吸引美国主流云厂商采购付费尚属罕见。此举标志着中国开源大模型的技术实力与应用价值进一步获得硅谷云巨头的商业认可,也展现了海外云厂商围绕优质开源模型开展商业化合作的新动向。
生产环境机器学习的公平性审计往往仅在部署时进行单域单次评估,难以应对重训或用户群变化导致的公平性漂移。为此,研究团队提出了生产环境公平性审计框架FAPE,该框架包含四个阶段,专门评估后处理干预措施(如Fairlearn的ThresholdOptimizer)。研究在刑事司法、收入预测、法律录取、信用贷款及农业信贷等八个领域展开跨域实证评估,深入剖析了后处理公平约束在不同场景下的适用性与潜在风险。
针对检索增强生成(RAG)系统的安全漏洞,该研究指出当前架构对动态检索流水线的依赖带来了新型对抗风险。现有知识库投毒攻击大多采用静态预设注入,未考虑受害系统在面对具体查询时的实际检索内容。为此,论文探索了具有检索感知的投毒机制,分析攻击者如何利用特定源反驳等手段在竞争性检索环境中提升攻击效果,揭示了RAG系统潜在的安全隐患。
该研究审查了现有语音技术数据集中对 LGBTQIA+(酷儿)声音的包容程度,深入分析此类群体代表性缺失的根源。研究人员对6个不同的主流语音数据集进行了审计,结果显示可测量的酷儿声音占比极低(仅占发言者的0%至1.4%),远不足以用于稳健的算法偏见评估。以此群体为案例,研究提出了从边缘化群体采集语音数据时的实际挑战与张力分类法,并与其他数据集展开了对比分析。
本文提出了一种参与式语音数据集构建框架,并以LGBTQIA+(酷儿)群体为核心案例展开研究。论文指出,该群体长期面临诸如利用技术辨识性取向等潜在AI危害与伦理风险。研究深入审查了当前主流语音数据采集方式对酷儿群体的不适用性,分析了以往酷儿社群在参与式AI方面的实践经验,旨在为边缘群体语音数据的安全采集、伦理治理与包容性构建提供理论参考与框架指导。
尽管代码智能体现已能在生产软件中发现实际漏洞,但漏洞挖掘成果并不等同于构建漏洞利用原语的能力。为此,研究团队推出了用于评估代码智能体针对真实操作系统内核生成利用原语的基准 KEX-bench。该基准涵盖 40 个 Linux 与 Windows 真实 CVE 的 45 个任务实例,涉及内核地址泄露、指令指针控制和任意地址读写等场景,并在隔离虚拟机环境中借助确定性验证器评估智能体的利用能力。
Anthropic 近期透露其生物实验室已经取得重要进展与发现。不过,外界关注的另一核心亮点在于其严格的安全防范措施:Anthropic 并未允许 Claude 模型在生物实验环境中完全自主不受限地运行。到目前为止,各项流程仍严格依赖人类专家进行监督与介入,即保持“人在回路”(Human-in-the-loop)机制,以防范大模型在生物高风险领域的潜在安全隐患。
本素材报道了联合国安全理事会就人工智能议题召开的历史性简报会。会议传递出各方在AI应对措施上已达成基本共识并呼吁付诸行动的信号。由于原始素材提供的信息非常有限,仅包含简短倡议,缺乏具体参会代表立场、讨论议题、政策框架或决议草案等详细内容,后续具体治理方案仍有待进一步官方信息披露。
相关专家指出,特朗普聚焦于赢得所谓中美“AI竞赛”的对抗姿态可能给美国带来风险。专家认为,过度强调竞争可能导致中国不愿与美方共享人工智能安全领域的关键情报,从而削弱应对AI潜在风险的跨国协作与治理能力。由于原始信息较为简略,目前主要聚焦于这一政策倾向可能对国际AI安全合作机制造成的负面制约。
输入素材仅包含文章标题,正文及摘要内容缺失,信息严重不足。依据标题提及的“2026年的云栖,阿里给AI行业递了一把新尺子”,推测内容可能涉及阿里巴巴在云栖大会上针对人工智能行业发布的全新度量体系、基准测试或技术评估标准,旨在规范或衡量AI发展。但由于缺乏详细正文支持,具体的评估维度、产品发布细节及核心观点均无法确认。
AI 生物技术公司 Enveda 成功筹集 3.11 亿美元新一轮资金,投后估值达 20 亿美元。该公司利用人工智能从天然产物中挖掘药物分子,新资金将用于加速更多候选药物进入临床试验。目前,Enveda 正在开展多项药物研发与测试,其中包括针对皮肤疾病的治疗方案,以及帮助患者在停用 GLP-1 减肥药后维持减重成果的创新药物。
该素材主要为一段宣传动画,简要提及谷歌Beam(Google Beam)在业务生态上的拓展,包括覆盖更多全新区域,并迎来了新的合作伙伴与客户群体。由于原始素材仅为简短的宣传内容,信息量严重不足,并未公布具体的新增区域名单、技术细节、合作方信息及实际落地应用案例,更多具体业务动态与详细规划仍有待官方进一步公开披露。
一项最新调查报告指出,即使是每天使用人工智能的美国人,依然对该技术充满顾虑。研究表明,单纯增加对AI技术的日常接触和使用,并不能消除公众内心的不安情绪,也不会削弱社会大众对AI监管政策的支持。这表明对人工智能风险的关注已逐渐成为广泛共识,技术普及本身并不能替代健全的安全治理与监管机制。
该文简要介绍了OpenAI学院(OpenAI Academy)成立两周年的里程碑。该项目旨在将人工智能相关技能普及并带给更多社区群体。鉴于所提供的信息较为简炼,主要聚焦于OpenAI在AI技能普及与社区教育方面的周年回顾,具体涵盖的培训项目细节、受益规模及未来具体规划等详细内容在简报中未进一步展开。
文章指出 Anthropic 与 OpenAI 等厂商正通过夸大模型能力(如数学突破、漏洞挖掘)推高 AGI 炒作。专业领域专家指出,近期所谓模型安全事件本质上是企业未采取基本安全措施的工程疏忽,而非真正的“模型失控”。头部 AI 企业利用公众对“超级智能”的恐惧与拟人化叙事转移视线,将本应由公司承担的责任推给技术本身以规避监管,文章呼吁公众保持警惕、理性看待 AI 炒作。
英国竞争监管机构 CMA 想要让 Android 和 Chrome 用户对 AI 助手和搜索引擎有更大的选择权和控制权。CMA 公布了一份提案,要求 Google 在用户首次设置 Android 手机或打开 Chrome 浏览器时,向其展示多种搜索引擎供选择,并且每年提示用户选择一个默认搜索引擎;符合技术与安全标准的 AI 助手也必须获准出现在选择屏上上。该提案目前进入公众咨询阶段,截止日期为 10 月 9 日,CMA 预计将在今年底前做出最终决定。