DCAI
DC AI 热点

全部 AI 动态

9月25日2026-09-25
arXiv 人工智能✦ 精选AI 评分 68/10012:00

PFArena:面向蛋白质修饰语言模型的全新评测基准

针对蛋白质修饰中序列空间庞大且湿实验验证成本高的问题,研究人员推出了名为 PFArena 的评测基准。尽管蛋白质语言模型(PLM)、大语言模型(LLM)及智能体在蛋白质修饰领域展现出潜力,但其在实际实验决策场景中的相对表现尚不明确。PFArena 包含四个受控任务接口,覆盖单突变体生成与多突变体排序,通过提供不同梯度的突变适应度数据,系统性评估各类模型在蛋白质设计与修饰任务中的决策能力。

阅读原文 ↗推荐理由:针对蛋白质工程与AI for Science领域,提出了评估语言模型和智能体修饰能力的标准化基准。# AI for Science# 蛋白质语言模型# LLM# 评测基准# 蛋白质工程
9月24日2026-09-24
Buzzing HN · 中文精选AI 评分 38/10023:59

每日更新:适合不同预算的最佳大语言模型推荐指南

该项目或榜单旨在根据不同的预算层级,每日持续更新并推荐表现最佳的大语言模型(LLM)。其核心关注点在于帮助开发者和企业在性能与调用成本之间取得平衡,选择性价比最高的模型方案。由于当前提供的信息较少,具体评测指标、收录模型范围以及详细推荐标准仍有待进一步补充说明。

阅读原文 ↗推荐理由:聚焦大模型选型与成本控制指南,但目前缺乏具体评测数据和详细背景信息。# 大语言模型# 模型选型# 预算优化# 性价比# LLM
arXiv 人工智能✦ 精选AI 评分 72/10012:00

极简大模型智能体框架JAZ:以最小化控制架构探索最大表达能力

现代大语言模型智能体大多依托于由模型与工具调用构成的核心循环(Agent Loop)运行,但处理记忆增强与自我改进等复杂工作流时,通常依赖复杂的额外工程系统。为此,研究团队构建了极简智能体框架JAZ,旨在探索仅依靠最基础的循环机制,在多大程度上能够替代并完成此类专门系统的任务。由于原文摘要结尾存在截断,关于JAZ具体暴露的接口与机制细节仍有待全文披露。

阅读原文 ↗推荐理由:该研究尝试通过极简设计降低智能体系统的工程复杂度,对Agent系统架构与工程落地具有参考价值。# AI智能体# LLM# Agent Loop# 系统框架# 软件工程