AIDC
DC AI 热点

全部 AI 动态

9月25日2026-09-25
arXiv 人工智能✦ 精选AI 评分 68/10012:00

PFArena:面向蛋白质修饰语言模型的全新评测基准

针对蛋白质修饰中序列空间庞大且湿实验验证成本高的问题,研究人员推出了名为 PFArena 的评测基准。尽管蛋白质语言模型(PLM)、大语言模型(LLM)及智能体在蛋白质修饰领域展现出潜力,但其在实际实验决策场景中的相对表现尚不明确。PFArena 包含四个受控任务接口,覆盖单突变体生成与多突变体排序,通过提供不同梯度的突变适应度数据,系统性评估各类模型在蛋白质设计与修饰任务中的决策能力。

阅读原文 ↗推荐理由:针对蛋白质工程与AI for Science领域,提出了评估语言模型和智能体修饰能力的标准化基准。# AI for Science# 蛋白质语言模型# 大模型# 评测基准# 蛋白质工程
9月24日2026-09-24
arXiv 人工智能✦ 精选AI 评分 70/10012:00

AI神经科学家:面向神经影像分析的交互式智能体界面

神经影像数据分析通常需要专业的编程与统计技能,这给非计算背景的研究人员带来了门槛。为此,研究团队推出了“AI神经科学家”,这是一种用于交互式数据探索的语言智能体。该系统将大语言模型与神经影像专业工具集相结合,支持研究人员直接通过自然语言查询数据质量、执行建模与可视化并设定分析参数,为小规模数据探索提供了一种替代传统脚本处理流程的透明且交互式的解决方案。

阅读原文 ↗推荐理由:将大语言模型智能体引入神经影像学领域,有效降低了专业科研数据分析的编程门槛。# 智能体# 神经影像# AI for Science# 大模型# 交互分析
arXiv 人工智能✦ 精选AI 评分 65/10012:00

面向气候感知数字孪生的物理信息神经网络稀疏观测大气温度预测

为支持气候感知数字孪生系统,该研究针对热观测数据不完整条件下的短期大气温度预测展开探索。论文评估了一种用于位温预测的物理信息神经网络(PINN),该模型受到气压坐标热力学平流-源方程以及从前12小时拟合且在预测训练前冻结的非绝热源闭合项的物理约束。研究采用三个气压层的逐小时ERA5再分析数据,对模型在1至3个时效步长下的条件后验预测性能进行了验证。

阅读原文 ↗推荐理由:探索将物理信息神经网络(PINN)应用于稀疏观测环境下的气象短期预测,为数字孪生与科学智能计算提供了参考思路。# PINN# 物理信息神经网络# 数字孪生# 气象预测# AI for Science
arXiv 人工智能✦ 精选AI 评分 75/10012:00

大知识模型(LKM):将学术文献转化为科学推理全景图谱

研究人员提出了大知识模型(LKM),这是一种旨在将学术文献转化为可计算科学推理资源的新型知识基础设施。为打通科研问题、实验流程、结论与证据间的逻辑连接,LKM 将学术论文表示为具备源依据的推理图谱,并结合结构化图遍历与语义检索技术。该架构使海量文献沉淀为可共享的计算资产,能够辅助科研人员探索新课题、设计实验方案并深入解读研究结果。

阅读原文 ↗推荐理由:提出了结合推理图谱与语义检索的大知识模型概念,为 AI for Science 及学术文献的自动化深度推理提供了新范式。# 大知识模型# AI for Science# 知识图谱# 科学推理# 语义检索
arXiv 人工智能✦ 精选AI 评分 72/10012:00

MolDesignBench:面向真实场景分子设计任务的LLM智能体评估基准

真实环境下的分子设计对大语言模型智能体提出了极高要求,需要其理解复杂上下文、满足多重约束并进行多步工具推理。针对现有基准偏向狭窄约束和单一路径的问题,研究人员提出了MolDesignBench。该基准紧密贴合实际分子设计场景,可系统评估工具增强型LLM智能体在处理多约束、不可行规范识别及多步工具调用下的综合推理与设计能力。

阅读原文 ↗推荐理由:针对AI4Science与LLM智能体落地场景,构建了更贴近真实复杂分子设计需求的评测基准。# 智能体# 大模型# 分子设计# AI for Science# 评测