标签:AI 科研智能体 AI 科学家

该标签下的全部条目(栏目名、期号「YYYY-MM-DD」与「每日前沿」都会作为标签)。

审计"审计者":无标签、可校准地测量 LLM 诊断中的无依据断言(ATRACC 2026)

场景:微服务事故诊断。核心工具 TCA(Telemetry Claim Adjudicator) 是一个不依赖结果标签的机械裁决器,逐条裁定 LLM 智能体在诊断中引用的遥测断言是否有依据。 配套制品:6 种架构臂 × 2 个基准的诊断 harness;以 SHA-256 请求号

人–AI 团队 vs 人–人团队:信息探询如何影响协作决策

背景:传统人–AI 决策研究把过程当作"AI 给建议、人做决定"的线性分段流程;但 LLM 让交互更接近人–人团队的协作——成员必须共享并整合各自独有的信息才能做出好决策。 采用团队研究经典范式 隐藏剖面任务(hidden profile);操纵团队类型(人–AI 98 组 vs

AI 与智能体在药物发现中的应用:批判性文献综述

演进脉络:从 DENDRAL 专家系统、计算机辅助药物设计(CADD)、QSAR 建模,到 AlphaFold 3 生物分子复合物预测、计算机辅助合成规划(CASP)、天然产物生物勘探与自主多智能体系统。 重点进展:抗菌筛选、精准肿瘤学、植物化学表征,以及临床阶段的 AI 生成分

主动推断与"人工推理":用期望自由能驱动结构学习与规则发现

核心问题:如何采样最能揭示世界模型结构的结果——即在若干生成模型/假设之间做最优实验设计(rule discovery)。 数学工具:主动推断中,策略(动作组合)按期望自由能选择 = 期望信息增益 + 价值;信息增益即"含与不含行动后果"两种预测后验之间的 KL 散度。 计算效率