AI 从检索文献走向提出假设,科学家负责什么?
Google 的 AI co-scientist 让多个 Agent 生成、质疑、排序并改进研究假设,科学家提供目标、种子想法与反馈。这种协作把 AI 带入研究设计环节,也让“一个值得验证的建议”与“已经确立的科学发现”之间的距离更加重要。
Google 的 AI co-scientist 让多个 Agent 生成、质疑、排序并改进研究假设,科学家提供目标、种子想法与反馈。这种协作把 AI 带入研究设计环节,也让“一个值得验证的建议”与“已经确立的科学发现”之间的距离更加重要。
一系列涉及 1,401 名参与者的实验显示,人机反馈循环能够放大知觉、情绪和社会判断中的偏差,而参与者往往低估这种影响。研究把关注点从单次错误扩展到持续互动:未来的 AI 系统也需要考虑自己正在怎样改变使用者。
这项元分析汇总百余项实验,发现人机组合平均并未超过人或 AI 中表现更好的一方;内容创作比决策任务更容易出现协作收益。它提醒我们,未来工作需要设计分工与交互方式,不能把“接入 AI”直接当作协同优势。
METR 在后续开发者研究中发现,部分人不愿参加禁用 AI 的实验,也会避开提交自己认为 AI 最能提速的任务。这让样本选择与并行工作计时影响了结论。文章说明,AI 正在改变任务选择和工作组织,旧实验设计未必仍能可靠衡量收益。
作者围绕研究目标、程序、知识共享与公共沟通提出五项原则,讨论在 AI 意识仍存在不确定性时,研究机构应如何作出承诺。文章区分了“表现得像有意识”与关于意识的科学判断,把人与智能的边界带入研究治理问题。
摩根士丹利的 Debrief 在客户同意后生成会议记录、行动项和跟进邮件草稿,并将记录存入 Salesforce。顾问编辑并决定发送内容,AI 嵌入既有服务流程。
把成功标准写成业务变化,把责任边界写进协作方式,再决定需要什么技术。
ERPBench 把定价、生产、采购与财务放进同一个模拟市场,观察环境变化如何改变企业 Agent 的表现。
补充研究 · 11
AI 的收益是否沉淀成了企业能力?研究将近期生产率收益与实践积累的、可持续使用的企业特定知识联系起来。
核心框架 · 09
金融估值不只反映生产能力,也会影响投资与资本形成。暂时的乐观,能否留下长期的实体生产能力?