如何判断一个 Agent,真的把事情做对了?
从任务、轨迹和评分器出发,梳理 Agent 评测的基本结构,以及为什么单一评测方式不够。
从任务、轨迹和评分器出发,梳理 Agent 评测的基本结构,以及为什么单一评测方式不够。
核心框架 · 04
组织层级为何存在?从知识、求助成本与专家时间出发,研究自主 AI 与辅助型 AI 如何改变组织及收益分配。
核心框架 · 03
智能体降低搜索、沟通与签约成本之后,公司、市场与平台的边界会怎样变化?问号背后,是新的交易机会与新的中介权力。
核心框架 · 07
技术效率与社会收益需要分开衡量。上游 AI 的使用费、接入费与市场势力,如何改变工资、企业进入和福利?
核心框架 · 02
公众与共同体并非个人偏好的简单集合。AI 如何改变共同实践、持续反馈,以及集体行动能力的形成?