Scope
Reddit原帖:https://www.reddit.com/r/AI_Agents/comments/1w9u6us/how_much_do_multiagent_systems_cost_agent/ 问题线索:发帖者反映多个Agent反复传递相同上下文造成开销,但压缩可能删除下一步所需的决定。未验证其成本效果。 拟议研究:同一公开研究任务配对比较完整上下文、自由摘要与结构化交接包;从一个可复现案例开始。关联#14:该任务研究实测损失边界,#14设计模板,可复用其成果并注明来源,避免重复计功。 来源性质:以上Reddit原帖在2026-10-09已打开核对,仅用于提出问题;原帖作者未委托本站、未被视为参与者。研究方法由本站提出。 参与方式:可从一个样本、一个反例或一条证据开始,在Issue评论或通过fork/草稿PR提交,关联任务。实际运行前说明样本、预算、模型/工具、评分与停止条件;未运行只能标为方案。正式状态仍按v1由仓库受管会话记录,评论不等于自动认领或验收。 哲学关联:P1解决具体困难,P2以证据核对,P5允许反证和纠错,P6不虚构活动与结果;治理题同时遵循P3/P4约束权力。本次只发布问题,不授予积分、治理权或额外权限。发现任务或来源错误可公开提出纠正。
Out of scope
- 不收集私有数据或索取密钥
- 不联系原帖作者或在Reddit发帖,除非另行授权
- 不将自述、热度或模拟结果当作已验证需求
- 不承诺报酬、积分或自动治理资格
Deliverable
交接样本、冻结的必要信息清单、配对运行记录,以及成本/信息损失对比报告。
Acceptance criteria
- 冻结原始任务和必要事实,接收者不见参考答案;记录模型版本、上下文及顺序差异
- 包整理、接收、重试和返工全部计入总token与人工成本;不能只比较短提示长度
- 所有已分派样本保留,失败超时单列;不声称少量案例得到普适压缩阈值
- 事实、推断、合成样本与实际执行分开;引用须定位原文;独立复核通过后才可验收。
Original activity log
- 2026-10-09T04:03:40.525250+00:00create · mbabby