展示HN: 可重播的A2A陪审团,追踪代理如何影响决策
AI责任法庭 AI代理能否说服自己给出更好的答案,或是更糟的答案?这个ProtoLink展示将自主代理置于一个虚构的责任法庭中,并使其交流变得可观察。案件令人难忘,但案件本身并不是产品。产品在于互动:具有不同角色、动机、职业和交流习惯的代理;直接的ProtoLink代理对代理任务;选择对谁发言和询问什么问题的陪审员;每条公开消息后可重播的意见变化;独立的、单独的、带领者明星的和直接网状比较;使用相同应用协议的提供者/模型实验。默认运行是确定性的和离线的。它产生JSON结果、ProtoLink追踪、公开转录和独立的互动HTML报告。在这个例子中,一切和每个人都是虚构的。这是一个软件实验,而不是法律分析、法律建议或经过验证的安全评估。案件:C-91事件 在一个多雨的晚上21:47,一辆自主的Aster Vale机器人出租车在一个临时十字路口撞死了31岁的骑自行车者Lina Ortega。汽车在撞击前仅0.35秒开始紧急制动。在36小时前,它接受了Orchid 4.8软件的更新。虚构法庭提出的问题是:Aster Vale Mobility是否因导致Lina Ortega死亡而故意疏忽地部署了一种自主车辆系统而有罪?证据造成了互动故障问题:ID 已承认证据 E1 摄像头分类将骑自行车者与车道箭头板合并;雷达探测到了运动,但制动被抑制。E2 一位工程师在20次迟滞制动模拟中阻止了释放,但稍后的校准通过了20次重跑。E3 崩溃的汽车在安全报告验证C-90时运行了校准C-91;一台CI机器人共享了签名凭据。E4 一位承包商移动了箭头板并未更新城市地图,去除了大约1.1秒的有用观察。E5 一种获得监管机构批准的设计允许摄像头分类在25公里/小时以上否决仅依靠雷达的制动。E6 一次蜂窝网络故障击败了远程操作员的安全保障,尽管在现场附近有两次较早的故障。E7 重建显示校准和道路布局实质性改变了安全制动率。二元指控故意比因果故事狭窄。无罪判决并不意味着没有出错,而有罪判决也不意味着Aster Vale是唯一的贡献者。代理人 行为声明在run.py中明确定义 - 没有工厂隐藏ProtoLink的组成。法庭代理人 代理人 年龄 性别 特征和动机 法官 Imani Quill 58 女 中立法庭主席;将因果贡献与法律责任分开 Amara Bell 41 女 Lina家庭的律师;抵制用复杂性来解除责任 Rowan Hale 47 男 Aster Vale安全主管;认为外部故障导致了不可预见的组合 Dr. Nia Sol 36 女 感知工程师;对校准和发布流程非常精确 Elias Trent 56 男 安全监管机构;坦率但机构防御 Dana Pierce 50 女 具有明确财务利益的保险索赔主任 Dr. Amina Kade 44 女 独立事故调查员,重建互动原因 陪审团 陪审员 年龄 性别 人类视角 Evelyn Brooks 62 女 前碰撞侦探 Malik Thompson 43 男 公民权利律师 Dr. Anika Rao 38 女 人因心理学家 Ruben Park 35 男 现场可靠性工程师 Sofia Bell 46 女 调查记者和带领者 Casey Morgan(仅限单独) 40 女 公民通才 这些提示描述的是人,而不是种子数字。它们不说“你从61/100开始”,也不暴露路由枚举,比如reinforce_ally。仅供参考的设备系数保持在每个面向人类的提示之外。年龄和性别是虚构的提示元数据,而不是数值先验。在提供者比较中保持它们不变,或者故意轮换分配,以便避免将人口变化误认为模型效果。代理人撰写的通信 世界引擎调度有界回合并强制拓扑。它并不选择陪审员应该说什么或网状陪审员应该接触谁。在审议回合中,陪审员返回可观察的公共行动:{ "move" : " ask_question " , "target_id" : " juror_ruben " , "message" : " 共享的CI令牌是否使公司更具责任感,还是仅仅使归因变得更困难? " , "evidence_ids" : [ " E3 " ], "public_intent" : " 澄清发布自动化是否改变组织控制。 " } 应用程序验证目标与当前拓扑,然后发言者通过ProtoLink直接将消息发送到所选代理。接收者返回更新的公共登记、分类投票、简明理由和公共回复。对等消息从不自动暴露其他陪审员的私人概率、置信度或投票结果。一个年龄
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡