VALIDATED CASES · 实测案例
Skills 来源于已经跑通的四套配置—圆桌—账本案例下方每个 Skill 都绑定 simulationId、worldVersion、stateHash 和固定 seed;个人运行记录仍保存在这个日历中。EXPERIMENT MEMORY · 推演日历
按时间找回每一次城市实验
日期是实验入口;时间周期、配置、讨论片段和结果会作为同一条记忆保存。HERMES SKILL CATALOG
10 个 Skills 可直接接入工作台 AI 助理
经济基底、38 个领域运行时契约和模型验证默认内置;审计、反事实与主体任务可按需安装。模型验证直接读取真实预测、LLM 守卫、ABM 和模拟器能力产物。“实测”只指固定协议已执行,不代表广州现实政策有效。

who-pays-world-foundation@1.1.0经济世界基底:模型、设定与数据导入
冻结场景设定,绑定消费者、商户、平台、骑手与政府模型卡,并按声称门禁导入公开矩。任何改参数、导数据或跑实验前先装这个 Skill。

who-pays-domain-runtime@1.1.038 个领域 Skill 运行时契约
把政府、平台、商户、骑手、消费者的 38 个已实现 SkillSpec 作为唯一合法写入口。需要发券、派单、限单、休息、约谈或下单时使用。

who-pays-audit-evidence@1.1.0城市推演证据审计
核对 simulationId、worldVersion、stateHash、同种子基线、复式账本和现实解释边界,逐条区分运行结果、公开来源与模型推断。

who-pays-design-counterfactual@1.1.0同种子反事实实验设计
把自然语言问题收敛为同一城市、同一 seed、同一时间周期且只改变一个变量的 baseline / policy 对照草案。

who-pays-validate-models@1.0.0模型验证:预测、LLM 守卫与模拟器
从真实 benchmark artifacts 对比 Seasonal、Ridge、树模型、MLP、GRU、Transformer、DeepSeek、MiniMax 与通用模拟器,并强制同任务、同信息集和现实边界。

who-pays-platform-growth@1.1.0平台 A · 约束增长配置
将订单、市场份额与补贴触达放进目标函数,同时以现金跑道、披露和派单安全作为不可突破的硬约束。

who-pays-fulfillment-safety@1.1.0平台 B · 履约与骑手安全
联合评估派单压力、等待时间、运力供给与骑手风险代理值,在可接受利润下保持订单规模。

who-pays-platform-resilience@1.1.0平台 C · 单位经济与合规韧性
在补贴退坡期同时评估单位贡献利润、现金跑道、规则披露与公众信任,避免只用短期份额判断策略。

who-pays-government-guardrails@1.1.0联合政府 · 多目标治理护栏
在职责与财政约束内权衡骑手安全、消费、商户稳定和公众信任,形成券面、披露、派单的条件性联合护栏。

who-pays-roundtable-information-game@1.1.0主体圆桌 · 信息边界博弈
组织主张、质询、收束三轮讨论,确保每个智能体只读取自身获授权信息,并将未知项写成 information gap 与 belief update。

