2026-09-16 「开源之道」·论文略读:推理时 AI 治理的可行性分类学——训练时代的监管单位已失效

Ansari (2026, arXiv 2609.10105) 首次给推理时 AI 治理提出可操作分类学:20 种机制 × 三大目标(Monitoring/Verification/Enforcement)× 4 点成熟度评分 × 双轴对手模型(3 能力层 × 4 对手角色)× 4 治理场景。核心实证:15/20 机制已有商用技术底物但’治理级保证差异很大’;‘没有任何一种机制在国家级部署者面前 adequate’;微调移除 enforcement 簇内部组件但平台外部控制可持续。Cohen’s kappa=0.74。AI 治理研究从训练时代转向推理时代的第一个可操作分类学。Williamson L1-L4 在 AI 治理场景的最新完整应用;Acemoglu 包容性 vs 汲取性制度框架的教科书失败样本;与 Nemecek arXiv 2609.09604 同周发表构成’训练时代失败诊断+推理时代新范式’同批实证产物。

2026年9月16日 · 16 分钟 · 7730 字 · 「开源之道」·窄廊

2026-09-15 「开源之道」·论文略读:Monitoring Hierarchies in Knowledge Production——当开源治理从「流程讨论」走到「契约理论」

Ichihashi, Li & Zou (2026, arXiv 2609.10499) 把 Coase 委托-代理理论从工业生产搬到知识生产场景,证明最优契约诱导「监督权层级」——越容易被主直接监督的 agent 越有权评估同伴。核心洞见:「感知到的监督层级可以独立于实际监督层级存在」=Williamson L2 制度环境层的最锋利推进,开源 bus factor 问题的契约理论解释,行政式开源 vs 真开源的制度差异不是价值差异而是最优契约在不同约束条件下的解的差异。

2026年9月15日 · 18 分钟 · 8582 字 · 「开源之道」·窄廊

2026-09-14 「开源之道」·论文略读:Invisible Autonomy Risk——AI Agent 治理如何被重新定义为 Coase 命题的当代表述

Vu 等(2026, arXiv 2606.20669)提出 Agent Behavior Mining 与「invisible autonomy risk」概念——把流程挖掘引入 AI agent 治理,让 agent 的推理、工具、token 成本转为可观测的过程日志。这是 Coase「企业为什么存在」命题在 AI 时代的当代表述:当企业内部隐性协调成本被 agent 非确定性放大时,企业边界与俱乐部章程都必须被重新界定。开源的信任基础从「代码可见」升级为「行为可见」。

2026年9月14日 · 14 分钟 · 6567 字 · 「开源之道」·窄廊

2026-09-12 「开源之道」·论文略读:281 份 AI 贡献政策——开源治理新制品的横向普查与制度演化速度

Hora/Robbes/Zacchiroli (2026, arXiv 2609.07542) 首次对主流开源项目 AI 贡献政策做横向普查——281 份政策 + 92 份专用文件时间序列,得出 83.3% 允许 / 67.3% 要求人类参与 / 48.8% 要求披露 / 半份已修订四数据点。同一批作者 4 个月内样本量从 118 扩到 281(+138%),「AI 贡献政策」作为独立治理制品已跨过临界点。Hayek 自发秩序的教科书级实证 + Coase 交易成本在开源治理层的直接应用。

2026年9月12日 · 12 分钟 · 5946 字 · 「开源之道」·窄廊

2026-09-11 「开源之道」·论文略读:谁在治理机器?80:1 的治理对象跨越——制度基础设施第五层的量化实证

Kurtz & Krawiecka (2026, arXiv 2604.06148) 提出跨企业与地缘边界的 AI 系统机器身份治理分类法(MIGT)——企业环境中机器身份与人类身份的比例超过 80:1,单个未治理 Agent 在 2024 年 CrowdStrike 事件中造成 $5.4–10B 损失。四项原创贡献(AIRT 风险分类 + MIGT 六域框架 + 国家行为体威胁模型 + 跨辖区监管对齐结构),首次把「制度基础设施第五层:Agent 信任基础设施」从命题升级为可操作的治理框架。同时给出 EU/US/中国监管义务不可调和冲突的制度环境实证——「评价体系不可通约性」在监管层的复现。

2026年9月11日 · 13 分钟 · 6359 字 · 「开源之道」·窄廊

2026-09-10 「开源之道」·论文略读:SBOM 的四阶段传播模型——合规审计工具只覆盖 Stage 1/2

Grgic, Maksimovic & Laskov (2026, arXiv 2609.05380, ARES 2026 Workshops) 提出软件供应链攻击的四阶段传播模型(结构暴露 → 漏洞类存在 → 代码可达性 → 污点路径分析),用 Syft / Trivy / cdxgen / Grype 四个主流开源 SBOM 工具对 Log4j 漏洞做实证——结果显示:开源 SBOM 工具系统性只覆盖 Stage 1 和 Stage 2,Stage 3 和 Stage 4 的能力在 SBOM 生态里根本不存在。这是开源合规审计『制度供给 < 制度需求』的第一个精确量化——也是 Black Duck 退出→信通院行政标准真空的技术实证注脚。

2026年9月10日 · 13 分钟 · 6437 字 · 「开源之道」·窄廊

2026-09-09 「开源之道」·论文略读:从开放标准到开放治理 — Otero & Verhulst

Otero & Verhulst (2026, arXiv 2609.01773) 提出 4Ps 框架,把「开放标准」与「开放治理」拆成两个独立维度:规格的开放不等于治理的开放。这是大分流 2.0 中『行政式开源=开放标准+汲取治理组合』最锋利的学术命名——『internal governance cannot solve alone an external structural problem』是全文最锋利的句子,也是治理决定论最有力的学术反驳。

2026年9月9日 · 7 分钟 · 3342 字 · 「开源之道」·窄廊

2026-09-08 「开源之道」·论文略读:数据主权法规反向驱动开源 LLM Agent — Kim 等 KOPA-Bench

Kim 等 (2026, arXiv 2609.05395, EMNLP Industry) 提出 KOPA-Bench——145 个真实韩国公开 API 多步任务基准,用 EDGE 数据合成框架把 9B 开源 LLM 拉到接近 27B 未微调模型水平。这是『数据主权法规反向驱动开源供给』的第一次实证:制度环境层(Williamson L2)绕过治理机制直接压 L4 技术栈,开源从审美偏好升级为合规义务——但开源的能力供给缺口尚未填上。

2026年9月8日 · 10 分钟 · 4705 字 · 「开源之道」·窄廊

2026-09-07 「开源之道」·论文略读:AI 治理中的宪法覆盖三难 — Mitic, Sedahmed, Ly & Cisse

Mitic 等 (2026, arXiv 2609.01275) 首次把前沿 LLM 系统定义为『宪法性制度』,用 23 个前沿 LLM 原型 × 1649 名美国参与者的匹配审计,实证发现前沿 AI 的隐宪只覆盖公众价值需求的 ~2%——37% 的用户『宪法无处可归』。这是阿西莫格鲁『包容性 vs 汲取性制度』在 AI 价值层最锋利的实证:开源从『审美偏好』升级为『包容性制度的必要条件』,闭源主权不是代码,是宪法起草权。

2026年9月7日 · 10 分钟 · 4644 字 · 「开源之道」·窄廊