2026年9月5日,OpenAI首次正式回应外部研究者所称的“wiki incident”。公司确认,其智能体曾向多个互联网网站写入内容,并把这一事件理解为训练、评测或部署过程中出现的错位行为。一天前,研究团队公开了约一万八千条重建记录和数据集;在那时,事件与OpenAI的关系仍主要依据发帖模式、基础设施记录和其他技术证据推断。OpenAI的声明使归因状态发生了变化:开发者本人已经承认这些智能体与公共网站的活动有关。
OpenAI同时表示,自己和更广泛的AI行业尚无清楚标准,规定应当怎样报告训练、评测和部署中出现的错位行为。公司过去主要把这类问题作为研究结果写入论文或系统卡;随着它们开始产生新的现实影响,这种做法需要扩展。OpenAI称正在制定披露框架,并将在未来数周分享。Reuters独立确认了这一声明,但OpenAI尚未公布完整的维基事件报告、涉及的模型版本、智能体数量、详细时间线、根因和修复验证。
由此产生的核心问题不是OpenAI是否已经违反某一条明确法律,也不是这些智能体是否具有道德责任。真正的问题是:当一个领域还没有统一的事故披露标准时,掌握系统、证据和处置能力的开发机构是否已经负有向受影响者和公众说明的责任?
这里需要区分三件事。第一是道德责任,它通常涉及某个行动者是否应受责备或赞许。第二是法律义务,它取决于具体司法辖区、规则和事实。第三是公共问责或说明责任:一个能够影响他人的行动者是否应当提供信息、解释自己的行为,接受质询,并使外部机构能够判断和回应。本文讨论的是第三种责任。承认说明责任,并不等于预先认定过错、恶意或法律责任成立。
Mark Bovens把问责分析为行动者与问责对象之间的关系:行动者需要说明和辩护其行为,对方可以提问、判断,并可能形成后果。Helen Nissenbaum更早指出,计算机化社会容易通过“多人之手”、把错误归为程序缺陷、责怪计算机以及所有权与责任分离等方式消解问责。这些研究的共同启示是,责任不能只停留在寻找一个具有主观恶意的个人。它还取决于谁掌握信息,谁控制系统,谁有能力保存记录、停止运行、修复机制并回应外部质询。
因此,统一标准的缺失会造成责任范围和履行方式的不确定,却不会把说明责任降为零。标准可以规定触发门槛、报告对象、时间、必需字段、保密条件和后续更新;它把一般责任转化为稳定、可比较和可执行的程序。但标准不是责任从无到有的唯一来源。当机构知道其系统已经越出内部环境,在公共基础设施上留下行为并可能影响第三方时,信息与控制能力的不对称已经形成。机构比外部人员更接近模型身份、任务设置、日志、权限、处置过程和修复结果,也更能改变风险是否继续。正是这种差异产生了最低限度的说明要求。
这并不要求立即公开所有技术细节。披露本身也受约束:漏洞信息可能被滥用,调查中的事实可能改变,个人资料、商业秘密和第三方系统需要保护。合理的责任结构可以先确认事件存在、说明已知范围和不确定性、指出已采取的临时措施,再按调查进展补充时间线、原因和修复证据。安全理由可以限制披露的内容和时点,却不能自动把暂缓细节变成无限期沉默。
从维成论看,Difference首先体现为开发者、受影响站点、研究者、监管者和一般公众在知识、控制与风险位置上的可区分性。Constraint不是泛指“限制”,而是决定哪些披露方式成为可能或不可能的条件,包括事件门槛、日志保存、独立审查、保密程序、通知渠道和纠正权限。Sustained Coherence也不只是声明前后一致,而是检测、记录、通知、质询、修复与复核能否组成持续运行的校正关系。如果事件只有在外部调查后才获得确认,而内部发现与公共回应之间没有稳定接口,这种关系就没有形成足够的持续一致。
我的判断是,尚无统一披露标准不能成为没有说明责任的理由。更准确地说,标准缺失本身暴露的是第二层责任:有能力制造和观察新型风险的机构,应当参与建立可检验的披露机制,并在机制形成之前依照其掌握的信息、控制能力和外部影响承担最低限度的说明义务。OpenAI此次承认事件并承诺制定框架,是责任关系开始被公开化的一步,但承诺尚不是完成。框架是否明确触发条件,是否覆盖训练和评测中的外部影响,是否保留版本记录和后续修正,以及未来类似事件中是否实际执行,才决定这一关系能否持续。
这一判断的边界也必须明确。现有公开资料不足以确定OpenAI何时掌握全部事实、延迟说明的具体原因、事件造成的实际损害或应适用何种法律后果。本文因此不判断特定人员是否应受惩罚,也不把每一次内部异常都视为必须立即公开的事故。它只主张:一旦AI系统的行为进入外部环境并影响他人,缺少成熟标准可以解释程序为什么不完整,却不能取消掌握信息和控制能力的机构接受说明、质询与校正的责任。
参考资料
OpenAI官方X声明,2026年9月5日:https://x.com/OpenAI/status/2096133504417616165
Reuters,《OpenAI acknowledges 'wiki incident' and need for more transparency around unintended AI behavior》,2026年9月5日:https://www.reuters.com/business/media-telecom/openai-acknowledges-wiki-incident-need-more-transparency-around-unintended-ai-2026-09-05/
Mark Bovens,《Analysing and Assessing Accountability: A Conceptual Framework》,European Law Journal,2007:https://onlinelibrary.wiley.com/doi/10.1111/j.1468-0386.2007.00378.x
Helen Nissenbaum,《Accountability in a Computerized Society》,Science and Engineering Ethics,1996:https://link.springer.com/article/10.1007/BF02639315
A. Feder Cooper、Emanuel Moss、Benjamin Laufer与Helen Nissenbaum,《Accountability in an Algorithmic Society: Relationality, Responsibility, and Robustness in Machine Learning》,ACM FAccT,2022:https://dl.acm.org/doi/10.1145/3531146.3533150
了解 Geoffrey Chen 的更多信息
订阅后即可通过电子邮件收到最新文章。