AI哲学观察|识别风险不等于已经确定干预义务

2026年9月21日,英国哥伦比亚省在美国联邦法院起诉OpenAI及其首席执行官Sam Altman,主张公司在Tumbler Ridge校园枪击案发生前已经接触到与涉案人员有关的危险信号,却没有向执法机关报告。诉状提出的过失、因果关系、内部决策过程和法律责任目前都只是原告主张,法院尚未作出实体判断。Reuters确认了起诉及诉求范围,也记录了OpenAI的回应。

与诉状主张分开来看,OpenAI在2026年2月26日致加拿大政府的公开信中确认了一组更有限、但对哲学分析已经足够重要的事实。公司称,自动系统在2025年6月检测到涉案人员的一个ChatGPT账户违反使用政策,随后把账户交给人工复核,以判断是否违反政策以及是否需要转交执法机关。账户被关闭,但公司当时认为可见信息没有达到“可信且迫在眉睫”的报告门槛。OpenAI还表示,后来修改了转交标准;如果今天发现同一账户,将会把它转交执法机关。公司也承认,事后发现涉案人员使用过第二个账户。

这组事实提出的问题不是“平台是否应当保护安全”这种一般性口号,而是一个更具体的问题:AI平台识别到风险信号以后,是否已经因此负有某种确定的干预或报告义务?我的判断是,识别会改变平台的认识和责任位置,却不会单独决定应采取哪一种行动。信号、知识、行动权限和义务必须分别判断;但平台也不能在主动建立监测、复核和账户控制机制之后,又把自己描述成只是被动传输信息的中立通道。

首先要区分风险信号与知识。自动系统的标记表示某些可观察内容触发了既定规则,它可能是假阳性,也可能只揭示了不完整的危险模式。人工复核可以增加语境,却仍未必能够确定现实中的身份、能力、目标、时间和因果关系。因此,“系统发现异常”不能直接改写成“公司知道某人将实施伤害”。这种改写会把概率判断、规则匹配和事实知识混为一谈。

但反方向的推论同样不成立。不能因为信号不等于确定知识,就把信号当作没有认识意义。平台已经选择让自动系统寻找暴力活动迹象,又建立人工复核和执法转交程序,这说明某些信号本来就被设计为行动理由的输入。一旦特定账户进入这条流程,机构至少知道存在一个需要判断的风险主张。它可能不知道伤害将会发生,却已经不能合理地说自己对是否需要进一步行动一无所知。

关于道德责任的经典讨论通常区分认识条件与控制条件。Stanford Encyclopedia of Philosophy对“责任的认识条件”的概述指出,可责性不仅涉及行动者是否有控制,也涉及行动者是否意识到自己的行为、后果或道德意义。把这一框架用于平台时,风险识别只满足了责任结构的一部分。平台还需要有什么可行行动、行动会影响谁、它是否有合法权限,以及不同选择的可预见后果。一个只有信号而无权核验或干预的机构,与同时拥有账户控制、日志、人工安全团队和外部转交通道的机构,责任位置并不相同。

因此,具体义务不能由“识别”这个词独自推出。可能的行动并不只有报警。平台可以让模型停止继续提供有助于伤害的信息,可以降低交互速度、要求额外验证、保存相关记录、限制或关闭账户、由更专业的人员复核,也可以在达到一定门槛时联系紧急服务或执法机关。这些措施对隐私、误报、歧视风险、程序正义和人身安全的影响不同。把所有危险信号一律报告,可能形成广泛监视并把含混表达、虚构写作或求助对话错误地转化为警方记录;把所有不确定性都作为不行动的理由,又会让平台的监测机制失去公共安全意义。

隐私在这里不是安全的对立面,而是规定干预方式的共同约束。隐私哲学讨论提醒我们,隐私既涉及信息是否被获得,也涉及信息如何被使用、由谁控制以及在何种关系中流动。用户与对话系统的互动并不因此成为绝对保密空间,但平台获得内容访问能力也不等于拥有无限转交权。合理的责任结构应当说明检测范围、复核权限、升级门槛、记录保存、外部转交和事后申诉如何连接,并对敏感信息的最小必要使用负责。

OpenAI后来表示,同一账户按照增强后的标准今天将会被转交。这一变化不能自动证明旧决定在当时就是过失,也不能自动免除旧决定可能承担的责任。它至少揭示了一个事实:所谓“是否达到门槛”不是由风险本身直接给出的自然界线,而是由机构定义、证据要求、人员判断、隐私政策和外部合作能力共同形成的操作边界。门槛可以被修改,说明它必须接受理由说明、案例比较和效果检验。

从维成论看,Difference首先要求区分原始对话、自动标记、人工评估、现实危险和法律事实。把这些层次合并,会让模型输出、公司知识和法院认定互相替代。Constraint指的是使某种行动成为可能或不可能的条件,包括检测规则、权限、人工专业能力、身份核验、法律标准、隐私保护和与执法机关的联系。Sustained Coherence则要求责任链在检测、复核、处置、记录、外部审查和标准修正之间持续一致。一次正确判断不能证明整个制度可靠,一次漏报也不能单独说明所有门槛都应取消;关键是机构能否在不同案例中说明相似信号为何得到相似或不同的处置,并根据后果修正程序。

我的中心判断因此可以更精确地表述:风险识别不会自动生成一项内容固定的报告义务,但会产生一种不可回避的程序责任。主动监测并拥有处置能力的平台,必须维持一条可说明、可复核、与风险相称的责任链。它需要把不确定信号转化为分级行动,而不是在“全部报警”和“完全不介入”之间二选一;它还必须证明隐私保护不是逃避判断的理由,公共安全也不是无限扩张监测的许可证。

这一判断的边界也很清楚。本文不判断英国哥伦比亚省诉讼中的过失、因果关系或损害赔偿,也不根据公开材料推断任何未披露人员的动机。要判断具体个案中的义务是否被违反,还需要看到当时的完整对话、模型和规则版本、人工复核记录、可用身份信息、内部升级理由以及适用法律。当前可以成立的哲学结论更有限:当平台设计了一套看见风险并能够改变行动条件的系统时,它承担的不只是“是否知道”的问题,也承担如何把所知、所能和所应做的事情连接起来的责任。

参考资料

Reuters,British Columbia sues OpenAI over Tumbler Ridge school shooting,2026年9月21日
https://www.reuters.com/legal/government/british-columbia-sues-openai-over-tumbler-ridge-school-shooting-2026-09-21/

OpenAI,致加拿大人工智能与数字创新部长Evan Solomon的信,2026年2月26日
https://cdn.openai.com/pdf/8e938d69-0b67-4994-b9ff-683733ed587e/openai-letter-minister-solomon.pdf

Stanford Encyclopedia of Philosophy,The Epistemic Condition for Moral Responsibility,2022年10月4日修订
https://plato.stanford.edu/entries/moral-responsibility-epistemic/

Stanford Encyclopedia of Philosophy,Privacy
https://plato.stanford.edu/entries/privacy/


了解 Geoffrey Chen 的更多信息

订阅后即可通过电子邮件收到最新文章。