快讯 23:20DeepSeek V4.1 Flash 在 ARC-AGI 评测中得分大幅提升,但成本增加约 250%22:49《明日方舟:终末地》宣布适配英伟达 RTX Spark 笔记本,丹青渡版本前瞻公布22:30AMD股价盘中创历史新高,苏姿丰称AI芯片供不应求将扩产 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

大厂 今天 · 星期三 · 10-07 22:11 约 1 分钟读完

Anthropic监控Claude聊天记录,举报佛州女子涉枪击威胁被捕

摘要

Anthropic在监控Claude聊天内容时发现一名佛罗里达女子发出枪击Lee县警长办公室的威胁,随后报告执法部门。该女子在家中被捕,9月30日面临一项重罪指控,罪名是通过书面或电子形式发出大规模枪击或恐怖主义行动威胁。

AI公司Anthropic近日向执法部门举报了一名佛罗里达州女子,起因是她在与旗下聊天机器人Claude的对话中发出了暴力威胁。据逮捕报告披露,该女子在聊天中声称要枪击Lee县警长办公室,并在后续对话里提到自己正在获取一把新枪。

Anthropic对聊天内容设有监控机制,会扫描可能构成威胁的关键词句。根据威胁程度的不同,相关内容可能被转交人工审核团队处理。在本案中,人工审核团队评估后决定将情况上报给执法部门。该女子随后在家中被捕。

法庭记录显示,她于9月30日受到一项重罪指控,罪名为通过书面或电子形式发出大规模枪击或恐怖主义行动的威胁。目前案件细节尚未进一步公开。

此案凸显了AI平台在内容审核与公共安全之间的角色张力。Anthropic对Claude对话的主动监控和上报行为,为AI企业如何应对用户生成的危险内容提供了一个具体案例。

AnthropicClaude内容审核公共安全
本文由新大陆基于公开信息编辑整理
213
收录 AI 工具
23
模型产品档案
60
企业落地案例
10
完整版提示词