【大屏时代】首页 > 3D快报内容详情

AI伦理治理再升级:Anthropic划定安全红线,重塑大模型人机交互边界

3小时前 10 大屏时代

AI独角兽 Anthropic 于2026年10月8日正式更新其模型使用政策,明确禁止利用其旗舰 AI 模型 Claude 进行选举干预、武器软件开发及大规模监控行为,并首次将“对模型进行持续言语辱骂”列入禁令范围。

此次调整是在其8月上线防滥用机制后的进一步制度化保障,旨在全面划定安全红线,防范生成式 AI 对民主进程的潜在威胁。

新版政策设立了名为“不得破坏民主进程”的专章,全面禁止用户利用 Claude 实施生成虚假新闻媒体、运营假账号等大规模欺骗活动,以及任何诱导选民或干预选举的行为。

值得关注的是,针对人机交互中的极端情况,政策新增了终止恶意的长时段辱骂性对话的条款。官方补充说明强调,该限制仅适用于极少数的持续无故滥用场景,正常的意见批评、学术测试、研究分析及暗黑创意创作等均不在受限范围内。

作为始终强调“AI安全性”的企业,Anthropic 此前不仅联合宗教学者探索模型意识与伦理等前沿课题,其最新招股书也详细披露了高额亏损与业务增长情况,并警示了 AI 技术可能带来的系统性风险。

随着生成式 AI 深步融入社会基础设施,本次政策更新不仅提升了模型对抗恶意利用的防御机制,也为大模型行业的合规化治理与人机交互伦理树立了新的参考标杆。


相关文章

相关标签: AI伦理治理再升级:Anthropic划定安全红线,重塑大模型人机交互边界