快讯 09:42DeepSeek 开源 V4 推理引擎,推理成本再降 40%10:15逐际动力完成 B 轮 5 亿元融资,加速人形机器人量产10:58Kimi 企业版 API 上线,新增批量推理折扣档位 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

论文 今天 · 星期六 · 09-12 00:00 约 1 分钟读完

Anthropic红队新评测:AI在战术定位与武器开发任务上逼近人类专家

摘要

Anthropic Frontier Red Team发布新评测,衡量AI模型在战术情报定位与常规武器开发方面的能力。评测涵盖账号关联、照片与文本地理定位,以及无人机末制导、投放和GPS拒止导航等任务。结果显示,模型在模拟任务上持续进步,部分任务已接近或超过人类专家基线。

Anthropic旗下前沿红队(Frontier Red Team)近日公布了一项针对AI模型能力边界的新评测,聚焦两个高度敏感的领域:战术情报定位与常规武器开发。该评测旨在系统性地追踪模型在模拟军事场景中的表现,而非评估其实际部署可能性。

在战术情报定位方面,评测覆盖了账号关联、基于照片的地理定位以及基于文本的地理定位三类任务。这些任务模拟了从公开信息中推断目标位置和身份的过程,对模型的跨模态推理与信息整合能力提出了较高要求。

常规武器开发维度的评测则涉及无人机末制导、投放操作以及GPS拒止环境下的导航。这些模拟任务考验模型在复杂约束条件下的规划与控制能力,尤其是当卫星导航信号不可用时,模型需依赖替代方案完成路径决策。

评测结果显示,AI模型在上述模拟任务中持续取得进步,部分任务的表现已接近甚至超过人类专家基线。这一趋势表明,前沿模型在特定军事相关场景中的能力正在快速提升,但Anthropic并未披露具体任务名称、模型版本或量化得分。

AnthropicAI安全红队评测军事AI
本文由新大陆基于公开信息编辑整理
3,284
收录 AI 工具
186
模型产品档案
57
企业落地案例
1,247
完整版提示词