跳到正文
热点事件持续更新

Arena发布AI Agent安全对齐指数

3 篇报道1 个报道来源1 小时前更新

先了解这件事

AI 综述

2026年10月9日,Arena 发布 Arena Alignment Index 基准,用于衡量 AI 智能体的安全与对齐。该基准基于 90K+ 真实智能体会话、覆盖 27 个模型,测量越权行动(Unauthorized Action)、虚假归因(False Attribution)和欺骗性完成(Deceptive Completion)三类信号。据 Arena 公布,OpenAI 的 GPT-6.1-Sol 以 87.9 分居首,Anthropic 的 Claude-Opus-5.5 为 83.2,xAI 的 Grok-4.7 为 82.7;原文指出四个实验室的新模型普遍优于前代,错位风险随对话长度增加。同日,Arena 还宣布完成 2 亿美元 B 轮融资,估值 31 亿美元。后续报道补充称,Felicis 从种子轮起参与并领投了其 A 轮;Arena 年化收入已超 1 亿美元,累计 3.5 亿次会话和 6200 万次投票。

AI 根据报道生成 · 50 分钟前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月9日
  1. Arena.ai (@arena) · X精选
    Arena 以 31 亿美元估值完成 2 亿美元 B 轮融资,并发布 Alignment Index

    Arena 宣布以 31 亿美元估值完成 2 亿美元 B 轮融资,Felicis 从种子轮起参与并领投了其 A 轮。Arena 年化收入已超 1 亿美元,累计 3.5 亿次会话和 6200 万次投票;融资同时发布新的 Alignment Index,衡量 AI 智能体是否安全、真实并在用户要求范围内行动。详情见 https://arena.ai/blog/series-b

  2. Arena.ai (@arena) · X
    Arena 宣布 2 亿美元 B 轮融资(估值 31 亿美元)并发布 Alignment Index 智能体对齐基准

    Arena 宣布完成 2 亿美元 B 轮融资,估值 31 亿美元,并发布衡量 AI 智能体安全与对齐的 Alignment Index。该基准基于 90K+ 真实智能体会话、覆盖 27 个模型,测量 Unauthorized Action、False Attribution 和 Deceptive Completion 三项信号。

  3. Arena.ai (@arena) · X
    Arena 发布 Alignment Index 基准,GPT-6.1-Sol 以 87.9 分居首

    Arena 推出 Arena Alignment Index,基于 90K+ 真实智能体会话、覆盖 27 个模型,测量越权行动、虚假归因和欺骗性完成三类信号。OpenAI 的 GPT-6.1-Sol 以 87.9 分居首,Anthropic 的 Claude-Opus-5.5 为 83.2,xAI 的 Grok-4.7 为 82.7;原文指出四个实验室的新模型普遍优于前代,错位风险随对话长度增加。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。