跳到正文
热点事件持续更新

Aleph Alpha发布中国AI模型政治敏感性基准研究

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

德国AI公司Aleph Alpha发布一项基准研究,用967个敏感话题测试阿里Qwen、DeepSeek和月之暗面Kimi。按其自研评分系统,这些模型仅17%至41%的回答被评为平衡,其余为复述官方立场、回避或拒答。 该结论来自Aleph Alpha自身的评分标准,报道未说明测试所用模型版本、具体话题及评分细则。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月4日
  1. The Decoder:AI News
    Aleph Alpha 研究:Qwen、DeepSeek、Kimi 等中国 AI 模型在敏感话题上回避或复述官方立场

    Aleph Alpha 用 967 个敏感话题测试阿里 Qwen、DeepSeek 和月之暗面 Kimi,其自研评分系统仅将 17% 至 41% 的回答评为平衡,其余为复述官方立场、回避或拒答。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。