热点事件 历史事件

GPT-4.5 在长文非虚构写作上表现停滞

1 篇报道1 个精选信源

先了解这件事

报道摘要

作者在完成一本 RLHF 教科书后反思,LLM 在长文非虚构写作上进展停滞,GPT 4.5 和 Kimi K2 等写作强模型已显老旧,而编码、数学等任务已接近超人水平。模型能改错字、做编辑,但组织整章内容时仍混乱且易出错,作者认为这阻碍了模型自主解决开放科学问题。

摘自 Nathan Lambert:Interconnects

报道时间线

沿着报道,了解事件的不同侧面。

显示 1全部报道最新在前
  1. Nathan Lambert:Interconnects官方一手精选
    我写了一本 AI 教科书——AI 还要多久才能写得更好?

    作者在完成一本 RLHF 教科书后反思,LLM 在长文非虚构写作上进展停滞,GPT 4.5 和 Kimi K2 等写作强模型已显老旧,而编码、数学等任务已接近超人水平。模型能改错字、做编辑,但组织整章内容时仍混乱且易出错,作者认为这阻碍了模型自主解决开放科学问题。