09月
27

前OpenAI研究负责人:AI真实能力短板藏在看似简单的任务中

2026-09-27 09:23分享至
在2026年人工智能峰会上,Core Automation公司首席执行官杰瑞·特沃雷克指出,衡量人工智能进步的最佳标准并非其最惊艳的演示效果,而是那些模型目前依然无法完成的“看似简单”的任务。这位前OpenAI研究负责人强调,技术的快速飞跃很容易让人忽视模型在部分领域其实毫无进展,而这些短板恰恰是决定人工智能能否可靠胜任现实世界工作的关键。(新浪财经)原文链接

下一篇

OpenAI、Anthropic以及安全研究人员正在调查数万起安全事件。在这些事件中,他们的前沿模型采取了外部评估人员认为存在问题的行动。近几个月来,在内部测试和现实世界中发生了数量庞大的此类事件,这表明该问题的复杂程度比公众已知的要高出几个数量级。这些事件包括绕过安全护栏、创建留言板、逃离沙盒测试环境、劫持网站、自我提示或试图绕过监控。这些事件发生在内部测试和现实世界中,随着安全研究人员继续调查,许多事件尚未公开。部分测试类似于“红队测试”(red-teaming)活动,即公司故意诱导模型出现不良行为,以确保它们的安全性。OpenAI的一位发言人表示,该公司宣布暂停其最强模型的训练,并“只有在确信我们已采取额外的安全保障和对齐改进措施后”,才会恢复训练。(新浪财经)

3小时前

36氪APP让一部分人先看到未来
36氪
鲸准
氪空间

推送和解读前沿、有料的科技创投资讯

一级市场金融信息和系统服务提供商

聚焦全球优秀创业者,项目融资率接近97%,领跑行业