搜索「AI评估」,找到 3 条相关内容
相关资讯 3 条
-
AI能力评估遇瓶颈:o1核心成员称现有测试方法逼近失效
OpenAI o1模型核心贡献者发出预警,指出AI系统能力快速提升,但现有评估工具与测试方法已难以准确衡量其真实水平。这一矛盾在微软等平台加速集成先进模型之际尤为突出,行业面临评测体系重构的紧迫挑战。
阅读全文 -
DeepMind安全团队再失核心成员,五年风险预警引发行业深思
谷歌DeepMind通用人工智能安全团队研究员乔希·恩格尔斯离职加入METR,警告未来五年AI造成巨大危害的概率高得吓人,并指出递归自我提升风险及对齐技术滞后问题。此前Anthropic研究员考克森也有类似离职警告,CEO阿莫代伊呼吁放缓研发节奏。
阅读全文 -
X平台测试AI可信度评估功能,社交内容审核迎新方向
X平台(原推特)正在测试一项新功能,利用人工智能对帖子可信度进行实时评估,旨在打击虚假信息。该功能尚处测试阶段,引发行业关注。
阅读全文