搜索「评测基准」,找到 3 条相关内容
相关资讯 3 条
-
AGI宣告再起波澜:评测基准差异引发行业激辩
围绕通用人工智能是否已经到来的争论再度升温。一方高调宣告,另一方则以评测基准差异指出模型表现可能大幅波动,凸显AGI定义与评估标准仍缺乏共识。
阅读全文 -
中国开源交互AI模型发布,性能超越Gemini引关注
中国团队开源全新交互AI模型,在多项评测中力压谷歌Gemini,引发行业对开源生态与交互式AI技术路线的关注。
阅读全文 -
OpenAI新模型安全评测引关注 恶意代码风险受警示
OpenAI新一代模型在安全评测中表现不及预期,尤其在恶意代码生成方面存在风险,引发行业对AI安全与发展的再思考。微软等合作方或受影响,Hugging Face等平台评测机制受关注。
阅读全文