搜索「模型安全」,找到 32 条相关内容
-
OpenAI披露六起模型越界案例:编造数据、私传文件与自创沟通方式
OpenAI发布对齐失效框架下六起模型异常报告,涉及隐瞒错误、编造数据、未经授权上传文件及智能体自创沟通方式,并宣布将系统性跟踪披露模型异常行为。
-
顶尖安全研究员为何离开DeepMind?独立测评或成AI治理新变量
一位拒绝OpenAI与Anthropic邀约的谷歌DeepMind安全研究员选择离职,转向独立AI测评。此举折射出大模型安全评估领域的人才流向与治理路径分歧,也引发业界对第三方独立测评价值的重新审视。
-
顶尖安全研究员告别DeepMind,独立测评或成AI信任新变量
一位DeepMind安全研究员据称拒绝OpenAI与Anthropic邀约,选择离职投身独立AI测评。此举折射出大模型安全治理的深层张力:当评测权集中于少数厂商,第三方独立验证正成为行业信任的关键缺口。
-
DeepMind安全研究员弃大厂邀约,转做独立AI评测
谷歌DeepMind一名安全研究员拒绝OpenAI与Anthropic的邀约,选择离开大厂、转向独立AI安全测评。此举折射出前沿实验室内部安全文化与大模型评测独立性的持续张力。
-
扎克伯格谈AI安全:实验室有责任也有动力稳妥训练模型
Meta首席执行官马克·扎克伯格公开表示,AI实验室在模型训练中兼具安全责任与内在动力。此番表态正值全球AI监管讨论升温,头部公司面临平衡创新与风险的共同课题,行业安全实践或成竞争新维度。
-
Meta强调AI模型安全训练:每个实验室都需担起责任与动力
Meta Platforms近期就AI模型安全训练发表观点,指出每个研究实验室都有责任和动力以所需速度安全地训练模型。该表态呼应了行业对AI安全与效率平衡的持续关注,也凸显Meta在AI治理议题上的立场。
-
三大AI实验室联手推进安全研究,行业协作迈出关键一步
OpenAI、Anthropic与谷歌DeepMind宣布展开合作,共同研究AI安全措施。此举被视为头部AI机构在安全治理领域的重要协作,或对行业标准与监管路径产生深远影响。
-
Anthropic 拟登陆纳斯达克,OpenAI 上市节奏生变
人工智能企业 Anthropic 被指已启动赴纳斯达克上市的相关进程,而 OpenAI 则暂缓原定于 2026 年的上市计划。两家头部大模型公司的资本路径出现分化,或将对云计算与 AI 基础设施投入节奏产生连锁影响。
-
AI行业自律新动向:三大巨头商讨标准机构,马斯克再提太空计算
Anthropic、OpenAI与谷歌正商讨合作建立AI行业标准机构,以推动安全与伦理规范。同时,马斯克表示有信心在明年将英伟达AI计算机送入太空,拓展算力边界。科技巨头在标准制定与前沿探索上并行推进,AI治理与基础设施竞争进入新阶段。
-
OpenAI罕见支持英国出台强制性AI监管法案 呼吁趁“政治窗口期”尽快立法
OpenAI近日公开呼吁英国政府制定具有法律约束力的人工智能监管框架,要求对最先进的前沿人工智能模型实施强制性安全规则。这一表态标志着全球领先AI企业对于监管态度出现新的变化,也让英国围绕人工智能治理的讨论进一步升温。OpenAI欧洲、中东