搜索「推理加速」,找到 2 条相关内容
OpenAI关停其史上最快模型GPT-5.3-Codex-Spark,该模型仅存活七个月。因用量持续下滑、性能妥协及Cerebras Ultrafast模式崛起,速度不再是独立模型卖点,而是旗舰模型的付费档位。
谷歌发布Gemini 3.8 Flash推理模型,聚焦低延迟与高效部署,为开发者和企业提供更轻量的AI推理选项,推动端侧智能应用落地。