搜索「视频理解」,找到 2 条相关内容
谷歌发布Gemini 3.8 Flash,原生支持视频理解,直接对标GPT系列。该模型在实时交互与多模态处理上实现突破,为开发者提供更高效的工具,推动AI在视频分析、内容生成等领域的应用。
谷歌近期发布主动视频理解功能,让AI能自主选择重点画面分析,大幅降低token消耗与成本,提升长视频理解准确率。此举或为谷歌在AI竞赛中开辟新赛道,以视频理解弥补旗舰模型短板。