模型原理与官方文档
同一空间怎样连接不同材料 →
上一代 EmbeddingGemma 面向文字;第二代把文字、代码、图片、音频和视频放进同一个表示空间。
Google DeepMind · 发布 2026-10-06
把文字、照片、声音和视频变成可比较的表示,为设备上的媒体检索提供基础。
模型原始说明 ↗暂未收录同口径榜单分数,可从下面的评测与示例了解这款模型。
模型原理与官方文档
上一代 EmbeddingGemma 面向文字;第二代把文字、代码、图片、音频和视频放进同一个表示空间。
官方手机检索示例
Google 的手机演示里,用户输入“海龟吃东西”,应用列出视频中的多个候选片段,每个都带时间点。