根据 黄金形态通APP 报道,谷歌于周一正式推出EmbeddingGemma 2,这是面向设备端部署的新一代多模态嵌入模型。该模型可在本地硬件上统一处理文本、图像、音频与视频,重点强调数据隐私保护与离线推理能力,对移动端人工智能应用开发者具有直接吸引力。模型拥有7.4亿参数,基于Gemma 4架构构建,并采用Apache 2.0商业友好型许可证开源发布,方便开发者自由微调与商业部署。
谷歌在官方博客中指出,EmbeddingGemma 2能够将多种模态映射至统一嵌入空间,支持在设备端完成跨模态搜索与检索增强生成任务。例如,用户可通过语音备忘录定位视频片段,或基于文本查询检索音频内容,全程数据无需离开本地设备。此前一代产品下载量已超2000万次,新版本进一步扩展至代码、视觉与音频领域。
谷歌-A(GOOGL.US)类股当日收高0.35%,成交额约数十亿美元级别,反映市场对谷歌在开源模型与安全响应方面进展的温和积极态度。模型发布与安全事件同步披露,既展示了技术领先性,也凸显了谷歌在网络安全防护上的快速行动力。投资者关注点主要集中在设备端人工智能生态的长期拓展潜力,以及Chrome等产品在证书拦截中的防护效果。
从更广视角看,开源多模态模型的落地有助于巩固谷歌在边缘计算与隐私优先人工智能赛道的话语权,对Alphabet整体估值形成支撑。
EmbeddingGemma 2总参数量为7.4亿,文本与代码核心约2.7亿,视觉编码器1.7亿,音频编码器3亿,支持模块化加载。上下文窗口扩展至8192令牌,可处理约5.5分钟音频、29张图像或58帧视频。输出向量维度为768,并支持Matryoshka表示学习,可动态截断至128、256或512维,最高降低向量存储成本达6倍。
性能方面,该模型在MTEB代码评测中较上一代提升9.92分(从68.76升至78.68),并在亚10亿参数规模多模态嵌入模型中取得领先基准成绩,部分指标甚至超越体量两倍以上的专项模型。量化后,文本模式在Pixel设备上仅需约191MB活跃内存,全模态约567MB,适合手机与消费级硬件运行。
| 对比维度 | EmbeddingGemma 1 | EmbeddingGemma 2 |
|---|---|---|
| 参数规模 | 约3亿文本为主 | 7.4亿全模态 |
| 支持模态 | 文本 | 文本图像音频视频 |
| 上下文窗口 | 约2K | 8K |
| MTEB代码得分 | 68.76 | 78.68 |
| 许可证 | 开源 | Apache 2.0 |
与模型发布同期,谷歌披露上周发现.gh(加纳)、.sl(塞拉利昂)、.as(美属萨摩亚)国家代码顶级域名空间发生多起域名劫持事件。攻击者通过控制这些顶级域名修改权威DNS记录,进而获取针对谷歌及多家国际知名品牌域名的未授权HTTPS证书。谷歌明确表示,此事件并未造成谷歌系统遭入侵。
谷歌已立即采取保护措施,拦截自有域名下未经授权证书的使用,并在Chrome中主动通过CRLSets机制封锁相关证书,同时与签发机构协作撤销证书,以尽快保障访问相关网站的用户安全。初步迁移后数据显示,更多机构受到同一攻击影响,包括多个广泛使用的线上服务。谷歌强调,攻击性质表明证书机构在验证环节可能存在可改进空间,但整体响应迅速有效。
EmbeddingGemma 2的开源发布直接降低了移动端多模态应用的开发门槛。开发者可在本地实现隐私优先的语义搜索、零样本分类与检索增强生成,无需依赖云端算力,特别适合对数据敏感的医疗、金融与个人助手场景。模块化设计允许按需加载编码器,进一步优化资源占用。
安全事件则提醒行业关注国家代码顶级域名注册管理的脆弱性。谷歌通过Chrome的主动拦截树立了浏览器级防护标杆,可能推动更多厂商加强证书透明度监控。综合来看,技术开放与安全加固并重,有助于谷歌在人工智能边缘部署与网络信任体系中同时提升影响力。
谷歌同步推进EmbeddingGemma 2开源多模态模型与域名劫持安全响应,展现了在设备端人工智能创新与网络安全防护上的双重能力。模型以7.4亿参数实现跨模态统一嵌入并取得基准领先,为隐私优先应用提供实用工具;安全措施则通过Chrome快速拦截有效保护用户。市场对相关进展反应温和正面,后续模型实际采用率与证书体系完善程度,将持续影响谷歌在开源生态与网络信任领域的长期竞争力。
问:EmbeddingGemma 2与上一代相比有哪些关键升级?适合哪些具体应用场景?
答:EmbeddingGemma 2最大升级在于从纯文本扩展至原生多模态,统一处理文本、代码、图像、音频与视频,并映射到同一768维嵌入空间。参数增至7.4亿,基于Gemma 4架构,上下文窗口扩大四倍至8192令牌,支持更长内容处理。代码评测得分提升9.92分,部分指标超越更大专项模型。模块化设计允许仅加载所需编码器,降低内存占用。量化后可在手机等设备高效运行。适用场景包括设备端语义搜索、跨模态检索(如语音找视频)、隐私优先检索增强生成、本地代码库索引以及零样本分类。开发者可利用Apache 2.0许可证进行商业微调,特别适合对数据不出设备有严格要求的移动应用与边缘计算项目。
问:谷歌股价上涨0.35%是否主要受模型发布驱动?成交情况如何解读?
答:谷歌-A当日收高0.35%,成交额处于正常交易区间。模型发布展示了谷歌在开源与设备端人工智能的持续投入,对长期生态建设形成正面信号,但单日涨幅相对温和,表明市场已部分消化相关预期。同期安全事件披露虽属负面信息,但因谷歌系统未遭入侵且响应迅速,未引发明显抛压。成交活跃度反映投资者对Alphabet在人工智能与安全双线进展的关注,但并非剧烈波动。整体看,股价表现更多体现稳健预期,后续需观察模型下载量、实际落地案例以及竞争格局变化对估值的进一步影响。
问:域名劫持事件具体如何发生?谷歌采取的措施能否有效保护普通用户?
答:攻击者控制了.gh、.sl与.as三个国家代码顶级域名注册系统,修改相关权威DNS记录,从而通过证书机构的自动域名控制验证,获取针对谷歌及其他知名品牌域名的未授权HTTPS证书。谷歌系统本身未遭入侵。谷歌立即在Chrome中通过CRLSets机制拦截这些证书,并与签发机构协作撤销,同时主动封锁更多受影响组织的证书。普通Chrome用户无需手动操作即可获得保护。其他浏览器用户则依赖证书撤销生效。此举有效阻断了中间人攻击风险,展现了浏览器级快速响应能力,但事件也暴露了部分国家顶级域名管理环节的潜在薄弱点。
问:开发者如何获取并部署EmbeddingGemma 2?对硬件要求如何?
答:模型权重已在Hugging Face与Kaggle等平台开源发布,采用Apache 2.0许可证,允许商业使用与微调。开发者可通过Sentence Transformers等库直接加载,支持按需启用视觉或音频编码器。硬件方面,文本模式量化后约需191MB活跃内存,全模态约567MB,可在Google Pixel等高端手机或消费级GPU、CPU上运行。支持8K上下文,适合本地长文档、音视频处理。部署时需注意输入格式,如视频默认每秒一帧采样、音频16kHz单声道。谷歌同时提供AI Edge Gallery演示应用,方便快速体验即时媒体搜索与视频片段定位功能。
问:此次事件对整个互联网证书体系与国家域名管理有何启示?
答:域名劫持通过控制国家代码顶级域名获取合法证书,暴露了部分注册管理机构在安全防护上的不足,以及证书机构自动验证流程可能被利用的风险。谷歌通过Chrome主动拦截树立了快速响应范例,推动行业加强证书透明度日志监控与跨机构协作。未来可能促使更多浏览器厂商完善CRL机制,并推动国家顶级域名注册商提升安全标准。对用户而言,使用主流浏览器并保持更新可获得较好保护。对开发者与企业,则需加强域名监控与多因素验证。整体事件提醒,网络信任链条中任何环节的薄弱都可能被放大,持续改进验证流程与应急响应至关重要。
来源:今日美股网