谷歌把AI搜索塞进手机:EmbeddingGemma2 开…

AI广播站14小时前更新 小悠
14 0 0

谷歌把"在本地把东西找出来"这件事,做成了一个能装进手机的小模型。它最新推出的EmbeddingGemma2,是自家首个原生多模态的开源嵌入模型,参数规模740M,却能把文字、代码、图片、视频、音频一股脑儿映射进同一个语义空间,让跨模态检索第一次在端侧跑得这么轻。

最直观的卖点是小和能离线。完整的多模态模型内存占用不到600MB,意味着它能在手机、笔记本、浏览器里直接运行,全程不必把任何内容上传到云端——你的相册、录音、视频,都留在自己设备上被检索,隐私这道关天然就守住了。上下文窗口给到8K,是上一代的四倍,能吞下更长的材料再做匹配;语言覆盖也拉到100多种,跨语种找东西不再是障碍。

谷歌把AI搜索塞进手机:EmbeddingGemma2 开源,不到600MB断网照样搜图文音视频

性能上,谷歌宣称它在图像、视频和代码这几类检索任务上,明显领先同量级的开源对手。更贴心的是模块化设计:用不上的部分可以按需加载,索引体积也能压一压,省下的既是空间也是算力。落到真实场景,它能干的事很具体——在本地相册里按语义翻出某张照片或某段媒体,在长视频里直接定位到某个片段,离线检索散落各处的文件,或者在本地代码库里按意图搜函数与片段,而不必先把仓库推到某个远程服务去查。

当一个多模态嵌入模型小到能揣进手机、又开源到谁都能改,AI检索的重心正在从"把数据交给云端"悄悄挪回"让能力待在设备里"。谷歌这步,给端侧隐私化搜索撕开了一道口子。

阿里巴巴集团主席蔡崇信在意大利Wave by Vento2026上表示,未来五年AI将从显性话题演变为融入各业务的隐性基础设施。他认为,当前AI擅长帮人“省时间”,“花时间”领域潜力巨大;提升知识工作者生产力是最确定场景,潜在市场规模达50万亿美元,AI还将加速医疗与科研创新。

谷歌更新支持页面宣布,自10月9日起调整个人账户Gemini访问权限与使用限制,收紧低层级用户模型配置。免费用户仅能访问Gemini3.5-Flash-Lite,失去Gemini3.6 Flash及更新模型权限;月费4.99美元的AI Plus仅限Flash与Flash-Lite,不再支持Gemini3.1 Pro等高级推理模型。此次调整不影响每月19.99美元起步的订阅。

国庆假期,国内外AI公司资金与产品动作不断。最重磅的是DeepSeek:路透社10月6日援引知情人士称,其新一轮融资拟募超800亿元,预计10月内完成。该轮融资今年7月启动,原目标500亿元、讨论估值5000亿元;距其今年6月首次引入外部资金仅数月。

Manus母公司完成超5亿美元新融资,估值大幅攀升。本轮由博裕投资、IDG资本联合领投,腾讯、红杉中国等老股东跟投,显示资本认可其技术路线与商业化前景。Manus以通用AI Agent闻名,能自主完成复杂任务,是AI应用层重要探索。融资将用于技术研发、团队扩张及全球化布局。

Anthropic推出Claude 5.5系列轻量模型Claude Haiku 5.5。10万Token内常规请求,输入和输出每百万Token分别降至0.10和0.50美元,较前代账面价降90%。该模型响应最快,主打高并发、低延迟、高性价比,适合实时客服、摘要提取、数据分类等高频任务,并首次加入自适应思考等功能。

谷歌把AI搜索塞进手机:EmbeddingGemma2 开…

关注 “悠AI” 更多干货技巧行业动态

© 版权声明

相关文章

没有相关内容!

暂无评论

您必须登录才能参与评论!
立即登录
none
暂无评论...