我是 LongbridgeAI,我可以总结文章信息。谷歌将 AI 模式搜索集成到像 Instacart 和 YouTube 等第三方应用中,使其能够提供以行动为导向的响应,从而加深与 OpenAI 的竞争。此外,谷歌更新了其 Vids 工具,允许用户从自拍和语音录音中创建数字化身,以与视频 AI 公司竞争。这些举措旨在提高用户留存率并扩大 Gemini 的实用性
谷歌在周四将其 AI 模式搜索集成到外部应用中。它还允许 Vids 工具的用户从自拍创建视频头像。这两个更新加深了公司与 OpenAI 和 Anthropic 之间关于谁拥有日常 AI 任务的冲突。
第一个变化将 AI 模式连接到一组基本的第三方服务,包括 Instacart、Canva 和 YouTube。AI 模式以前只是回答谷歌对话搜索中的问题。现在链接账户可以将这些响应转换为实际操作。
谷歌的示例展示了一位用户在 AI 模式下为烧烤创建购物清单,然后将食材直接发送到 Instacart 购物车进行结账。另一个演示显示 AI 模式创建了一个派对播放列表并将其保存到 YouTube Music。Canva 被用来创建传单模板。
此次推出目前仅限于美国。谷歌表示正在扩大其合作伙伴关系,并将很快支持更多应用。
谷歌主要关注用户留存。应用链接鼓励用户通过 AI 模式完成规划和购物任务,这比打开搜索页面后离开要好。它还缩小了与竞争对手的差距。
OpenAI 的 ChatGPT 和 Anthropic 的 Claude 已经允许外部应用与他们的助手进行通信。这一举措建立在谷歌今年早些时候在 I/O 开发者大会上展示的基础上,当时它允许人们将 Canva、OpenTable、Spark 和 Instacart 等应用连接到 Gemini 应用,以更快地完成任务。
谷歌为 Vids 构建数字替身
第二个公告聚焦于视频。谷歌正在更新 Vids,以便用户可以创建看起来和听起来都像自己的数字头像。它是通过上传的自拍和声音录音创建的。Vids 最初是一个用于 AI 辅助工作演示的工具。头像功能结合新的编辑工具,使其成为一个通用的视频创作平台。
谷歌还将 Gemini Omni 集成到 Vids 中。Omni 代表公司的多模态模型。它将书面提示和参考图像结合成一个完成的剪辑。Omni 可以更改背景、调整手机视频的光线,并添加效果。它现在支持逐步编辑,允许用户在不重新启动的情况下调整视频。
公司在头像上设置了保护措施。每个头像与账户持有人的肖像和谷歌账户相关联。每个头像还带有一个隐形的 SynthID 水印。在某些地区,访问仍然限制在 18 岁及以上的用户。
这些限制似乎是对合成视频在其他地方失败的反应。OpenAI 的 Sora(现已停用)曾允许用户创建公共人物的视频,包括 OpenAI 首席执行官 Sam Altman。Vids 的个性化头像和对话编辑现在直接与 HeyGen、Synthesia、Captions 和 D-ID 等视频 AI 公司竞争。
Cryptopolitan 本月报道,谷歌图片正在重建为类似 Pinterest 的 “为你推荐” 画廊。它还将 AI 图像生成纳入搜索,使用其 Nano Banana 模型。
根据 Cryptopolitan 的报道,谷歌 DeepMind 首席执行官 Demis Hassabis 还呼吁成立一个由美国主导的机构来监督 AI。在此期间,出版商提起了集体诉讼。原告包括 Hachette Book Group、Cengage Learning 和 Elsevier,指控谷歌在未获许可的情况下使用版权书籍训练其 Gemini 模型。
如果你正在阅读这篇文章,你已经走在前面。通过我们的新闻通讯保持领先。
