GoogleAI
近期帖子
以下是本周发布的内容: — Gemini 3.5 Live Translate,我们最新的音频模型,用于实时语音到语音翻译 — @NotebookLM 获得重大升级,包括聊天中的 agentic 能力、更先进的推理,以及一套全新的输出格式 — 来自 @GoogleLabs 的 Project Genie 现已面向全球 Google AI Ultra 5x 订阅用户开放 — @GeminiApp 中的 Notebooks 现已在欧洲经济区、英国和瑞士上线 — DiffusionGemma,我们最新的实验性开源 @googlegemma 模型,探索文本扩散——一种极快的文本生成方法
今天,我们发布了 Gemini 3.5 Live Translate,这是我们用于实时语音到语音翻译的最新音频模型。 它支持超过70种语言,并在你开口的那一刻就开始翻译,一边聆听你接下来要说的内容,一边流式输出翻译。没有尴尬的停顿或断断续续的音频,只有跨越语言障碍的真正连接。 那么,它是如何运作的呢?🤔 该模型能够在瞬息之间做出决策,在速度与翻译质量之间灵活权衡,让对话真正流畅、富有人情味且自然。为此,模型必须在接收并理解输入内容的同时,输出翻译后的语音。 通过这一过程,Gemini 3.5 Live Translate 能够仅落后于每位说话者几秒钟,甚至能在长时间的会话中保持节奏、音…
阅读博客了解更多: https://t.co/vmrrdu7lwt
以下是本周的发布回顾 👇 — Nano Banana 2 与 Nano Banana Pro 现已正式发布(GA),可通过 Gemini Enterprise Agent Platform、Gemini API 以及 @GoogleAIStudio 使用 — Co-Scientist,我们用于结构化科学思维的全新多智能体系统,可生成并完善新颖假设以解决复杂科学问题 — 来自 @GoogleLabs 的 dreambeans 会在夜间工作,基于你连接的 Google 应用,为你策划个性化的每日主题合集 — @GoogleGemma 4 12B,我们的统一无编码器模型,将强大的多模态智能直…
阅读更多关于我们今年用 AI 让 I/O 活动栩栩如生的各种有趣方式: https://t.co/jE7rLCVnfs