1
里程碑
7
重要更新
15
常规动态
Google DeepMind 发布 Gemini 3.7 Flash 模型
Google DeepMind 正式推出 Gemini 3.7 Flash,这是 Gemini Flash 系列的最新模型,旨在提供更高性价比和更快的推理能力。
Google DeepMind 发布手语转文字(SL2T)模型
Google DeepMind 发布手语转文字(SL2T)模型,将手语 AI 交到用户手中,为聋哑和听障用户提供新的手语识别与转换功能。
Gemini 引导学习功能在塞拉利昂的随机对照试验显示积极效果
随机对照试验结果显示 Gemini 的 Guided Learning 功能在塞拉利昂提升了学习参与度和效率。
Google 在印度推出 ATL Saathi 教育 AI 工具
Google 与 AIM 合作推出 ATL Saathi,一款基于 Gemini 的 AI 工具,赋能印度教育工作者在机器人实验室的教学。
Google DeepMind 与 Isomorphic Labs 发布生物韧性联合方案
Google DeepMind 与 Isomorphic Labs 分享其在生物韧性和 AI 模型方面的联合方案。
WeatherNext:AI 模型在气旋预测方面取得突破
Google DeepMind 的 WeatherNext AI 模型在气旋预测方面取得突破性进展。
Google 发布 Gemini Robotics 2 及 ER 2 机器人模型
Google 推出 Gemini Robotics 2 及 ER 2,为机器人赋予全身智能,并在视频理解、任务编排和多机器人协作方面实现阶跃式提升,解决现实物理交互任务。
Lyria 3.5 上线 Google Flow Music,音乐性/歌词/人声/创作控制全面升级
Google 在 Flow Music 中推出 Lyria 3.5,在音乐性、歌词、人声和创作控制方面全面提升。
Google DeepMind 与 A24 电影公司宣布研究合作
Google DeepMind 与 A24 电影公司宣布首次研究合作,可能探索 AI 在电影制作中的应用。
Google DeepMind 与英国政府合作 AI 加速住房规划决策
英国政府与 Google DeepMind 合作构建 AI 原型,旨在加速住房规划决策。
Google 向 Genesis Mission 承诺 4000 万美元 AI 算力支持
Google 承诺向 Genesis Mission 提供 4000 万美元的 AI tokens 和 credits,用于加速科学发现。
Google DeepMind 与新加坡建立国家级 AI 合作伙伴关系
Google DeepMind 与新加坡政府合作,将前沿 AI 应用于健康、教育和可持续发展等领域的复杂挑战。
Google 扩展内容来源与编辑透明度工具
Google 扩展工具帮助用户了解网页内容的创建和编辑方式,涉及内容溯源和透明度。
Gemini for Science:面向科学发现的 AI 实验与工具集
Google 发布 Gemini for Science 科学工具和实验集合,旨在提升科学探索的规模和精度。
Project Genie 结合街景实现真实世界地点模拟
Google 扩展 Project Genie 世界模型,结合街景能力实现真实地点模拟,向全球 Google AI Ultra 订阅用户开放。
Google DeepMind 发布 AI Agent 安全路线图及千万美元研究资助
Google DeepMind 发布 AI 控制路线图,结合传统安全措施和实时监控保障 Agent 系统安全,并宣布投入 1000 万美元资助多智能体安全研究计划。
DiffusionGemma:文本生成速度提升 4 倍
Google 发布 DiffusionGemma,基于扩散模型的文本生成技术,相比传统自回归方法实现 4 倍速度提升。
Gemini 3.5 Live Translate 实现流畅自然的语音翻译
Gemini 3.5 Live Translate 在 Google AI Studio、Google Translate 和 Google Meet 中提供近实时自然语音翻译能力。
Google 发布 Antigravity 2.0
Google 发布 Antigravity 2.0 新产品/能力。
Google 发布 Gemini Omni 新模型家族及 Nano Banana 2 Lite
Google 发布 Gemini Omni 新模型家族,预计为统一的下一代多模态模型。同时,Nano Banana 2 Lite(轻量级模型)和 Gemini Omni Flash(Omni 系列轻量版)已正式开放给开发者使用,进一步丰富了多模态和轻量级模型矩阵。
Google 发布 Gemma 4 12B 统一无编码器多模态开源模型
Google 发布 Gemma 4 12B,一款统一的无编码器多模态模型,以开源权重形式发布。该模型无需单独编码器即可支持文本和视觉,代表了开源多模态模型架构的重要技术趋势。
Google 发布 Gemini 3.6 Flash 及 3.5 Flash-Lite/Cyber 扩展模型
Google 发布三款新 Gemini 模型:Gemini 3.6 Flash(性能升级)、3.5 Flash-Lite(轻量版)和 3.5 Flash Cyber(网络安全专用,用于发现和修复漏洞)。此举大幅扩展了 Flash 系列产品线,覆盖从高性能推理到垂域安全的多种场景。
Google 为 Gemini 3.5 Flash 引入 Computer Use 能力
Google 为 Gemini 3.5 Flash 新增了 Computer Use 能力,使模型能够操作图形界面并代表用户完成任务,进一步增强了其在 Agent 自动化操作场景中的竞争力。