跳到正文

公司与模型

Google / Gemini 最新动态

Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。

64 条精选近 30 天 13 条共收录 92 条

更新

精选归档 · 第 2 页

8月28日周五第 21–40 条
  1. Google Research66

    Google 发布行星预测引擎 PPE,自动完成地理空间建模全流程

    Google 在 Google Earth AI 下推出实验性研究能力行星预测引擎(PPE),可由自然语言查询自主完成数据发现、特征工程、模型训练与评估,把复杂行星预测模型的构建时间从数周缩短到数分钟。

    推荐理由:原文给出 PPE 在公共卫生、粮食安全与疫情预测上的量化提升,读者可据此判断自主地理空间建模的可行边界。

8月27日周四
  1. Google DeepMind62

    Google DeepMind 试点全球首个双盲 AI 评测

    Google DeepMind 宣布推出全球首个针对专有前沿级 AI 模型的双盲评测,将外部评测限制在加密环境中,避免评测题目被模型用于后续优化。该试点与新加坡 AI Safety Institute、OpenMined、AVERI 和 MLCommons 合作,在隐私保护环境下用保密基准测试一个 Gemini Flash Lite 模型,以提升评测的可信度。

8月22日周六
  1. Google Research62

    Google Research 发布 Biomarker Discovery Framework,从可穿戴传感器数据中筛选候选生物标志物

    Google Research 提出 Biomarker Discovery Framework,一个在人类监督下把候选生物标志物优先级排序组织为迭代研究循环的多智能体系统,结合假设生成、并行统计分析、模型训练、对抗性验证与文献推理。

    推荐理由:Google Research 公开了多智能体生物标志物发现框架的完整流程与三队列评估结果,可了解 AI 辅助科研如何做统计严谨性约束。

8月21日周五
8月17日周一
8月14日周五
8月12日周三
  1. Google Research62

    Google Research:召回而非编码是前沿 LLM 事实性的瓶颈

    Google Research 提出知识画像框架,把事实状态分为编码失败、召回失败、直接召回、思考后召回和无编码推理五类,并发布含 2,150 条维基百科事实、每条配 10 个问题的 WikiProfile 基准。

    推荐理由:Google Research 用知识画像区分编码与召回失败,指出前沿模型的事实错误更多来自知识难以调用而非未存储。

  2. Google Research78

    Google Research 发布 AMIE (Video),实时视频问诊达到专家级水平

    Google Research 发布基于 Gemini 和 Project Astra 的 AMIE (Video),可在实时视频问诊中感知非语言线索、引导虚拟体格检查并同步进行诊断推理。

    推荐理由:原文给出 AMIE (Video) 的三智能体架构与随机 OSCE 研究设计,读者可据此了解实时视频临床 AI 的能力边界与验证方式。

8月6日周四
  1. Google DeepMind84

    Google DeepMind 开源 WeatherNext 气旋预报模型

    Google DeepMind 在 Nature 发表论文,称 WeatherNext AI 模型在预测气旋路径、强度和风场结构上达到 SOTA,平均多出一天预报提前量,三天预报精度相当于此前模型的两天水平。

    推荐理由:WeatherNext 把气旋路径与强度统一进单一模型并开源权重,读者可据此判断 AI 天气预报的能力边界与可用入口。

7月31日周五
7月30日周四
  1. Google DeepMind78

    Google DeepMind 发布 Gemini Robotics ER 2 具身推理模型

    Google DeepMind 发布面向机器人的具身推理模型 Gemini Robotics ER 2,可作为机器人的高层大脑,负责对话、理解物理世界并规划多步任务,再把动作执行交给底层 VLA 模型。

    推荐理由:官方给出视频理解、任务编排与多机协作的能力变化和开放入口,可据此判断机器人在真实环境中的任务完成方式。

  2. Google DeepMind62

    Google DeepMind 在 Google Flow Music 发布 Lyria 3.5 音乐生成模型

    Google DeepMind 发布音乐生成模型 Lyria 3.5,并在 Google Flow Music 中上线。官方称新版本在音乐性、歌词、人声和创作控制四方面改进:旋律结构更丰富自然,歌词质量与提示词遵循、结构感知更好,人声更具表现力和情感且发音改善,同时可更便捷地控制输出 tempo 与时长。

    推荐理由:官方给出 Lyria 3.5 在旋律、歌词、人声与创作控制上的具体改进方向,可据此判断音乐生成能力的变化。

7月28日周二
7月23日周四
  1. Google Research74

    Google Research 发布 SymptomAI:面向日常症状评估的对话式 AI 智能体

    Google Research 发布研究论文 SymptomAI,用五个不同提问策略的 Gemini Flash 2.0 智能体开展症状问诊与鉴别诊断。全国随机研究纳入 13917 名参与者,临床专家在超过 50% 的病例中更偏好 SymptomAI 给出的鉴别诊断,且认为其更准确;主动追问的智能体策略显著优于无提示的基线模型。

    推荐理由:Google Research 用 13917 人随机对照研究检验对话式症状问诊智能体,并给出与临床医生和可穿戴生物信号的对照结果。

  2. Google Research71

    Google Research 用强化学习让量子计算机从错误中学习

    Google Research 在 Nature 发表论文,提出用强化学习智能体从量子纠错检测事件中学习,在计算过程中持续调节数千个控制参数以对抗漂移。在 Willow 超导处理器上,人为注入漂移后 RL 调控使纠错码的逻辑稳定性提升 3.5 倍,在专家校准基础上进一步将逻辑错误率降低 20%。

    推荐理由:Google 用强化学习让量子纠错检测事件反过来驱动校准,读者可了解这一闭环如何把逻辑错误率压到新低。

7月22日周三
7月21日周二