跳到正文

Google / Gemini

Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。

最新精选

第 61–63 条 · 共 63 条
3月12日周四
  1. Google Research73

    Groundsource:利用 Gemini 将新闻报道转化为洪水数据

    Google Research 发布 Groundsource 方法,利用 Gemini 从全球新闻报道中提取洪水事件,构建了覆盖 150 多个国家、260 万条记录的开放数据集。方法结合 Google Read Aloud 和 Cloud Translation API 进行多语言文本提取与标准化,并通过 Gemini LLM 完成分类、时间推理和空间定位验证。

    推荐理由:该方法将非结构化新闻转化为结构化灾害数据,为全球洪水预测提供了新的数据基线。

  2. Google Research62

    Google AMIE真实门诊临床可行性研究发布

    Google Research与Beth Israel Deaconess Medical Center合作,发布了AMIE在真实门诊场景中的前瞻性单中心可行性研究。100名患者在就诊前通过安全网页链接与AMIE进行文本问诊,由医生实时监督。研究显示零安全触发事件,AMIE诊断符合率90%、top-3准确率75%,且患者和医生对其接受度良好。

    推荐理由:研究提供了AMIE在真实门诊场景中的安全性和可行性证据,为对话式医疗AI的临床落地提供了初步实证基础。

3月7日周六
  1. Google Research60

    WAXAL:非洲语言语音技术大规模开源资源

    Google Research发布WAXAL开源语音数据集,覆盖27种撒哈拉以南非洲语言、超过1亿使用者,包含约1846小时ASR转录语音和565小时TTS高质量录音,采用CC-BY-4.0许可。

    推荐理由:开源语音数据集覆盖27种撒哈拉以南非洲语言,为低资源语言语音技术提供了可复用的数据基础。