跳到正文
10月7日周三
  1. Google DeepMind Blog85

    EmbeddingGemma 2:一个开源的轻量级多模态嵌入模型

    DeepMind 发布了 EmbeddingGemma 2,这是一个开源的多模态嵌入模型,能够将文本、图像、音频和视频组合映射到统一的嵌入空间。它基于 Gemma 4 架构,具有 7.4 亿个参数,适用于设备端推理。

    推荐理由:EmbeddingGemma 2 是一个开源的多模态嵌入模型,具有轻量级和强大的功能,适用于设备端的多模态嵌入和搜索。读者可以了解其能力变化和开放入口,从而判断它将如何改变现有工作流。

10月1日周四
  1. Google DeepMind Blog85

    Gemini 4 Argon:DeepMind 推出下一代前沿智能模型

    DeepMind 发布了新的前沿模型 Gemini 4 Argon,该模型旨在通过其强大的推理能力,改变 Google 的工作和构建方式。Argon 在现实世界的软件工程、企业知识工作(如法律和金融)以及网络安全防御方面表现出前沿性能。该模型将逐步向可信的网络安全防御者推出,并计划以每百万输入令牌 2 美元和每百万输出令牌 10 美元的入门价格推出。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

9月30日周三
  1. Google DeepMind Blog72

    DeepMind 推出 SynthID Bio:为合成生物学引入水印技术

    DeepMind 推出 SynthID Bio,一种水印技术,用于合成生物学,以增强生物安全和科学诚信。该技术将不可察觉的签名嵌入到生物代码中,确保水印在数字模型和合成的物理蛋白质上都是可验证的,同时保持其生物功能。

    推荐理由:SynthID Bio 是 DeepMind 开发的一种生物安全工具,通过在 AI 生成的蛋白质中嵌入不可察觉的签名,以增强生物安全和科学诚信。读者可以了解其工作原理和应用场景,以及它如何帮助解决生物安全挑战。

9月25日周五
9月24日周四
9月23日周三
9月16日周三
  1. Google DeepMind Blog85

    DeepMind 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 模型

    DeepMind 发布了 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 模型,这两个模型在实时推理和智能体任务完成方面取得了显著进步,并提供了更流畅的语音交互体验。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

9月8日周二
  1. Google DeepMind Blog85

    DeepMind 发布 AlphaGenome Atlas:人类基因组所有可能的 DNA 变异的预测图

    DeepMind 发布了 AlphaGenome Atlas,一个包含 90 亿个单核苷酸变异预测的平台,旨在帮助研究人员更好地理解基因变异对生物学的影响。

    推荐理由:AlphaGenome Atlas 提供了关于人类基因组中所有可能的 DNA 变异的预测,有助于加速我们对生物学的理解,并为研究人员提供了强大的工具来探索基因组数据。

9月3日周四
  1. Google DeepMind Blog85

    DeepMind 发布 WeatherNext 3:最先进和精确的全球天气 AI 模型

    DeepMind 发布了 WeatherNext 3,这是一个最先进和精确的全球天气 AI 模型,它集成了实时卫星数据、每小时刷新、更高分辨率、精确降水预测和清洁能源变量。

    推荐理由:WeatherNext 3 模型在精度和分辨率上取得了显著提升,为全球天气预报提供了更准确的数据,对农业、能源等领域有重要影响。

  2. Google DeepMind Blog72

    DeepMind 发布 Fairwind Program,为政府和企业提供主动网络安全防御

    DeepMind 推出 Fairwind Program,为政府和企业提供先进的网络安全防御能力,包括 Gemini 3.8 Flash Cyber 模型和 CodeMender 工具,以帮助防御者自动发现和修复漏洞。

    推荐理由:DeepMind 发布了 Fairwind Program,为政府和企业提供先进的网络安全防御能力,有助于提升网络安全水平。

9月2日周三
  1. Google DeepMind Blog85

    DeepMind 推出 Gemini 智能视频理解功能

    DeepMind 推出 Gemini 智能视频理解功能,通过降低 token 消耗和成本,提高分析质量,为视频处理带来新的能力,如亚秒级时刻检索、更准确的异常检测、精确计数等。该功能现已通过 Gemini API 在 Google AI Studio 和 Gemini Enterprise Agent Platform 上提供。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

8月28日周五
  1. Google DeepMind Blog65

    Gemini Omni 1.1 Flash发布,提供更多创作控制能力

    Google DeepMind发布Gemini Omni 1.1 Flash,新增场景扩展、首尾帧插值、4K升级、快速原型制作等功能,支持开发者构建更可控、迭代更快、适合实际部署的生成式视频。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

8月27日周四
  1. Google DeepMind Blog70

    DeepMind 首次进行双盲AI评估测试

    DeepMind 与多家机构合作,对Gemini Flash Lite模型进行双盲评估,以增强评估的完整性。

    推荐理由:原文介绍了首次双盲AI评估方法,读者可以了解其对AI模型评估的影响。

8月21日周五
  1. Google DeepMind Blog85

    DeepMind:基于15年游戏AI研究,从Atari到EVE Online

    DeepMind分享了其在游戏AI研究方面的15年成果,包括从Atari到StarCraft的突破,以及最新的SIMA项目,探讨了游戏AI在理解智能、解决现实世界问题方面的潜力。

    推荐理由:DeepMind分享了其在游戏AI研究方面的15年成果,并探讨了未来研究方向,对游戏AI领域有重要意义。

8月14日周五
  1. Google DeepMind Blog85

    DeepMind 发布 Gemini 3.7 Flash 模型

    DeepMind 发布了新的 Gemini 3.7 Flash 模型,该模型在编码和智能体领域表现出色,具有更高的代码准确性和生成生产级代码的能力。此外,该模型还提供了更好的开发者体验和更具竞争力的价格。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

8月12日周三
  1. Google DeepMind Blog85

    DeepMind 推出手语 AI 功能

    DeepMind 推出新的手语到文本翻译模型 SL2T,为听障和听力受损用户提供手语功能,支持 Gboard 和 Pixel 11 上的实时转录。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

8月6日周四
7月30日周四
  1. Google DeepMind Blog80

    Gemini Robotics ER 2:利用视频理解、任务编排和多机器人协作推动机器人技术

    DeepMind 发布了 Gemini Robotics ER 2,这是一个能够进行视频理解、任务编排和多机器人协作的机器人技术,旨在使机器人在物理世界中更加有用。该模型允许机器人与人类交流、理解物理世界并规划多步任务,同时支持机器人之间在共享空间中协作完成复杂工作流程。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

7月28日周二
  1. Google DeepMind Blog85

    DeepMind 发布 Gemini Robotics 2,为机器人带来全身智能

    DeepMind 发布了 Gemini Robotics 2,这是一款能够为机器人提供全身智能、高级灵巧和团队协作能力的智能层。它能够使机器人通过每个动作进行推理,解锁各种任务,例如行走、蹲下、伸展和操纵物体来清理杂乱的房间。

    推荐理由:原文介绍了 Gemini Robotics 2 的能力提升和开放入口,读者可以据此判断它会如何改变现有工作流。

7月22日周三
7月21日周二
7月17日周五
7月16日周四
  1. Google DeepMind Blog70

    DeepMind 和 Isomorphic Labs 共同探索生物韧性方法

    DeepMind 和 Isomorphic Labs 合作,通过预防、检测和应对三个关键领域,利用 AI 技术提高社会对传染病和未来疫情的应对能力。

    推荐理由:DeepMind 和 Isomorphic Labs 共同分享了对生物韧性的方法,通过合作和先进技术来提高社会对传染病和未来疫情的应对能力。

7月13日周一
  1. Google DeepMind Blog40

    ATL Saathi:Gemini赋能印度创新教育

    Google DeepMind推出Gemini驱动的ATL Saathi,为印度超过1100万学生提供3D打印、物联网和机器人技术等新技术的访问,并利用AI进行高质量导师制的扩展。该应用提供24/7规划与培训助手,支持多语言访问,旨在减轻教师行政负担,提高教学效率。

7月3日周五
7月1日周三
  1. Google DeepMind Blog72

    DeepMind 发布 Nano Banana 2 Lite 和 Gemini Omni Flash

    DeepMind 发布了 Nano Banana 2 Lite 和 Gemini Omni Flash,两款模型分别针对图像生成和视频编辑,旨在提高开发者的工作效率和创作能力。Nano Banana 2 Lite 是一款快速且成本效益高的图像模型,而 Gemini Omni Flash 则是一款高质量的视频生成和对话式编辑模型。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

6月25日周四
  1. Google DeepMind Blog67

    DeepMind 发布 Gemini 3.5 Flash 中的计算机使用功能

    DeepMind 发布了 Gemini 3.5 Flash,其中集成了计算机使用功能,允许开发者构建跨平台交互的智能体。该功能之前作为独立模型存在,现在已集成到主模型中,支持长期和自动化任务。DeepMind 还提供了安全措施,包括对抗性训练和可选的企业级安全系统。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。