跳到正文
  1. Google DeepMind Blog85

    EmbeddingGemma 2:一个开源的轻量级多模态嵌入模型

    DeepMind 发布了 EmbeddingGemma 2,这是一个开源的多模态嵌入模型,能够将文本、图像、音频和视频组合映射到统一的嵌入空间。它基于 Gemma 4 架构,具有 7.4 亿个参数,适用于设备端推理。

    推荐理由:EmbeddingGemma 2 是一个开源的多模态嵌入模型,具有轻量级和强大的功能,适用于设备端的多模态嵌入和搜索。读者可以了解其能力变化和开放入口,从而判断它将如何改变现有工作流。

  1. OpenAI News62

    OpenAI 发布 GPT-6 模型使用指南

    OpenAI 发布 GPT-6 模型使用指南,指导初创公司如何选择 GPT-6 模型、调整推理努力、优化提示和技能、协调工具以及为生产准备工作流程。

    推荐理由:本文为 OpenAI 官方发布,提供了 GPT-6 模型选择、推理努力调整、提示和技能优化、工具协调以及生产工作流程准备等方面的指导,对了解 GPT-6 模型应用有重要参考价值。

  1. Google DeepMind Blog85

    Gemini 4 Argon:DeepMind 推出下一代前沿智能模型

    DeepMind 发布了新的前沿模型 Gemini 4 Argon,该模型旨在通过其强大的推理能力,改变 Google 的工作和构建方式。Argon 在现实世界的软件工程、企业知识工作(如法律和金融)以及网络安全防御方面表现出前沿性能。该模型将逐步向可信的网络安全防御者推出,并计划以每百万输入令牌 2 美元和每百万输出令牌 10 美元的入门价格推出。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

  1. Google DeepMind Blog70

    DeepMind 发布 Gemini 3.8 Live 带有实时虚拟形象功能

    DeepMind 发布了 Gemini 3.8 Live 带有实时虚拟形象功能,该功能通过将实时对话能力与低延迟视频流相结合,为企业及其用户提供更自然直观的对话体验。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

  1. Google DeepMind Blog85

    DeepMind 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 模型

    DeepMind 发布了 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 模型,这两个模型在实时推理和智能体任务完成方面取得了显著进步,并提供了更流畅的语音交互体验。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

  1. Google DeepMind Blog85

    DeepMind 发布 Gemini 3.8 Flash 和 3.8 Flash Cyber 模型

    DeepMind 发布了 Gemini 3.8 Flash 和 3.8 Flash Cyber 模型,分别针对软件工程、智能体任务和网络安全领域,提供更强大的推理和编码能力。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

  1. Google DeepMind Blog85

    DeepMind 推出 Gemini 智能视频理解功能

    DeepMind 推出 Gemini 智能视频理解功能,通过降低 token 消耗和成本,提高分析质量,为视频处理带来新的能力,如亚秒级时刻检索、更准确的异常检测、精确计数等。该功能现已通过 Gemini API 在 Google AI Studio 和 Gemini Enterprise Agent Platform 上提供。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

  1. Google DeepMind Blog70

    DeepMind 发布 Gemini 3.5 Transcribe 智能转录模型

    DeepMind 发布了 Gemini 3.5 Transcribe 智能转录模型,该模型旨在提供更精确和智能的实时转录功能,支持多种语言和方言,并具有自动格式化、自定义词汇识别等功能。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

  1. Google DeepMind Blog85

    DeepMind 发布 Gemini 3.7 Flash 模型

    DeepMind 发布了新的 Gemini 3.7 Flash 模型,该模型在编码和智能体领域表现出色,具有更高的代码准确性和生成生产级代码的能力。此外,该模型还提供了更好的开发者体验和更具竞争力的价格。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

  1. Google DeepMind Blog80

    Gemini Robotics ER 2:利用视频理解、任务编排和多机器人协作推动机器人技术

    DeepMind 发布了 Gemini Robotics ER 2,这是一个能够进行视频理解、任务编排和多机器人协作的机器人技术,旨在使机器人在物理世界中更加有用。该模型允许机器人与人类交流、理解物理世界并规划多步任务,同时支持机器人之间在共享空间中协作完成复杂工作流程。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

  1. Google DeepMind Blog85

    DeepMind 发布 Gemini Robotics 2,为机器人带来全身智能

    DeepMind 发布了 Gemini Robotics 2,这是一款能够为机器人提供全身智能、高级灵巧和团队协作能力的智能层。它能够使机器人通过每个动作进行推理,解锁各种任务,例如行走、蹲下、伸展和操纵物体来清理杂乱的房间。

    推荐理由:原文介绍了 Gemini Robotics 2 的能力提升和开放入口,读者可以据此判断它会如何改变现有工作流。

  1. Google DeepMind Blog85

    DeepMind 发布 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 新模型

    DeepMind 发布了新的 Gemini 模型,包括 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber,旨在提高 AI 智能体的效率、降低延迟并提高可靠性。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

  1. Google DeepMind Blog85

    DeepMind 推出 Gemini 3.5 Flash Cyber 智能安全模型

    DeepMind 推出 Gemini 3.5 Flash Cyber 智能安全模型,基于 3.5 Flash 并针对快速发现、验证和修复漏洞进行了微调,旨在提供高效、经济、可扩展的网络安全解决方案。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

已经到底了