跳到正文
  1. TechCrunch AI85

    非文本AI模型Jev发布后估值达75亿美元

    TypeSafe AI开发的非文本AI模型Jev发布后迅速获得流行,并在短短几周内筹集了8.7亿美元,估值达到75亿美元。Jev基于Transformer架构,但不是大型语言模型(LLM),它输出概率而非文本,声称比LLM更快且使用更少的token。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

  1. Hugging Face Blog65

    AI基础设施团队发布GPU集群调度器新功能

    AI基础设施团队发布了新的GPU集群调度器,通过引入GPU时间预算、分层公平共享分配和时间切片合同等功能,优化了资源分配和提升了工作效率。

    推荐理由:原文介绍了GPU集群调度器的新功能,读者可以了解如何优化资源分配和提升工作效率。

  2. 量子位80

    联想天禧发布智能体TianxiCode登顶SWE-bench-Live全球第一

    联想天禧AI自主研发的代码智能体框架TianxiCode在SWE-bench-Live评测中取得全球第一,展示了其在复杂软件工程竞技场上的实力,未来将应用于联想AI硬件产品中。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

  3. TechCrunch AI85

    Google 推出 Gemini 智能体功能,面向企业用户

    Google 在其云会议上宣布推出 Gemini 智能体功能,该功能能够回答问题并代表用户完成任务,支持连接企业内部系统,并可在 iOS、Android、Windows 和 Mac 等设备上使用。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

  1. OpenAI News70

    OpenAI 打击 AI 辅助虚假宣传操作

    OpenAI 官方报道,成功打击了两个利用 AI 进行虚假宣传的操作,涉及虚假记者和智库。

    推荐理由:OpenAI 官方报道,揭示了利用 AI 进行虚假宣传的操作,对了解当前 AI 领域的挑战和风险有重要意义。

  2. Hugging Face Blog72

    使用 ML-Intern 创建模型:从无到有的过程

    作者介绍了如何使用 Hugging Face 的 ML-Intern 工具创建模型,包括从构思到实现的整个过程,并分享了几个实际案例。

    推荐理由:作者通过实际操作展示了如何使用 ML-Intern 创建模型,为读者提供了可借鉴的实践案例。

  1. Google Blog65

    Google发布SynthID Detector工具,助力识别AI生成内容

    Google发布SynthID Detector工具,可识别由Google或其合作伙伴(包括OpenAI、NVIDIA、Kakao和Apple)使用AI生成的图像、视频和音频文件,旨在帮助用户在线上做出更明智的决策。

    推荐理由:原文介绍了SynthID Detector工具的全球发布,读者可以了解其如何帮助识别AI生成内容,并评估其对在线媒体内容可信度的提升。

  2. OpenAI News62

    Atlassian 与 OpenAI 扩展合作,将企业知识转化为行动

    Atlassian 与 OpenAI 合作扩展,旨在将前沿模型与企业知识结合,以帮助团队更有效地规划、构建和交付工作。

    推荐理由:OpenAI 与 Atlassian 的合作扩展,将前沿模型与企业知识相结合,有助于团队规划、构建和交付工作。

  1. Hugging Face Blog65

    微软发布智能体评估工具 ThinkingBox

    微软与 Hugging Face 联合发布智能体评估工具 ThinkingBox,通过评估AI代理在业务流程中的表现,揭示了模型在实际应用中的可靠性和一致性。

    推荐理由:ThinkingBox 通过评估AI代理在业务流程中的表现,揭示了模型在实际应用中的可靠性和一致性,为读者提供了重要的参考价值。

  1. Hugging Face Blog70

    ServiceNow 推出 AutoSynthData:为智能体生成训练数据

    ServiceNow 推出 AutoSynthData,旨在通过利用目标模型的失败和更强教师的成功来生成和验证新的训练任务,从而提高企业智能体的性能。

    推荐理由:AutoSynthData 通过将模型失败转化为训练数据,帮助企业在特定环境中训练更有效的智能体,读者可以了解其如何改变现有工作流。

  1. Google DeepMind Blog85

    Gemini 4 Argon:DeepMind 推出下一代前沿智能模型

    DeepMind 发布了新的前沿模型 Gemini 4 Argon,该模型旨在通过其强大的推理能力,改变 Google 的工作和构建方式。Argon 在现实世界的软件工程、企业知识工作(如法律和金融)以及网络安全防御方面表现出前沿性能。该模型将逐步向可信的网络安全防御者推出,并计划以每百万输入令牌 2 美元和每百万输出令牌 10 美元的入门价格推出。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

  1. OpenAI News67

    OpenAI 打击模型蒸馏协同行动

    OpenAI 打击了一场针对提取受保护模型推理的协同行动,并加强了对抗性蒸馏防御。

    推荐理由:OpenAI 打击了一场针对提取受保护模型推理的协同行动,读者可以关注其加强对抗性蒸馏防御的努力。

  1. Hugging Face Blog65

    ProvenanceGuard:基于MCP的LLM智能体源意识事实性验证

    Hugging Face提出了一种名为ProvenanceGuard的源意识事实性验证方法,用于提高基于MCP的LLM智能体的答案准确性。

    推荐理由:原文提出了针对MCP智能体的源意识验证方法,有助于提高事实性验证的准确性。

  2. OpenAI News72

    OpenAI DevDay 2026 回顾

    OpenAI 在 DevDay 2026 上发布了超过 20 项公告,包括 GPT-6 Astra、ChatGPT、Codex、APIs、安全工具和面向开发者的新工具。

    推荐理由:OpenAI 在 DevDay 2026 上发布了多项重要公告,包括 GPT-6 Astra、ChatGPT、Codex、APIs、安全工具和面向开发者的新工具,读者可以关注这些新功能对行业的影响。

  3. FT中文网85

    SpaceX星舰火箭首次成功进入轨道

    SpaceX星舰火箭成功进入轨道,对于马斯克实现航天目标具有重要意义。

    推荐理由:SpaceX星舰火箭首次成功进入轨道,标志着人类航天事业的重要里程碑。

  1. Google DeepMind Blog70

    DeepMind 发布 Gemini 3.8 Live 带有实时虚拟形象功能

    DeepMind 发布了 Gemini 3.8 Live 带有实时虚拟形象功能,该功能通过将实时对话能力与低延迟视频流相结合,为企业及其用户提供更自然直观的对话体验。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

  1. Hugging Face Blog70

    英国人工智能安全研究所和 EvalEval 如何使基准结果可重复

    英国人工智能安全研究所(AISI)正在使用 EvalEval 的基础设施公开分享评估结果,支持可重复和可验证的评估科学。AISI 和 EvalEval 合作发布了五个基准的验证结果,并提供了评估方法和发现的相关信息。

    推荐理由:EvalEval 和 UK AI Security Institute 的合作推动了可重复和可验证的评估科学,为元研究和政策分析提供了更可靠的参考点。

  1. Google DeepMind Blog85

    DeepMind 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 模型

    DeepMind 发布了 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 模型,这两个模型在实时推理和智能体任务完成方面取得了显著进步,并提供了更流畅的语音交互体验。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

  2. Hugging Face Blog67

    Hugging Face 推出智能体一致性分析工具

    Hugging Face 推出了一种名为 Consistency Analyzer 的工具,用于分析智能体的可靠性问题,并提出了解决方案。

    推荐理由:原文介绍了如何通过一致性指南来提高智能体的可靠性,读者可以了解这一方法并应用于自己的工作流。