跳到正文
今天10月10日周六6 条
  1. TechCrunch AI85

    非文本AI模型Jev发布后估值达75亿美元

    TypeSafe AI开发的非文本AI模型Jev发布后迅速获得流行,并在短短几周内筹集了8.7亿美元,估值达到75亿美元。Jev基于Transformer架构,但不是大型语言模型(LLM),它输出概率而非文本,声称比LLM更快且使用更少的token。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

  2. TechCrunch AI34

    Amazon 放弃数据中心 NDA,AI 智能体想要你的信用卡

    Amazon 宣布在与地方政府谈判数据中心交易时将不再使用保密协议(NDA),此前 Microsoft 今年早些时候已采取类似举措。与此同时,一批初创公司押注消费者愿意让 AI 智能体访问自己的收件箱、文件和信用卡,前提是能让网站放行。TechCrunch Equity 播客讨论了放弃 NDA 是否会改变数据中心交易方式,以及信任为何可能是个人 AI 初创公司的真正产品。

  3. TechCrunch AI45

    人形机器人Gabe与大型语言模型:MIT研究揭示人类与AI互动的心理影响

    MIT的研究发现,人类倾向于将机器人视为人类,并与它们建立情感联系。例如,在MIT的计算机科学与人工智能实验室,研究人员与一个名为Gabe的人形机器人互动时,表现出友好的行为。此外,研究还指出,随着大型语言模型(LLMs)的普及,人们越来越容易与这些看似有感知的聊天机器人互动,这可能导致人们过度依赖AI,甚至忽视现实世界的人际关系。

10月9日周五
  1. TechCrunch AI65

    a16z 合伙人 Olivia Moore 谈消费级 AI 现状

    a16z 合伙人 Olivia Moore 本周发布消费级 AI 应用百强报告,并接受 TechCrunch 采访谈该领域现状。她认为 OpenAI 今年转向企业更像是扩张而非转型,因为目前 AI 收入几乎都来自订阅和 token 消耗,且集中在企业与专业用户侧;她更希望消费端回到广告等非订阅变现方式,而非让更多家庭自掏腰包。

  2. 量子位62

    Google 诊断 AI 聊天机器人 AMIE 研究登上《柳叶刀》主刊

    Google 与贝斯以色列女执事医疗中心(BIDMC)研究人员主导的一项研究发表于《柳叶刀》主刊,这是 Google 研究成果首次登上该刊。在 BIDMC 门诊初级保健诊所的真实临床研究中,98 名患者在急诊就诊前使用了 Google 研究级诊断 AI 聊天机器人 AMIE,医生实时监控全部交互,按预设安全标准没有任何一轮对话需要被中断。

  3. TechCrunch AI85

    Google 推出 Gemini 智能体功能,面向企业用户

    Google 在其云会议上宣布推出 Gemini 智能体功能,该功能能够回答问题并代表用户完成任务,支持连接企业内部系统,并可在 iOS、Android、Windows 和 Mac 等设备上使用。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

  4. TechCrunch AI40

    Anthropic 更新使用政策,禁止模型滥用和选举干预

    Anthropic 对其使用政策进行了更新,明确禁止了选举干预、武器软件和监控。新政策特别禁止对模型进行长时间的言语虐待,并禁止用户追求此类对话。此外,政策还禁止用户进行广泛欺骗性的活动,如使用 Claude 运行虚假账户或编造新闻机构,并包含有关不破坏民主过程的规则。

10月8日周四
10月7日周三
  1. Google Blog65

    Google发布SynthID Detector工具,助力识别AI生成内容

    Google发布SynthID Detector工具,可识别由Google或其合作伙伴(包括OpenAI、NVIDIA、Kakao和Apple)使用AI生成的图像、视频和音频文件,旨在帮助用户在线上做出更明智的决策。

    推荐理由:原文介绍了SynthID Detector工具的全球发布,读者可以了解其如何帮助识别AI生成内容,并评估其对在线媒体内容可信度的提升。

10月6日周二
10月5日周一
10月4日周日
  1. Hugging Face Blog65

    微软发布智能体评估工具 ThinkingBox

    微软与 Hugging Face 联合发布智能体评估工具 ThinkingBox,通过评估AI代理在业务流程中的表现,揭示了模型在实际应用中的可靠性和一致性。

    推荐理由:ThinkingBox 通过评估AI代理在业务流程中的表现,揭示了模型在实际应用中的可靠性和一致性,为读者提供了重要的参考价值。

10月2日周五
  1. Hugging Face Blog70

    ServiceNow 推出 AutoSynthData:为智能体生成训练数据

    ServiceNow 推出 AutoSynthData,旨在通过利用目标模型的失败和更强教师的成功来生成和验证新的训练任务,从而提高企业智能体的性能。

    推荐理由:AutoSynthData 通过将模型失败转化为训练数据,帮助企业在特定环境中训练更有效的智能体,读者可以了解其如何改变现有工作流。

10月1日周四
  1. Google DeepMind Blog85

    Gemini 4 Argon:DeepMind 推出下一代前沿智能模型

    DeepMind 发布了新的前沿模型 Gemini 4 Argon,该模型旨在通过其强大的推理能力,改变 Google 的工作和构建方式。Argon 在现实世界的软件工程、企业知识工作(如法律和金融)以及网络安全防御方面表现出前沿性能。该模型将逐步向可信的网络安全防御者推出,并计划以每百万输入令牌 2 美元和每百万输出令牌 10 美元的入门价格推出。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。