大模型动态

Google发布Gemini Omni——首款"全能创作"多模态模型

在Google I/O 2026上,DeepMind发布了Gemini Omni,这是Google首款能从任何输入(文字、图片、视频、音频)生成任何输出内容的统一模型,首期能力聚焦视频生成。CEO Demis Hassabis称其为"世界理解与多模态编辑的跨越性进步"。这意味着Google在大模型能力上实现了真正的统一多模态架构,直接与OpenAI的GPT-4o系列在视频生成赛道正面竞争。

Google DeepMind · Twitter/X原文 ↗

· Wednesday

今日要点

Google I/O 2026重磅开幕:发布Gemini Omni多模态模型(从任何输入生成任何内容)、Gemini 3.5 Flash系列(主打实时Agent能力),以及革命性的新搜索体验"Google搜索框能做一切";Andrej Karpathy加入Anthropic引发行业热议;OpenAI推出"保底算力"(Guaranteed Capacity)新服务;NVIDIA推出Vera——首款为AI Agent设计的CPU;Mistral AI收购Emmi布局全栈AI;xAI宣布Grok可在OpenClaw中使用。Google I/O成为今天的绝对主角,多个重大发布同时发生。

大模型动态

4
  • Google发布Gemini 3.5系列——首款"结合前沿智能与真实世界行动"的模型

    Gemini 3.5 Flash首发亮相,Guodong Chen(Artificial Analysis创始人)评价其在"智能vs速度帕累托前沿"上领先所有竞品,在真实Agent任务指标上取得大幅进步。该系列的特点是模型不仅能思考还能行动,是Google从"对话AI"转向"行动AI"的战略转向。

    Google DeepMind / @ArtificialAnlys · Twitter/X原文 ↗

  • Andrej Karpathy加入Anthropic——"未来几年前沿LLM将特别具塑造力"

    前OpenAI创始成员、Tesla AI总监、前OpenAI联合创始人Andrej Karpathy在Twitter上宣布加入Anthropic。这条推文获得超过1200万次曝光和10万+点赞,创下AI行业个人职位变动信息的传播量纪录。Karpathy的加入被解读为Anthropic在前沿模型研究和AI安全领域的进一步加码。

    Andrej Karpathy · Twitter/X原文 ↗

  • OpenAI推出"Guaranteed Capacity"——企业客户可保证长期算力访问

    Sam Altman表示"客户越来越要求算力确定性",新服务允许企业锁定长期算力配额。Altman同时警告"模型越好,世界越会算力受限"。这是OpenAI应对企业客户对算力稳定性的担忧的战略举措,也暗示OpenAI对自己的算力供需预测信心十足。

    OpenAI / Sam Altman · Twitter/X原文 ↗

  • Sam Altman:ChatGPT最新更新后质量大幅提升

    Altman发推称"ChatGPT在最新更新后大幅改善,为团队感到骄傲",获得120万+曝光和1.5万+点赞。目前尚不清楚更新内容的具体细节,但暗示OpenAI在持续迭代核心产品体验,可能在响应速度、推理质量和指令遵循上有显著改进。

    Sam Altman · Twitter/X原文 ↗

AI 商业与产业

5
  • Google I/O:你可以与你的Gmail收件箱对话了

    Google在I/O 2026上展示了Gmail与Gemini的深度整合——用户可以直接用自然语言与收件箱对话、提问、查找关键邮件、甚至让AI代表你撰写回复。这是Google"搜索框能做一切"愿景的落地,将AI Agent能力直接嵌入到用户日常最核心的应用中,对工作效率的提升不可忽视。

    TechCrunch · RSS原文 ↗

  • Google搜索的未来:一个搜索框能做一切

    The Verge深度解读Google I/O 2026的核心方向——搜索不再只是找信息,而是执行任务。Google正在将搜索、Gemini、Gmail、地图、日历等所有产品整合到统一AI界面中。用户只需一个搜索框就能完成从"预订旅行"到"分析邮件"到"生成文档"的一切操作。这是Google产品史上最具雄心的整合战略。

    The Verge · RSS原文 ↗

  • Google的AI未来需要信任——以及你的个人数据

    The Verge报道Google I/O发布的"Gemini Spark"功能——Gemini将获得用户邮件、日历、位置、设备摄像头等前所未有的数据访问权限,以提供真正的个性化AI服务。这引发了关于隐私和信任的辩论:AI的智能化程度与数据授权深度正相关,Google能否让用户相信数据会得到安全使用。

    The Verge · RSS原文 ↗

  • Greg Isenberg深度拆解"36个最大创业机会"——AI、移动应用与线上到线下是三大赛道

    知名创业策略顾问Greg Isenberg将其爆款推文扩展为深度播客,提炼出当前最大的9个创业方向并逐一分析。核心建议是:AI工具化正在创造大量空白市场,但真正的机会在于AI与具体垂直行业(医疗、法律、教育)的深度结合,而非通用工具。

    Greg Isenberg · Twitter/X原文 ↗

  • Gemini将利用Volvo外部摄像头解读停车标志

    Google I/O上展示了Gemini与Volvo EX60的整合——车辆外部摄像头拍摄到的停车标志和禁停标识将被Gemini实时解读并告知驾驶员。这是AI多模态能力在车载场景的落地,标志着"AI+汽车"从娱乐信息系统向驾驶辅助能力的拓展。

    The Verge · RSS原文 ↗

AI Agent 智能体

4
  • Google I/O发布新一代AI Agent——搜索"超越标准搜索"

    TechCrunch详细报道了Google在I/O上展示的AI Agent新能力:用户可以让AI Agent自动完成多步骤任务,例如"帮我找这周所有会议中提到的行动项,并按优先级排列"。Google在Agent能力上正加速追赶,将Agent能力直接嵌入搜索是最具规模优势的打法——数十亿用户无需学习新工具即可使用AI Agent。

    TechCrunch · RSS原文 ↗

  • NVIDIA发布Vera——全球首款为AI Agent设计的CPU

    NVIDIA Vera CPU已交付给全球顶级AI实验室。Vera专为Agent工作负载设计,在推理、工具调用和多任务并行处理上有显著优化。Jensen Huang在Dell Technologies World上称"需求呈抛物线式爆发"。这标志着AI Agent基础设施从GPU单核驱动走向CPU+GPU协同优化的新阶段,也是NVIDIA从"GPU公司"向"全栈AI基础设施公司"转型的重要一步。

    NVIDIA Blog · RSS原文 ↗

  • Mistral AI收购Emmi AI——打造"领先的全栈AI"

    欧洲AI领军企业Mistral AI宣布收购Emmi AI,旨在构建从模型到应用层的完整AI栈。Mistral在开源模型和欧洲数据主权上已有独特优势,收购Emmi将进一步增强其面向企业的端到端AI能力,直接与OpenAI、Anthropic和Google抢占欧洲企业市场。

    Emmi AI · RSS原文 ↗

  • HyperWrite CEO Matt Shumer:"AI推理的潜在市场规模远超最乐观者的想象"

    Matt Shumer发推称即使是AI行业最乐观的人也在严重低估AI推理(Inference)的市场规模。随着AI Agent从实验走向生产级应用,推理算力的需求将以指数级增长,其市场规模可能远超训练算力。这对AI基础设施投资和商业模式设计有深远影响。

    Matt Shumer · Twitter/X原文 ↗

前沿观察

4
  • Elon Musk推广Cursor Composer 2.5——AI编程工具再升级

    Musk转推Cursor的Composer 2.5并称"试试!",获得738万曝光。Cursor作为AI编程助手的代表,正从"代码补全"进化为"完整应用构建"工具。Musk的背书进一步推动了AI编程工具的公众认知。

    Elon Musk · Twitter/X原文 ↗

  • xAI宣布Grok可在OpenClaw中使用——X Premium订阅用户可在Agent平台调用Grok

    xAI官方宣布,Grok和X Premium订阅功能现在可以直接在OpenClaw Agent中使用。用户可以聊天、生成图片/视频、或搜索X帖子。这是xAI在AI Agent生态的关键布局——将Grok的能力通过Agent平台触达更多开发者,也标志着类ChatGPT的封闭生态正在向Agent平台开放。

    xAI · Twitter/X原文 ↗

  • OpenAI采用Google的SynthID水印技术——为AI图像增加来源验证

    OpenAI宣布采用Google DeepMind开发的SynthID水印技术,为ChatGPT生成的所有图像添加C2PA内容凭证和不可见水印,并推出来源验证工具。Google和OpenAI在AI内容溯源标准上的合作,标志着行业正从"零散自研"走向"统一标准",这对AI生成内容的可信度和法规合规意义重大。

    OpenAI Blog · RSS原文 ↗

  • NVIDIA CEO黄仁勋:"AI需求呈抛物线式爆发"

    在Dell Technologies World上,Jensen Huang表示AI基础设施的需求正在从指数增长变为"抛物线式爆发"。他特别强调Agent化企业AI是下一波增长的核心驱动力,NVIDIA正在从"GPU提供商"演变为"Agent基础设施平台提供商"。这对所有AI行业投资决策者都是一个重要信号。

    NVIDIA Blog · RSS原文 ↗

深度阅读

3
  • The future of Google is a search box that does everything

    The Verge的深度分析:Google I/O 2026展示的核心理念是"搜索框统一一切"——Google正在将所有产品能力整合到单一AI驱动的搜索界面中。文件搜索、邮件问答、日程管理、内容生成全部在搜索框内完成,用户无需切换应用。这是Google成立以来最重大的产品战略转型,挑战了传统的App/Web产品划分模式。

    The Verge · Jay Peters原文 ↗

  • Google's AI future demands trust — and your personal data

    The Verge的另一篇重磅报道聚焦于Gemini Spark功能的隐私权衡。为了让AI真正有用,Google需要前所未有的个人数据访问权限——邮件、日历、相机、位置。报道提出核心问题:Google能否说服用户信任其数据使用方式?在AI助手普及的关键转折点,隐私与功能性的平衡将是决定胜负的关键因素。

    The Verge · Emma Roth原文 ↗

  • 从黑客少年到"铁穹"研究员——这位创始人融资2800万美元对抗AI钓鱼攻击

    TechCrunch报道了一个励志的创业故事:一位曾在少年时期被视为黑客的创始人,如今领导着一家2800万美元融资的AI安全公司。其产品被称为网络安全界的"铁穹"(Iron Dome),专门防御AI驱动的钓鱼攻击和深度伪造诈骗。随着AI生成内容的逼真度提高,传统的邮件安全方案正在失效,此轮融资反映了AI安全市场的爆发式增长。

    TechCrunch原文 ↗

KOL 观点

5
  • • Andrej Karpathy (@karpathy) — 宣布加入Anthropic,"未来几年前沿LLM将特别具塑造力" `👁 12.2M | 💬 6.2K | 🔁 7.9K | ❤️ 105.8K`

    https://x.com/karpathy/status/2056753169888334312

  • • Elon Musk (@elonmusk) — "Vera nice, Vera nice… 🤌"(回应NVIDIA Vera CPU发布) `👁 50.1M | 💬 3.5K | 🔁 6.4K | ❤️ 101.4K`

    https://x.com/elonmusk/status/2056547935752441863

  • • Google DeepMind官方 (@GoogleDeepMind) — "发布Gemini Omni,从任何输入创建任何内容" `👁 459K | 💬 167 | 🔁 730 | ❤️ 5.3K`

    https://x.com/GoogleDeepMind/status/2056786446636212467

  • • Sam Altman (@sama) — "OpenAI Guaranteed Capacity:客户需要算力确定性" `👁 415K | 💬 391 | 🔁 107 | ❤️ 2.5K`

    https://x.com/sama/status/2056827105401614656

  • • Marc Andreessen (@pmarca) — "CLICK"(发布新视频链接) `👁 233K | 💬 63 | 🔁 17 | ❤️ 1.1K`

    https://x.com/pmarca/status/2056787836246909332

← 全部日报归档