Codex + GPT 5.5 / Agent Runtime

Codex Goes Multi-Agent, Windows Native

Codex现在可以自己管理会话、利用Windows操控电脑——AI编程从'助手'变成'自有组织'

OpenAI本周连发多个重大更新:Codex的Computer Use功能正式支持Windows平台,意味着Windows用户可以让Codex直接操控电脑,完成浏览器、文件操作、应用交互等操作。更重要的是,Codex开始能够自己管理自己的会话——创建会话、搜索会话、整理归档、置顶重要内容、还能为并行任务拉起独立的worktree。宝玉周末发现,在GPT 5.5、/goal、autoreview和crabbox等工具的组合下,AI编程任务从原来的30-60分钟扩展到4-10小时,表明AI Coding正从短期商用向持续性生产力工具迈进。

OpenAI / X | 宝玉 @dotey | Peter Steinberger @steipete原文 ↗

· 第 137 期 · Sunday · 8 min read

今日要点

1. OpenAI Codex支持Windows + 自管会话,AI编程进入'自有组织'阶段
—— Codex可以自己管理会话、创建工作树、并行处理多个任务,从编程助手升级为自主编程组织。

2. Grok Build 0.1 API公开测试,xAI加速AI编程布局
—— 马斯克称其'进展迅速',战略意图已经很清楚:这是对OpenAI Codex的直接进攻。

3. GitHub Copilot转Token计费引发开发者强烈不满
—— 计费模式改变会显著影响开发者使用习惯,也可能加速开源AI编程工具的替代。

4. Meta被曝正在开发AI悬挂饰品
—— 这是一款可穿戴AI设备,标志着社交巨头在'下一代人机交互'赛道上的加码。

头条

4
  • Google Gemini Spark实测:24/7 AI助手'真的很有用'

    TechCrunch实测显示,这款能长时间连续工作的AI助手在实际任务中表现出真实的生产力价值。能够24/7在线体验也许是云端AI助手的一个关键差异化点。

    TechCrunch原文 ↗

  • Franklin:自己花钱办事的AI Agent

    BlockRunAI发布的Agent能自主消耗USDC来完成真实任务。这意味着Agent不仅能思考和行动,还能'花钱'——这是AI Agent授权的重要一步。

    GitHub Trending原文 ↗

  • GitHub Copilot转Token计费,开发者强烈不满

    'What a joke'——开发者对Copilot新的代码计费模式广泛不满。这一变动可能会重塑AI编程工具市场的竞争格局,加速开源替代方案的崛起。

    TechCrunch原文 ↗

  • Grok Build 0.1 API公开测试,直接对标Codex

    xAI的Grok Build正式面向公众开放API,这是和Codex同一个维度的AI编程工具。马斯克在社交媒体上多次强调'Grok Build进展迅速',战略意图已经很清楚。

    xAI / X | @elonmusk原文 ↗

大模型动态

Models & Labs5
  • OpenAI启动Rosalind Biodefense,AI生物安全布局

    专注于加速生物领域的防御性进展,帮助可信的生物研究者植入AI防御。这是OpenAI在AI安全和生物技术交叉领域的战略性布局。

    OpenAI / X

  • 多家大模型系统提示词被大规模泄露

    GitHub项目asgeirtj/system_prompts_leaks提取了Anthropic Opus 4.7/4.6、Sonnet 4.6、OpenAI ChatGPT 5.5、Google Gemini 3.5等多个版本的详细系统提示词,引发行业对AI安全的关注。24小时内获得40K+ Star。

    GitHub Trending

  • 宝玉:大家说Codex明天会重置额度

    中文AI圈一线KOL观察到,Codex使用额度可能快速耗尽,用户已经开始期待额度重置。这反映了AI编程工具的真实使用强度正在攀升。

    X | @dotey

  • Greg Isenberg:Claude Opus 4.8没有意义上好于GPT 5.5

    起底评测显示,截至5月29日,各大模型之间的差距正在缩小,作为商业决策者应更关注应用而非基础模型的轮流展示。

    X | @gregisenberg

  • Clement Delangue:大多数RL训练代理LLM的团队都有隐藏bug

    Hugging Face CEO指出,目前用强化学习训练Agent型大模型的团队中,大多数的训练回路'安静地坏掉了'而当事人并不知道。这是一个值得关注的行业技术风险。

    X | @ClementDelangue

AI 智能体

Agents5
  • GenericAgent:自我进化的AI智能体熔炉

    这个12K+ Star的项目从仅3,300行的种子代码开始,自主生长出完整技能树,实现系统全控制,而且仅消耗1/6的Token。这对AI Agent的自我进化方向有重大商业启示。

    GitHub Trending

  • Cherry Studio:300+属性的AI生产力工具矩阵

    支持多个前沿LLM统一访问、智能对话、自主代理,46K+ Star。对于想要统一管理多个AI服务的企业,这是一个值得关注的工具化方案。

    GitHub Trending

  • Peter Steinberger:Codex任务从30min扩展到多个小时

    OpenClaw创始人发现在GPT 5.5环境下,AI编程任务的复杂度和持续时间重大增长。他认为Codex已经可以信赖地完成更大的任务,这对AI代码生产力的商业价值证明至关重要。

    X | @steipete

  • OpenClaw v2026.5.28发布

    OpenClaw最新版本发布。持续的版本迭代反映了AI Agent平台的快速进化。这是观察AI Agent生态发展的重要风向标。

    OpenClaw GitHub

  • Skales:本地优先的AI桌面代理支持全平台

    支持Windows/macOS/Linux/Android的本地优先AI桌面Agent,集成代码工作、多代理团队和桌面自动化。'本地优先'这个角度对云端Agent服务可能是一个差异化竞争点。

    GitHub Trending

行业与投融资

Business & Policy5
  • Meta被曝开发AI悬挂饰品,穿戴AI战争加温

    据TechCrunch报道,社交巨头正在开发一款可穿戴AI设备。穿戴式AI可能是下一代人机交互的重要入口,值得重点关注。

    TechCrunch

  • Marc Andreessen:法律AI能赋权普通人对抗大机构

    a16z联合创始人表示,AI正在'超赋权'没有法律背景的普通个体,让他们能够在官僚机构和法院中对抗大机构。这是AI在法律服务商业化方向的重要观察。

    X | @pmarca

  • AI Grifters利用AI剪辑制作伪黑人影像推销Shein

    The Verge报道显示,AI正被用于制作伪黑人影像在TikTok上促销低价商品。这是AI生成内容在线上营销领域面临的新伦理挑战。

    The Verge

  • Azeem Azhar直播:AI vs ROI,投资回报真实情况

    Exponential View主理人Azeem Azhar主持了一场直播讨论AI的投资回报问题。对于行业决策者,这是一个必看的视角。

    Exponential View

  • SoftBank计划750亿欧元投资法国AI数据中心

    孙正义的软银正在加速全球AI基础设施投资。法国AI数据中心项目规模巨大,这将对欧洲AI产业格局产生深远影响。

    Bloomberg

前沿观察

4
  • EvoMap/evolver:基于GEP的自进化引擎

    可审计的Agent进化框架,通过'基因'、'胶囊'、'事件'的概念实现可追踪的进化。这将AI智能体的进化提升到了可审计、可解释的程度,对企业应用至关重要。

    GitHub Trending原文 ↗

  • 系统提示词泄露图谱揭示的行业风险

    GitHub上一项目集中展示了Anthropic Opus 4.7/4.6、Sonnet 4.6、OpenAI ChatGPT 5.5、Codex、Google Gemini 3.5等多个模型的系统提示词。这对于企业的AI安全策略有警示意义。

    GitHub Trending原文 ↗

  • EY加拿大网络安全报告大量引用为AI编造

    GPTZero调查发现,EY加拿大发布的一份网络安全报告中,大部分引用是AI编造的。这对专业服务行业使用AI的风险提出了严肃警告。

    Hacker News原文 ↗

  • 'Domain expertise has always been the real moat'

    Hacker News热门文章认为,领域专业知识一直是真正的护城河——在AI时代尤其如此。这为企业应对AI冲击提供了战略性思考框架。

    Hacker News原文 ↗

深度阅读

3
  • Domain expertise has always been the real moat

    作者认为在AI时代,真正的竞争优势不是技术本身,而是深厚的领域知识和行业洞察。这是一篇值得企业管理层深入阅读的战略思考文章。

    brethorsting.com原文 ↗

  • What prediction markets actually know

    a16z Crypto撰文分析预测市场的真实信息价值。对关注AI和科技趋势的决策者有重要参考意义。

    a16z Crypto原文 ↗

  • How one founder's bet on 'the old school web' is paying off

    The Verge报道了一位创始人坚持'老派网络'理念并取得商业成功的故事。在AI狂潮中,这是一个值得倾听的逆向思考案例。

    The Verge原文 ↗

KOL 观点

7
  • @elonmuskxAI / SpaceX / Tesla CEO

    Grok Build进展迅速。API版本0.1已公开测试,直接对标Codex。马斯克正在加速xAI在AI编程工具领域的布局。

  • @steipeteOpenClaw创始人

    GPT 5.5 + Codex的组合让AI编程任务从30分钟扩展到4-10小时。他认为Codex已经可以信赖地完成更大任务,这对生产力价值是重要验证。

  • @pmarcaa16z联合创始人

    法律AI正在超赋权普通个体对抗大机构。数条推文表达了对AI赋能个体权利的乐观预期。

  • @dotey (宝玉)中文AI圈KOL

    关注Codex新版特性:会话管理、并行worktree、Token用量显示等。推测明天重置额度,反映了AI编程工具的实际使用强度。

  • @gregisenbergAI创业ideas之王

    明确认为Claude Opus 4.8没有意义上好于GPT 5.5。关注实际应用而非模型测评成绩——一个值得重视的视角。

  • @op7418 (歸藏)中文AI活跃KOL

    自己的Skill登上GitHub本周新建项目Star排名第一。关注AI产品/工具生态发展。

  • @ClementDelangueHugging Face CEO

    指出大多数用RL训练Agent型LLM的团队都有'安静的错误'——训练循环有隐藏bug而团队不自知。这是一个重要的行业技术风险提示。

← 全部日报归档