Codex + GPT 5.5 / Agent Runtime
Codex Goes Multi-Agent, Windows Native
Codex现在可以自己管理会话、利用Windows操控电脑——AI编程从'助手'变成'自有组织'
OpenAI本周连发多个重大更新:Codex的Computer Use功能正式支持Windows平台,意味着Windows用户可以让Codex直接操控电脑,完成浏览器、文件操作、应用交互等操作。更重要的是,Codex开始能够自己管理自己的会话——创建会话、搜索会话、整理归档、置顶重要内容、还能为并行任务拉起独立的worktree。宝玉周末发现,在GPT 5.5、/goal、autoreview和crabbox等工具的组合下,AI编程任务从原来的30-60分钟扩展到4-10小时,表明AI Coding正从短期商用向持续性生产力工具迈进。
OpenAI / X | 宝玉 @dotey | Peter Steinberger @steipete原文 ↗
· 第 137 期 · Sunday · 8 min read
今日要点
—— Codex可以自己管理会话、创建工作树、并行处理多个任务,从编程助手升级为自主编程组织。
2. Grok Build 0.1 API公开测试,xAI加速AI编程布局
—— 马斯克称其'进展迅速',战略意图已经很清楚:这是对OpenAI Codex的直接进攻。
3. GitHub Copilot转Token计费引发开发者强烈不满
—— 计费模式改变会显著影响开发者使用习惯,也可能加速开源AI编程工具的替代。
4. Meta被曝正在开发AI悬挂饰品
—— 这是一款可穿戴AI设备,标志着社交巨头在'下一代人机交互'赛道上的加码。
头条
4Google Gemini Spark实测:24/7 AI助手'真的很有用'
TechCrunch实测显示,这款能长时间连续工作的AI助手在实际任务中表现出真实的生产力价值。能够24/7在线体验也许是云端AI助手的一个关键差异化点。
TechCrunch原文 ↗
Franklin:自己花钱办事的AI Agent
BlockRunAI发布的Agent能自主消耗USDC来完成真实任务。这意味着Agent不仅能思考和行动,还能'花钱'——这是AI Agent授权的重要一步。
GitHub Trending原文 ↗
GitHub Copilot转Token计费,开发者强烈不满
'What a joke'——开发者对Copilot新的代码计费模式广泛不满。这一变动可能会重塑AI编程工具市场的竞争格局,加速开源替代方案的崛起。
TechCrunch原文 ↗
Grok Build 0.1 API公开测试,直接对标Codex
xAI的Grok Build正式面向公众开放API,这是和Codex同一个维度的AI编程工具。马斯克在社交媒体上多次强调'Grok Build进展迅速',战略意图已经很清楚。
xAI / X | @elonmusk原文 ↗
大模型动态
Models & Labs5OpenAI启动Rosalind Biodefense,AI生物安全布局
专注于加速生物领域的防御性进展,帮助可信的生物研究者植入AI防御。这是OpenAI在AI安全和生物技术交叉领域的战略性布局。
OpenAI / X
多家大模型系统提示词被大规模泄露
GitHub项目asgeirtj/system_prompts_leaks提取了Anthropic Opus 4.7/4.6、Sonnet 4.6、OpenAI ChatGPT 5.5、Google Gemini 3.5等多个版本的详细系统提示词,引发行业对AI安全的关注。24小时内获得40K+ Star。
GitHub Trending
宝玉:大家说Codex明天会重置额度
中文AI圈一线KOL观察到,Codex使用额度可能快速耗尽,用户已经开始期待额度重置。这反映了AI编程工具的真实使用强度正在攀升。
X | @dotey
Greg Isenberg:Claude Opus 4.8没有意义上好于GPT 5.5
起底评测显示,截至5月29日,各大模型之间的差距正在缩小,作为商业决策者应更关注应用而非基础模型的轮流展示。
X | @gregisenberg
Clement Delangue:大多数RL训练代理LLM的团队都有隐藏bug
Hugging Face CEO指出,目前用强化学习训练Agent型大模型的团队中,大多数的训练回路'安静地坏掉了'而当事人并不知道。这是一个值得关注的行业技术风险。
X | @ClementDelangue
AI 智能体
Agents5GenericAgent:自我进化的AI智能体熔炉
这个12K+ Star的项目从仅3,300行的种子代码开始,自主生长出完整技能树,实现系统全控制,而且仅消耗1/6的Token。这对AI Agent的自我进化方向有重大商业启示。
GitHub Trending
Cherry Studio:300+属性的AI生产力工具矩阵
支持多个前沿LLM统一访问、智能对话、自主代理,46K+ Star。对于想要统一管理多个AI服务的企业,这是一个值得关注的工具化方案。
GitHub Trending
Peter Steinberger:Codex任务从30min扩展到多个小时
OpenClaw创始人发现在GPT 5.5环境下,AI编程任务的复杂度和持续时间重大增长。他认为Codex已经可以信赖地完成更大的任务,这对AI代码生产力的商业价值证明至关重要。
X | @steipete
OpenClaw v2026.5.28发布
OpenClaw最新版本发布。持续的版本迭代反映了AI Agent平台的快速进化。这是观察AI Agent生态发展的重要风向标。
OpenClaw GitHub
Skales:本地优先的AI桌面代理支持全平台
支持Windows/macOS/Linux/Android的本地优先AI桌面Agent,集成代码工作、多代理团队和桌面自动化。'本地优先'这个角度对云端Agent服务可能是一个差异化竞争点。
GitHub Trending
行业与投融资
Business & Policy5Meta被曝开发AI悬挂饰品,穿戴AI战争加温
据TechCrunch报道,社交巨头正在开发一款可穿戴AI设备。穿戴式AI可能是下一代人机交互的重要入口,值得重点关注。
TechCrunch
Marc Andreessen:法律AI能赋权普通人对抗大机构
a16z联合创始人表示,AI正在'超赋权'没有法律背景的普通个体,让他们能够在官僚机构和法院中对抗大机构。这是AI在法律服务商业化方向的重要观察。
X | @pmarca
AI Grifters利用AI剪辑制作伪黑人影像推销Shein
The Verge报道显示,AI正被用于制作伪黑人影像在TikTok上促销低价商品。这是AI生成内容在线上营销领域面临的新伦理挑战。
The Verge
Azeem Azhar直播:AI vs ROI,投资回报真实情况
Exponential View主理人Azeem Azhar主持了一场直播讨论AI的投资回报问题。对于行业决策者,这是一个必看的视角。
Exponential View
SoftBank计划750亿欧元投资法国AI数据中心
孙正义的软银正在加速全球AI基础设施投资。法国AI数据中心项目规模巨大,这将对欧洲AI产业格局产生深远影响。
Bloomberg
前沿观察
4EvoMap/evolver:基于GEP的自进化引擎
可审计的Agent进化框架,通过'基因'、'胶囊'、'事件'的概念实现可追踪的进化。这将AI智能体的进化提升到了可审计、可解释的程度,对企业应用至关重要。
GitHub Trending原文 ↗
系统提示词泄露图谱揭示的行业风险
GitHub上一项目集中展示了Anthropic Opus 4.7/4.6、Sonnet 4.6、OpenAI ChatGPT 5.5、Codex、Google Gemini 3.5等多个模型的系统提示词。这对于企业的AI安全策略有警示意义。
GitHub Trending原文 ↗
EY加拿大网络安全报告大量引用为AI编造
GPTZero调查发现,EY加拿大发布的一份网络安全报告中,大部分引用是AI编造的。这对专业服务行业使用AI的风险提出了严肃警告。
Hacker News原文 ↗
'Domain expertise has always been the real moat'
Hacker News热门文章认为,领域专业知识一直是真正的护城河——在AI时代尤其如此。这为企业应对AI冲击提供了战略性思考框架。
Hacker News原文 ↗
深度阅读
3Domain expertise has always been the real moat
作者认为在AI时代,真正的竞争优势不是技术本身,而是深厚的领域知识和行业洞察。这是一篇值得企业管理层深入阅读的战略思考文章。
brethorsting.com原文 ↗
What prediction markets actually know
a16z Crypto撰文分析预测市场的真实信息价值。对关注AI和科技趋势的决策者有重要参考意义。
a16z Crypto原文 ↗
How one founder's bet on 'the old school web' is paying off
The Verge报道了一位创始人坚持'老派网络'理念并取得商业成功的故事。在AI狂潮中,这是一个值得倾听的逆向思考案例。
The Verge原文 ↗
KOL 观点
7@elonmuskxAI / SpaceX / Tesla CEO
Grok Build进展迅速。API版本0.1已公开测试,直接对标Codex。马斯克正在加速xAI在AI编程工具领域的布局。
@steipeteOpenClaw创始人
GPT 5.5 + Codex的组合让AI编程任务从30分钟扩展到4-10小时。他认为Codex已经可以信赖地完成更大任务,这对生产力价值是重要验证。
@pmarcaa16z联合创始人
法律AI正在超赋权普通个体对抗大机构。数条推文表达了对AI赋能个体权利的乐观预期。
@dotey (宝玉)中文AI圈KOL
关注Codex新版特性:会话管理、并行worktree、Token用量显示等。推测明天重置额度,反映了AI编程工具的实际使用强度。
@gregisenbergAI创业ideas之王
明确认为Claude Opus 4.8没有意义上好于GPT 5.5。关注实际应用而非模型测评成绩——一个值得重视的视角。
@op7418 (歸藏)中文AI活跃KOL
自己的Skill登上GitHub本周新建项目Star排名第一。关注AI产品/工具生态发展。
@ClementDelangueHugging Face CEO
指出大多数用RL训练Agent型LLM的团队都有'安静的错误'——训练循环有隐藏bug而团队不自知。这是一个重要的行业技术风险提示。