AI日报:2026年05月24日
🇨🇳 国内AI动态
1. 活过来的Codex,扛起了OpenAI上市的希望
ChatGPT 证明了 OpenAI 有用户、有收入,Codex 则要证明 OpenAI 有可规模化的生意。作为 OpenAI 独立运营的 AI 编程产品,Codex 的持续迭代和商业化进展,将直接影响 IPO 叙事——能否从「一人公司」转向真正能支撑估值的独立业务。
来源:钛媒体 | 原文链接 | 发布时间:05-24 13:36
2. 能随意窃取数据!这款热门 AI 编程工具曝重大隐患
安全研究人员披露 Claude Code 的沙箱防护存在严重缺陷,攻击者可在沙箱内运行时直接绕过隔离机制,未经授权读写文件系统,所有已发布版本均已受影响。该漏洞意味着 AI 编程助手在用户本地执行任务的场景下,数据窃取风险显著上升,开发团队需立即评估是否继续在生产环境使用。
来源:钛媒体 | 原文链接 | 发布时间:05-24 08:59
3. 破局多端困境,拥抱 AI 变革:飞猪跨端技术的过去、现在与未来|AICon上海
飞猪高级技术专家陈立宝在 AICon 上海站分享中,回顾了飞猪从多端独立开发到统一 meshup app 架构的演进历程,重点解析兼容性能与动态化效率两大技术目标如何在 AI 编程时代被重新定义。面向大模型驱动的开发范式,飞猪提出 AI 辅助编程不会颠覆所有技术选型,而是推动「易变的被加速、不变的根本不变」路线图。
来源:InfoQ | 原文链接 | 发布时间:05-24 18:00
4. 大规模工程支撑场景下的多智能体系统设计:Grab 实践案例
Grab 分析数据仓库团队基于多智能体架构,将故障排查、SQL 调试、平台支持三类工程请求自动化处理,每月节省数百个工程工时,让核心团队从被动救火转向系统建设。这套「调查+增强」双工作流的设计,为数据平台治理场景提供了可复用的多智能体落地方案。
来源:InfoQ | 原文链接 | 发布时间:05-24 16:00
5. 卷到今天,Agent的含金量还在提升丨AIGC2026圆桌论坛
AIGC2026 圆桌嘉宾指出,AI Agent 已从 Demo 阶段进入真实业务场景攻坚期,拥有真实数据接口、合规适配与工程稳定性能力的 Agent 产品将形成更高的竞争门槛。从商业化角度看,工具接入深度与落地场景复杂度已取代单纯的大模型参数,成为下一阶段的核心竞争力指标。
来源:量子位 | 原文链接 | 发布时间:05-24 18:50
6. 未来推理将吃掉70%算力,30%留给训练丨硅谷投资人张璐@AIGC2026
硅谷投资人张璐在 AIGC2026 分享中指出,随着 Agent 规模化落地,AI 算力开销将出现结构性翻转:推理需求将占据总算力的 70%,训练仅占 30%。这一趋势意味着推理芯片、缓存优化和推理服务弹性调度的商业价值将显著上升,是 AI 基础设施下一阶段的主要投资方向。
来源:量子位 | 原文链接 | 发布时间:05-24 14:14
🌍 国外AI动态
7. 字节跳动研究发现:让多模态大模型回答问题,比要求它转录文本更适合长文档训练
字节跳动 Seed 团队发现,即使训练时最长文档仅为推理阶段的 25%,7B 模型在长文档问答任务上仍比大得多的大模型更可靠。改变训练模式——让模型主动从文档中定位并回答问题,而非先逐页转录再打标签——可在保持精度的同时大幅降低文档理解的成本和延迟。
来源:The Decoder | 原文链接 | 发布时间:05-24 21:28
8. DeepMind Hassabis 称人类已站在「奇点的山脚」,LeCun 则认为当前 AI 并非真正的智能
Yann LeCun 公开表示当前 AI 系统不具备真正的理解与推理能力;Demis Hassabis 则认为人类已站在奇点入口;Gemini 联合负责人 Oriol Vinyals 看法介于两者之间——七年前的模型已足以被视作 AGI,但今天的模型仍无法从经验中持续学习、无法自主产生真正的新发现。三人分歧为行业制定长期路线图提供了重要参照框架。
来源:The Decoder | 原文链接 | 发布时间:05-24 20:54
9. 为何不应在 Copilot、Gemini 等 AI 工具上沿用默认模型
数学家 Adam Kucharski 的实验显示,Copilot 在分析同一数据集时,仅因换用不同国家标签就主动编造出各国差异,输出的是详细刻板印象而非真实洞见。只有当用户知道何时切换至高级模型时才能规避这类问题,提醒从业者不应默认使用工具配置——模型选择直接影响分析的可靠性。
来源:The Decoder | 原文链接 | 发布时间:05-24 18:17
10. 五角大楼将 Anthropic 列为供应链风险,但 NSA 仍可能继续采购 Claude
尽管美国防部已将 Anthropic 标记为供应链风险,情报机构仍有望维持与 Anthropic 的定制合同,原因是情报机构最新型 Grace Blackwell 芯片供应短缺,而 Anthropic 的 Mythos 模型在更老的硬件上也能运行。「任何合法使用」条款争议已从协议中移除,使谈判得以继续。
来源:The Decoder | 原文链接 | 发布时间:05-24 16:51
11. 研究人员让 Claude Code 独立发现 AI 缩放算法,成果优于人类设计方案
来自 UMD、Google、Meta 等机构的团队用 AutoTTS 让编码代理自主搜索 AI 推理缩放控制算法,最终找到精度相当但计算量缩短 70% 的方案。实验全程仅花费 $40、耗时 160 分钟,全部由 Claude 完成。这种低成本自动化搜索范式,或将成为未来大规模 AI 调优的标准工具链。
来源:The Decoder | 原文链接 | 发布时间:05-24 16:06
12. DeepSeek 将 75 折永久化,输出 token 价格低至 GPT-5.5 的 1/34
DeepSeek 已将 V4-Pro 七五折定价永久化:百万输入 token $0.435,比 GPT-5.5 便宜至少 11.5 倍;输出 token 便宜 34 倍以上。对 token 消耗量大的 AI Agent 部署场景而言,这一价格差距将持续挤压西方供应商的利润空间,加速全球推理成本向中国厂商靠拢。
来源:The Decoder | 原文链接 | 发布时间:05-24 01:10
今日看点
昨日 AI 行业呈现三大主线:一是 AI 工程商业化加速落地——Codex 承载 OpenAI IPO 叙事,Claude Code 安全漏洞事件叠加飞猪、Grab 企业级案例,均指向 AI 辅助工程从试点阶段进入规模化安全与信任考验。二是安全与合规议题持续升温——Anthropic 与 NSA 合作争议、Copilot 刻板印象问题浮出水面,映射出 AI 大规模落地后偏见管控与供应链风险评估的复杂性。三是成本结构持续下移——DeepSeek 永久折扣、字节跳动训练方法优化,推理供给侧的价格竞争加剧将加速全球 AI 算力成本中枢进一步下探。
数据来源:钛媒体、InfoQ、量子位、The Decoder | 共收录12条