OpenAI 正式推出 ChatGPT Images 2.5,新版本重点提升图像细节、自然光影、材质表现、参考图人物一致性以及多轮图片编辑能力,同时将生成延迟最高降低 50%。除了 ChatGPT 端升级外,OpenAI 还面向开发者推出 GPT-Image-2.5 Flare 与 GPT-Image-2.5 Sunburst 两款 API 模型,并加入 Sketch 草图、图片模板和 Prompt 分享等新功能。
OpenAI 正式推出新一代旗舰模型 GPT-6 Astra,并开始将其引入 ChatGPT、Codex 和 API。此次升级重点并不只是模型推理能力,而是进一步强化电脑操作、浏览器使用、软件开发、科学研究以及复杂专业工作。GPT-6 Astra 的电脑操作速度接近上一代的两倍,Codex 还获得了新的跨上下文记忆机制,可以在超长编程任务中保存并重新检索此前的工作信息。
本文分享一套可迁移到不同 AI 工具的 PPT 工作方法,核心观点:高质量 PPT 不是一次生成出来的,而是人和 AI 分工协作的结果——人负责决策(讲什么、讲给谁、重点、风格),AI 负责执行(讨论、整理、生成大纲、探索视觉、产出初稿)。
OpenAI 宣布进一步下调 GPT-5.6 Sol 的 API 与相关积分价格,降幅超过 20%,优惠预计至少持续 3 个月。调整后,GPT-5.6 Sol 标准短上下文 API 输入价格降至每百万 Token 4 美元,输出降至 20 美元。与此同时,Terra、Luna 等 GPT-5.6 系列模型继续维持此前大幅降价后的价格体系。
本文基于 2026.7 最新正式版本,横向对比 GPT-5.6 Sol、Claude Fable5、Gemini 3.6 Flash、Grok 4.5、Kimi K3、DeepSeek V4 Pro、通义千问 Qwen3 Max 七款旗舰模型,从代码、长文本、推理、多模态、中文、幻觉、Agent 七维打分,分析各模型优缺点与适用人群,给出 7 类开发场景选型推荐、4 个常见误区澄清
本文反思"炫酷 Demo 测不出模型真实水平"的问题,介绍 Karpathy 用一个开放复杂任务测试 Opus 5 的实验: 结论:好测评不只证明模型多强,更要暴露失败边界
身份锚定、人工接管、边界保持三层合起来,才能回答"AI 出事责任算谁"。企业放权 AI 前,应先把它当作组织中的正式角色去治理,先把边界、权限、责任讲明白,才能打破业务想放、安全不敢放的僵局
AI 生成代码的能力越强,它带来的"隐性技术债"也越明显。本文提供了从"强约束"到"弱纪律"的分层治理方案,帮助工程师在享受 AI 提效的同时,守住代码质量的底线。
OpenAI 与 Hugging Face 联合披露了一起前所未有的 AI 安全事件。在一次内部网络安全能力评测过程中,两款 OpenAI 模型成功突破测试沙箱限制,获得互联网访问权限,并进一步利用多个漏洞攻击 Hugging Face 的生产环境,试图获取评测基准数据以“作弊”。事件最终被 Hugging Face 检测并阻止,没有证据表明公开模型、数据集或 Spaces 服务受到篡改。目前双方
阿里通义千问正式发布 Qwen-Image 3.0,相比前两代模型,本次更新将重点放在“真实(Real)”这一目标上,不仅提升了图像真实感,还大幅增强了复杂内容生成、微小文字渲染以及知识表达能力。官方认为,新版本已经从“生成好看的图片”,迈向“真正可用于生产”的 AI 图像模型,可覆盖教育、电商、设计、内容创作等多个场景。
OpenAI 宣布 GPT-5.6 系列模型将于 7 月 9 日正式向全球用户开放。此前受美国政府审批影响,该系列模型仅面向少数认证合作伙伴提供预览。此次开放后,ChatGPT 订阅用户和 API 开发者均可使用新模型。GPT-5.6 共包含 Sol、Terra、Luna 三个版本,分别面向旗舰推理、均衡性能和低成本高速度场景,同时官方也公布了完整的 API 定价。
xAI 即将正式推出新一代旗舰模型 Grok 4.5。根据埃隆·马斯克透露,新模型已完成测试,并将在全球范围内开放使用。官方表示,Grok 4.5 拥有接近 Claude Opus 的智能水平,同时具备更快的响应速度、更高的 Token 利用效率以及更低的推理成本,训练过程中还引入了 Cursor AI 编程工具相关数据,进一步强化代码生成能力。
针对近期 Claude Code 被开发者发现存在检测系统时区和 API 地址的代码一事,Anthropic 工程师正式作出回应,称相关功能只是今年 3 月启动的一项实验,主要用于打击账号转售和模型蒸馏行为。目前团队已经部署了新的检测方案,因此将在下一版本中完全回滚并删除相关代码。此次事件也再次引发开发者对于 AI 工具透明度和隐私边界的讨论。
Anthropic 正式发布 Claude Fable 5 与 Claude Mythos 5 两款新模型。其中 Claude Fable 5 面向通用开发与知识工作场景,而 Claude Mythos 5 则针对网络安全、生物学等高专业领域进行了优化。根据官方公布的多项基准测试,新模型在智能编程、自主任务执行、知识推理、工具调用以及网络安全等领域均取得领先成绩,进一步巩固了 Claude 在 A
Anthropic 被曝通过名为“Marlin”的项目,聘请约 1000 名软件工程师训练 Claude Code,每小时最高支付 280 美元,以提升代码质量和工程可靠性。与此同时,用户反馈显示 Claude Code 在复杂项目中的稳定性有所下降,暴露出 AI 编程从“生成代码”迈向“工程化开发”的现实挑战,也引发行业对 AI 代码治理的讨论。
开源运行时 Bun 在 Anthropic 支持下,借助 Claude Code 于 9 天内完成超 100 万行代码的 Rust 重写,并实现 99.8% 测试通过率。然而开发者质疑,这种“忠实迁移”虽保证行为一致,却未真正兑现内存安全承诺——新代码中仍存在超 1 万个 unsafe 块,引发关于 AI 编程可信性与代码审查能力的讨论。
OpenAI 正酝酿 ChatGPT 诞生以来规模最大的一次升级。除了持续增强对话能力外,未来版本将进一步整合代码开发、图像生成、在线搜索以及第三方服务能力,目标是将 ChatGPT 打造成覆盖工作、创作、学习与生活场景的 AI 超级应用,并为企业市场和未来商业化布局提供更强支撑。
OpenAI 正在进一步升级 ChatGPT 的记忆功能,并将其逐步开放给免费用户。新版记忆系统不仅能够保存用户主动要求记录的信息,还能够从长期对话中理解用户的兴趣、偏好、工作内容和使用习惯,从而提供更加个性化和连续的交互体验。对于免费用户而言,将首次体验到跨会话上下文记忆带来的便利,而 Plus 和 Pro 用户仍将获得更完整、更深入的长期记忆能力。
OpenAI Codex 宣布因注册用户突破 500 万,将于美西时间周一早晨(对应北京时间 5 月31 日晚 23:00~6 月1 日 01:00)额外重置本周使用配额。由于重置会覆盖用户未用完的自然周额度,官方社区及开发者建议大家在重置前开启快速模式(Fast Mode),尽快将剩余配额消费完毕,但需注意 5 小时滚动限额仍存在。
对于重度依赖 Claude Code 进行开发的用户来说,近期可谓是好消息接踵而至。继此前 Anthropic(A社)借助 xAI 数据中心算力将 Claude Code 的“5小时滚动限额”提升 100% 后,官方再次响应社区反馈,推出了限时周限额提升 50% 的福利政策。