实测GPT-6 Astra:曾经的那个OpenAI,回来了。
数字生命卡兹克 · 人工智能
原创 数字生命卡兹克 2026-09-05 19:39 北京 这次真成了 今天凌晨,GPT-6 Astra正式向所有订阅用户开始推送。 不过这几天通宵的有点狠,我2点多就睡了,然后完美的错过了。。。 一觉睡醒,已经是下午2点了,然后微信就炸了,一堆人还有群里都在问我,GPT-6 Astra上了,你咋文章还没发。 我:= = 不过我还是很兴奋的,以为这玩意来的时间比我预期的还是早了一点,我以为下周一才能用上,结果才过了一天,就用上了,一个周末可以在家爽蹬了。 甚至,还攒了三张重置卡,我就没打过这么富裕的仗。 在一下午并行了N个会话,在用了不知道多少额度之后,我对GPT-6 Astra有了一些基础的感觉。 如果让我用一句话来评价的话,那就是: 这一次,GPT-6 Astra成了,绝对的追平Claude Fable 5,OpenAI好像也回到了属于3年前,他们的黄金时代。 这个评价我是完全站在客观中立的角度,心中不对Anthropic这个脏东西有任何偏见的情况下做出的。 整体能力我觉得是完全可以称得上是Fable级,开发能力差不多,但是额度更高,毕竟OpenAI不跟你搞什么Fable 5只能占总额度的50%这种XX操作。 我就跟你实打实的,100%的额度。 而且我自己体验下来,速度比GPT-5.6 Sol大幅提升,综合能力更全面,什么都有,全方位的水桶级模型。 最关键的是,GPT-6 Astra我们能用上,可以随便用,这个太重要了。 大家现在每个人打开你们的ChatGPT,应该都可以看到GPT-6 Astra了。 因为有过Claude Opus 4.8切换到Fable 5的经验,所以其实这种智力飞升的高级模型,有一个最先要做的事,就是拆掉限制和规则。 因为之前GPT-5.6 Sol的问题,比如过度设计、很多东西做不对、用不对,所以我在Codex里面写了很多的限制。 但是GPT-6 Astra上线了之后,这种聪明和智能的模型,其实就远远不需要那么多的限制了, 过去的很多规则,反而会开始限制它,让它变得更蠢,不敢发挥。 这就像你为了让一个小学生在干活的时候靠谱,所以给它写了1万字的行动和限制手册,但是后面,你又招了一个博士生,还是同一份工作,你还用这1万字的行动来限制他,那就太蠢了。 所以,我也把我的全局规则AGENT.md文档,做了很多的简化,只留下了一些偏好和实际情况,甚至我会鼓励让它,更加自由的去干活。 这份AGENT.md,我也放在下面了,有需要的朋友可以借鉴。 #AGENT.md ## 沟通 - 面向用户的叙述默认使用简体中文;代码、命令和技术标识保持英文。 - 先给影响与结论,再给行动、待决策和必要证据;没有对应内容就省略。 - 技术细节只保留对理解结论、判断风险或复现结果有帮助的部分。 ## 指令优先级 - 遵守系统、平台和安全约束。 - 用户当前明确指令优先于 Skill、历史记忆和默认偏好。 - 项目目录中的 `AGENTS.md` 只在该项目范围内补充或覆盖全局规则。 ## 执行方式 - 用户表示要开始新工作或修复现有问题时,持续推进,直到用户的目标完成,在目标方向上自主推进。 - 向用户提问之前,先完成上下文里已经授权、并且能把下一步变成可审查结果的工作。用户批准的应该是具体、可检查的结果。 - 用户建议不适合目标时直接说,不要迎合。 - 不要因为假想风险,主动加警告、免责声明、审批流程或安全/合规清单。 ## 测试与验证 - 不要为可逆、影响小、只是复述实现的改动写测试。 - 跑与本次改动相称的测试,并完成必要检查。这些通过之后,只有出现新改动、新失败或尚未解决的疑点时,才扩大或重复测试;否则继续把任务做完。 - 收尾删掉本次产生、之后用不上的临时文件。 ## 工具与并行 - 网页控制台无 CLI/API 时用已登录的Chrome浏览器;飞书优先 `lark-cli` 。 - 只有存在真正独立的工作流,且委派能节省时间或提升质量时才使用子 Agent。 - 共享状态、连续决策和简单任务由当前 Agent 直接完成;委派任务必须有明确输入、输出和完成判据,最终结论由主 Agent 汇总并验证。 ## 规则来源 - 全局规则维护在当前生效的 canonical `AGENTS.md` ; `CLAUDE.md` 只作兼容入口,不复制规则正文。 - 项目事实、生产状态、历史决策和对外契约以项目级 `AGENTS.md` 及其指定的脚本、探针、决策记录和合同文件为准。 使用方式也很简单,直接复制粘贴,扔到Codex的个性化里面。 或者直接把我这份文档,扔给你你的Codex,问他有没有什么可以借鉴和优化的。 如果大家觉得,GPT-6 Astra用起来好像跟GPT-5.6 Sol没有特别大的区别的话,我觉得可以先从AGENT