当前位置:新城娱乐资讯

GPT-6 Astra不会让外行秒变专家

发布日期:2026/9/8 17:30:50 访问次数:4



GPT-6 Astra(OpenAI 2026年8月发布的agentic编码/桌面操控模型,接替Codex默认Sol位置)刷屏的是"一句话操控Blender/Photoshop/Unity/机器人"的案例,但实测结论先放前面:它把外行从"不会点按钮"推到"能做出一个东西",再从"能做出"到"做好"之间那道坎,没动——因为坎里填的是领域知识、审美标准和错误定位能力,模型不补这门课。

作者lencx用Blender和Audacity测了两把,翻车翻得很有代表性。Blender里对Astra说"做个精致少女虚拟体",Codex走Python脚本建模,首版出来作者自己评价"以目前审美不太能欣赏";丢《凡人修仙传》银月截图让照着调,结果银发猫耳往"牛来"风格漂,越改越偏最后"向非洲狂奔"。问题不在Astra不会写脚本,而在人给不出"哪里不好、先改比例还是材质还是拓扑"的有效反馈——"再精致点"等价于对程序员说"做得高级点",信息量近零。Audacity那边反倒露出真东西:Codex不只点GUI,还调FFmpeg、写Python/Lisp/Swift多语言脚本协同,把音频任务在CLI和代码层接力跑完。这展示的是跨工具调度,不是音频审美;作者明说"最后音乐效果先抛开"。

这正好拆穿两层幻觉。第一层是案例剪接术:公开视频只给"一句prompt+漂亮成片",前置的插件/素材/预设/失败次数全剪掉,小白以为从零到成品靠一句话,实则专业人士背后有数年Blender拓扑和材质积累当暗支架。第二层是"操作=专业"的误等价:Astra跨的是软件操作门槛,跨不过目标拆解、标准判定、错因定位。以前卡在不会点按钮,现在卡在不知道下一步改哪——门槛没消失,往里挪了一层。

过程比成片更值钱这点作者点得准:Astra跑完留下脚本、日志、中间blend文件、被弃版本,这条可回看路径未来可能比孤零零成品更能证明"怎么长出来的"。原创争议里,创作轨迹权重会上升,不是日志能解决一切,但比单图强。

Astra自身还有个工程侧怪象:常停在"下一步该做什么"不执行。翻Codex源码可知不是reasoning退化——Astra和Sol默认reasoning/verbosity/tool mode基本一致,差异在行为层:Astra对缺失信息更谨慎、对AGENTS.md/skills里含糊规则更敏感、官方给配了更长专属agent prompt明确要求把"can you/I want to/help me"当行动请求、别只给计划。它上线即成Codex默认模型,老任务切过去时旧base instruction叠新developer message,多层指令叠加更易保守收手。所以用户感觉"回退"是真感受,根源是谨慎性+默认切换+指令敏感三重叠加,不是执行被削弱。

收尾那几位旁观者刚好框住边界:Musk 2020年猜GPT-5/6近人类智能是外部观察者口径,不能当结论;Schirano说Astra是最强逆向工程引擎,指的是"图/视频→代码、复现现有软件功能"这层,不是"无中生有专业作品";PG说可被复制的初始想法不值钱,值钱的是实践里长出来的新想法;Mollick说Astra会读本地历史推偏好,同prompt不同人结果不同,横向跑分天然有噪。合起来一句话:AI缩短"看见→复现"的距离,不缩短"外行→专家"的距离。

所以标题那句不是泼冷水,是拆杠杆——Astra是放大器不是许愿池:放大你已有的判断力,也放大你已有的模糊。你卡在"它丑"但说不出"丑在颧骨比还是光影衰减",模型再会调Blender也救不了这层空缺;等你真知道好长什么样,Astr a才从玩具变工具。GPT-6强的是agentic执行,弱的和GPT-3一样:它不替你长脑子。

(注:你稿中"GPT-6 Astra"为2026年8月OpenAI发布、接替Codex默认Sol的agentic模型;"Sol"是前文Codex旧默认模型代号,别和xAI的Grok系混淆;Blender测试参考图《凡人修仙传》银月、Audacity调FFmpeg+Lisp/Swift属作者实测细节,引用时保留即可。)

联系人:卧虎

TG:xylmwohu

QQ:5243865