七条使用建议 案例能让人兴奋,真正开始用的时候,还会遇到一个问题:为什么别人能连续做几小时,我的任务却老停在“我可以帮你”? OpenAI 的 Angel Brodin 在 Astra 发布后的原帖里,专门谈过这类情况:模型会在额外信息可能影响结果时提出问题,建议提前说明什么时候应自行推进。官方模型指南也把主动性、指令冲突、表达风格和过度测试列成需要调整的行为。 ([Angel 的原始建议](https://x.com/angelbrodin/status/2095882075412832380) · [官方模型行为说明](https://developers.openai.com/api/docs/guides/latest-model#gpt-6-astra-behavior)) 下面七条,是结合这些说明和前面案例写给实际使用者的建议。你可以按需要挑,不必一股脑塞进每个任务。 ### 把“给我建议”改成“交给我什么” 任务里直接写出文件和使用方式。你要的是一个能播放的视频、一个能筛选的表、一个能投递的简历,还是一份能拿去讲的课件?如果结尾只写“帮我分析一下”,模型交出一段分析并没有违背字面要求。 > 建议任务(本文编写,按你的素材修改) > > 1)这次最终需要交付一份可以实际使用的成品; > 2)请先理解我要拿它做什么,再执行所需步骤; > 3)文件做好后要打开检查;遇到能自行查明的问题继续处理; > 4)只有缺少会改变业务结论的信息,或需要新的外部动作授权时,再问我。 同样,别把所有任务都喊成“做到极致”。极致没有结束条件。能被接收者正常使用、关键内容正确、指定动作走通,这些要求虽然朴素,却能让模型知道何时该停。 ### 先清理互相打架的规则,再怀疑它为什么犹豫 一份说明要求“所有事情先确认”,另一份要求“一口气做到最后”,你又在聊天里说“直接弄”。这种冲突会增加任务的摩擦。官方建议检查 Skills 和 AGENTS.md 等文件中的指令,这也解释了为什么同一个模型在不同人的环境里可能表现不同。 ([官方关于指令跟随的说明](https://developers.openai.com/api/docs/guides/latest-model#gpt-6-astra-behavior)) 我会让它先列冲突,不会让它直接删除全部规则。真正保护数据、付款和发布的要求要保留;只在复杂任务里必要的步骤,可以限定适用范围。一个错别字修改,没有必要变成全面系统检查。 > 建议任务(本文编写,按你的素材修改) > > 1)检查当前任务会读取的规则,指出哪些要求彼此冲突、已经过期或只适用于特定工作; > 2)说明它们会怎样影响这次结果,给出最小调整建议; > 3)先提供对照,不修改文件,也不扩大操作权限。 ### 给它参考结果,也告诉它参考什么 小禾给简历补参考图以后,视觉有改善,但项目内容问题仍然存在。这说明参考只能解决它所覆盖的部分。你给一张版式图,不能指望它顺便知道哪段职业经历最重要。 参考最好带一句用途:这张看留白,这张看色彩,这份看内容组织,另一份只看输出格式。哪里必须保留、哪里可以发挥,也写清楚。 > 建议任务(本文编写,按你的素材修改) > > 1)参考 A 只借鉴页面层级,参考 B 只借鉴材质和光线; > 2)正文事实全部来自我的资料; > 3)先解释你准备借鉴哪些特点,再用新的结构实现,不复制对方正文、品牌或独特视觉元素。 对文字也一样。给三段你认可的旧稿,比喊十遍“有人味”更具体。告诉它你为什么喜欢:判断直接,例子有细节,读起来知道下一步该做什么。 ### 用同一份小任务比较推理档位 Simon 的骑车鹈鹕 SVG 对照,把不同模型和推理档位的结果放在一起,并展示那次运行的消耗。他也指出作品仍有具体错误。这种测试不能决定模型所有能力,却比只看最高档的一个惊艳结果更方便选择。 ([Simon 的对照实验](https://simonwillison.net/2026/Sep/4/astra-pelicans/)) 你可以给自己的工作留一个小样本:一页商品介绍、一段数据清洗、一张有明确条件的图。用相同输入比较结果,记录等待多久、改了几轮、哪一项没做到。以后再调整档位,就有自己的依据。 不必机械追求最强配置。某一轮只是移动按钮、修改文字或补一个导出格式,就看看较轻的设置是否已足够;复杂推理和困难修复再提高投入。套餐、推理设置、调用额度和本机渲染成本是不同的东西,不能看见作者写了 Ultra,就直接推断自己该买哪一档。 ### 让它自行做一轮,再给具体反馈 一边要求它自主,一边每三十秒给一个新方向,也会让任务碎掉。你可以先给清楚的成品要求,让它交出可看的阶段结果,然后集中改两三个最影响使用的问题。 > 建议任务(本文编写,按你的素材修改) > > 1)这一轮先完成已有目标,不追加新功能; > 2)交付预览后,列出你发现的三个主要问题,说明会影响哪一种使用; > 3)我会按优先级反馈,再继续修改。 反馈时说位置和现象:“第二个镜头的标题遮住产品”“第三页结论没有数据支持”“手机第一次打开按钮落在屏幕外”。模型才能沿着结果工作,不必重新猜你心里的审美。 ### 检查要对着真实用途,别检查出一个假放心 前面那个早期膝盖错误提醒我,检查方法也可能选错。表格的总和算对了,退款口径可能错;文档没有乱码,项目经历可能漏;页面截图漂亮,按钮可能按不下去。 你可以要求一项结构检查,再加一项使用检查。结构检查确认文件、公式、格式和必要内容;使用检查回到收件人会做的动作。两项都讲得明白,才知道自己得到了什么。 > 建议任务(本文编写,按你的素材修改) > > 1)不要只报告文件已经生成; > 2)请按实际接收者的使用方式打开它,做一次最重要的操作,把发现的问题修好; > 3)检查与本次风险相称;能证明目标的检查做完后,不要继续扩大到无关范围。 ### 把公开案例、你的资料和最终文件接在一起 收藏别人的案例,最容易停在“以后试”。我建议每次只选一个,把所需材料当天放进一个文件夹:原始资料、参考、目标说明、输出。你发出的任务就有了具体对象。 一轮结束,把最有用的提示词、主要修改和成品留住。下次需要同类工作,就从这份材料开始。你收集的东西逐渐变成自己的工作资产,而不是浏览器里越积越多的书签。 要分享给朋友,也分享这四样:要解决的问题、输入材料示例、可直接使用的任务、结果怎么看。单独一张惊艳截图只会让人羡慕,一份能照做的材料才会让人行动。