七条使用建议


案例能让人兴奋，真正开始用的时候，还会遇到一个问题：为什么别人能连续做几小时，我的任务却老停在“我可以帮你”？

OpenAI 的 Angel Brodin 在 Astra 发布后的原帖里，专门谈过这类情况：模型会在额外信息可能影响结果时提出问题，建议提前说明什么时候应自行推进。官方模型指南也把主动性、指令冲突、表达风格和过度测试列成需要调整的行为。

（[Angel 的原始建议](https://x.com/angelbrodin/status/2095882075412832380) · [官方模型行为说明](https://developers.openai.com/api/docs/guides/latest-model#gpt-6-astra-behavior)）

下面七条，是结合这些说明和前面案例写给实际使用者的建议。你可以按需要挑，不必一股脑塞进每个任务。

### 把“给我建议”改成“交给我什么”

任务里直接写出文件和使用方式。你要的是一个能播放的视频、一个能筛选的表、一个能投递的简历，还是一份能拿去讲的课件？如果结尾只写“帮我分析一下”，模型交出一段分析并没有违背字面要求。

> 建议任务（本文编写，按你的素材修改）
>
> 1）这次最终需要交付一份可以实际使用的成品；
> 2）请先理解我要拿它做什么，再执行所需步骤；
> 3）文件做好后要打开检查；遇到能自行查明的问题继续处理；
> 4）只有缺少会改变业务结论的信息，或需要新的外部动作授权时，再问我。

同样，别把所有任务都喊成“做到极致”。极致没有结束条件。能被接收者正常使用、关键内容正确、指定动作走通，这些要求虽然朴素，却能让模型知道何时该停。

### 先清理互相打架的规则，再怀疑它为什么犹豫

一份说明要求“所有事情先确认”，另一份要求“一口气做到最后”，你又在聊天里说“直接弄”。这种冲突会增加任务的摩擦。官方建议检查 Skills 和 AGENTS.md 等文件中的指令，这也解释了为什么同一个模型在不同人的环境里可能表现不同。

（[官方关于指令跟随的说明](https://developers.openai.com/api/docs/guides/latest-model#gpt-6-astra-behavior)）

我会让它先列冲突，不会让它直接删除全部规则。真正保护数据、付款和发布的要求要保留；只在复杂任务里必要的步骤，可以限定适用范围。一个错别字修改，没有必要变成全面系统检查。

> 建议任务（本文编写，按你的素材修改）
>
> 1）检查当前任务会读取的规则，指出哪些要求彼此冲突、已经过期或只适用于特定工作；
> 2）说明它们会怎样影响这次结果，给出最小调整建议；
> 3）先提供对照，不修改文件，也不扩大操作权限。

### 给它参考结果，也告诉它参考什么

小禾给简历补参考图以后，视觉有改善，但项目内容问题仍然存在。这说明参考只能解决它所覆盖的部分。你给一张版式图，不能指望它顺便知道哪段职业经历最重要。

参考最好带一句用途：这张看留白，这张看色彩，这份看内容组织，另一份只看输出格式。哪里必须保留、哪里可以发挥，也写清楚。

> 建议任务（本文编写，按你的素材修改）
>
> 1）参考 A 只借鉴页面层级，参考 B 只借鉴材质和光线；
> 2）正文事实全部来自我的资料；
> 3）先解释你准备借鉴哪些特点，再用新的结构实现，不复制对方正文、品牌或独特视觉元素。

对文字也一样。给三段你认可的旧稿，比喊十遍“有人味”更具体。告诉它你为什么喜欢：判断直接，例子有细节，读起来知道下一步该做什么。

### 用同一份小任务比较推理档位

Simon 的骑车鹈鹕 SVG 对照，把不同模型和推理档位的结果放在一起，并展示那次运行的消耗。他也指出作品仍有具体错误。这种测试不能决定模型所有能力，却比只看最高档的一个惊艳结果更方便选择。

（[Simon 的对照实验](https://simonwillison.net/2026/Sep/4/astra-pelicans/)）

你可以给自己的工作留一个小样本：一页商品介绍、一段数据清洗、一张有明确条件的图。用相同输入比较结果，记录等待多久、改了几轮、哪一项没做到。以后再调整档位，就有自己的依据。

不必机械追求最强配置。某一轮只是移动按钮、修改文字或补一个导出格式，就看看较轻的设置是否已足够；复杂推理和困难修复再提高投入。套餐、推理设置、调用额度和本机渲染成本是不同的东西，不能看见作者写了 Ultra，就直接推断自己该买哪一档。

### 让它自行做一轮，再给具体反馈

一边要求它自主，一边每三十秒给一个新方向，也会让任务碎掉。你可以先给清楚的成品要求，让它交出可看的阶段结果，然后集中改两三个最影响使用的问题。

> 建议任务（本文编写，按你的素材修改）
>
> 1）这一轮先完成已有目标，不追加新功能；
> 2）交付预览后，列出你发现的三个主要问题，说明会影响哪一种使用；
> 3）我会按优先级反馈，再继续修改。

反馈时说位置和现象：“第二个镜头的标题遮住产品”“第三页结论没有数据支持”“手机第一次打开按钮落在屏幕外”。模型才能沿着结果工作，不必重新猜你心里的审美。

### 检查要对着真实用途，别检查出一个假放心

前面那个早期膝盖错误提醒我，检查方法也可能选错。表格的总和算对了，退款口径可能错；文档没有乱码，项目经历可能漏；页面截图漂亮，按钮可能按不下去。

你可以要求一项结构检查，再加一项使用检查。结构检查确认文件、公式、格式和必要内容；使用检查回到收件人会做的动作。两项都讲得明白，才知道自己得到了什么。

> 建议任务（本文编写，按你的素材修改）
>
> 1）不要只报告文件已经生成；
> 2）请按实际接收者的使用方式打开它，做一次最重要的操作，把发现的问题修好；
> 3）检查与本次风险相称；能证明目标的检查做完后，不要继续扩大到无关范围。

### 把公开案例、你的资料和最终文件接在一起

收藏别人的案例，最容易停在“以后试”。我建议每次只选一个，把所需材料当天放进一个文件夹：原始资料、参考、目标说明、输出。你发出的任务就有了具体对象。

一轮结束，把最有用的提示词、主要修改和成品留住。下次需要同类工作，就从这份材料开始。你收集的东西逐渐变成自己的工作资产，而不是浏览器里越积越多的书签。

要分享给朋友，也分享这四样：要解决的问题、输入材料示例、可直接使用的任务、结果怎么看。单独一张惊艳截图只会让人羡慕，一份能照做的材料才会让人行动。

