AI 写作降 AI 率的 Prompt 设计原理
Few-shot 示例的选择比数量重要。3 个高质量示例的效果远好于 10 个普通示例。关键是示例要覆盖不同场景:正常情况、边界情况、特殊情况。而且示例的顺序也有影响,把最典型的放第一个。 Prompt A/B 测试的方法:准备 20-30 个测试输入,用两个 Prompt 版本分别生成,人工评分...
Few-shot 示例的选择比数量重要。3 个高质量示例的效果远好于 10 个普通示例。关键是示例要覆盖不同场景:正常情况、边界情况、特殊情况。而且示例的顺序也有影响,把最典型的放第一个。 Prompt A/B 测试的方法:准备 20-30 个测试输入,用两个 Prompt 版本分别生成,人工评分...
角色设定不是随便写「你是专家」就够的。要具体:「你是 5 年经验的 Next.js 全栈开发者,熟悉 SEO 优化和出海产品,代码风格偏好简洁和类型安全」。越具体的角色设定,AI 的输出越符合预期。 上下文窗口管理是个技术活。长对话中 AI 容易「遗忘」早期设定。我的做法是:把关键约束放在系统提示...
角色设定不是随便写「你是专家」就够的。要具体:「你是 5 年经验的 Next.js 全栈开发者,熟悉 SEO 优化和出海产品,代码风格偏好简洁和类型安全」。越具体的角色设定,AI 的输出越符合预期。 RAG + Prompt 工程是让 AI 基于私有文档回答的标准方案。关键在于检索质量:chunk...
Prompt 模板变量设计能让提示词可复用。我用 `{{role}}`、`{{tech_stack}}`、`{{constraints}}` 这种占位符,运行时填充。这样一套模板可以适配不同项目,类似组件化的思路应用到 Prompt 工程。 Prompt 迭代优化的思路和代码优化一样:先让它跑通,...
Prompt A/B 测试的方法:准备 20-30 个测试输入,用两个 Prompt 版本分别生成,人工评分或用自动化指标(如代码通过率)。统计显著性需要至少 30 个样本,否则可能是噪音。 系统提示词模块化设计:把角色定义、技术栈、代码规范、错误处理策略拆成独立模块,按需组合。类似微服务架构的思...
系统提示词的 token 预算要合理分配。我的经验:角色定义 50 token、技术约束 200 token、格式要求 100 token、示例 300 token。总共控制在 650 token 以内,留足空间给用户输入和 AI 输出。 元提示词(用 Prompt 生成 Prompt)是个有趣的...
AI 生成生产级代码的 Prompt 要点:明确技术栈版本、给出代码规范链接、要求错误处理、要求类型安全、要求添加注释。最重要的是给一个高质量的参考实现作为 few-shot 示例。 Prompt Chain 是处理复杂任务的利器。比如生成一个完整的 Next.js 页面:第一步 Prompt 生...
用 Prompt 驱动 Prisma Schema 设计效果不错。告诉 AI 业务需求(如「用户有多个订阅,订阅有多个订单」),让它生成包含关系、索引、级联删除的完整 Schema。但要检查索引是否合理,AI 偶尔会漏掉查询频繁字段的索引。 Prompt 中的歧义消除是关键。比如「加一个搜索功能」...
长上下文 Prompt 的信息密度要控制。AI 对上下文的理解不是均匀的,开头和结尾的内容权重更高(首因效应和近因效应)。关键信息放开头,最新指令放结尾,中间放背景资料。 AI 生成生产级代码的 Prompt 要点:明确技术栈版本、给出代码规范链接、要求错误处理、要求类型安全、要求添加注释。最重要...
系统提示词的 token 预算要合理分配。我的经验:角色定义 50 token、技术约束 200 token、格式要求 100 token、示例 300 token。总共控制在 650 token 以内,留足空间给用户输入和 AI 输出。 AI 生成 Tailwind 组件的 Prompt 要点:...
Prompt A/B 测试的方法:准备 20-30 个测试输入,用两个 Prompt 版本分别生成,人工评分或用自动化指标(如代码通过率)。统计显著性需要至少 30 个样本,否则可能是噪音。 系统提示词的 token 预算要合理分配。我的经验:角色定义 50 token、技术约束 200 toke...
Temperature 参数的经验值:代码生成用 0.1-0.3(要确定性),创意写作用 0.7-0.9(要多样性),SEO 内容用 0.4-0.6(平衡准确和自然)。Top-p 一般固定 0.9,主要通过 Temperature 调节。 Prompt 模板版本管理很重要。我用 Git 管理 Pr...
Prompt A/B 测试的方法:准备 20-30 个测试输入,用两个 Prompt 版本分别生成,人工评分或用自动化指标(如代码通过率)。统计显著性需要至少 30 个样本,否则可能是噪音。 RAG + Prompt 工程是让 AI 基于私有文档回答的标准方案。关键在于检索质量:chunk 大小设...
降 AI 率的关键不是事后改写,而是从 Prompt 层面就让 AI 模仿人类写作风格。我会在 Prompt 里加「使用口语化表达、偶尔出现不完美的语法、加入个人主观判断、避免过度结构化的排比句式」,生成的内容 AI 检测率能从 95% 降到 30% 以下。 Chain-of-Thought 在复...
降 AI 率的关键不是事后改写,而是从 Prompt 层面就让 AI 模仿人类写作风格。我会在 Prompt 里加「使用口语化表达、偶尔出现不完美的语法、加入个人主观判断、避免过度结构化的排比句式」,生成的内容 AI 检测率能从 95% 降到 30% 以下。 Prompt 模板版本管理很重要。我用...
RAG + Prompt 工程是让 AI 基于私有文档回答的标准方案。关键在于检索质量:chunk 大小设 500-1000 字符,重叠 100 字符,用语义检索而非关键词匹配。Prompt 里告诉 AI「只基于提供的上下文回答,不确定时说不知道」,能大幅减少幻觉。 AI 生成生产级代码的 Pro...
系统提示词的 token 预算要合理分配。我的经验:角色定义 50 token、技术约束 200 token、格式要求 100 token、示例 300 token。总共控制在 650 token 以内,留足空间给用户输入和 AI 输出。 Few-shot 示例的选择比数量重要。3 个高质量示例的...
Temperature 参数的经验值:代码生成用 0.1-0.3(要确定性),创意写作用 0.7-0.9(要多样性),SEO 内容用 0.4-0.6(平衡准确和自然)。Top-p 一般固定 0.9,主要通过 Temperature 调节。 用 Prompt 驱动 Prisma Schema 设计效...
系统提示词模块化设计:把角色定义、技术栈、代码规范、错误处理策略拆成独立模块,按需组合。类似微服务架构的思路,每个模块职责单一,通过组合适配不同场景。 Prompt 模板版本管理很重要。我用 Git 管理 Prompt 文件,每次优化都 commit,写清楚改了什么、为什么改、效果如何。这样团队可...
Prompt 中的歧义消除是关键。比如「加一个搜索功能」可以理解为前端搜索、后端搜索、全文搜索。好的 Prompt 会明确:「在 /forum 页面加服务端搜索,支持标题和内容匹配,用 Prisma 的 contains 查询,结果分页 20 条/页」。 Few-shot 示例的选择比数量重要。3...