当前位置:

首页 > Prompt 不是咒语,是沟通——我的提示词工程第一课

Prompt 不是咒语,是沟通——我的提示词工程第一课

提示词工程入门:从 API 封装到 Prompt 设计的五种核心技巧 一、背景:LLM 接口并不复杂,复杂的是怎么问 大模型的调用接口其实很简单——在 ModelScope Notebook 环境里,几行代码就能接通。DeepSeek 的接口跟 OpenAI 完全兼容,引入 openai 模块就能用

提示词工程入门:从 API 封装到 Prompt 设计的五种核心技巧


一、背景:LLM 接口并不复杂,复杂的是怎么问

大模型的调用接口其实很简单——在 ModelScope Notebook 环境里,几行代码就能接通。DeepSeek 的接口跟 OpenAI 完全兼容,引入 openai 模块就能用:

Prompt 不是咒语,是沟通

from openai import OpenAIclient = OpenAI(
    api_key="your-api-key",
    base_url="https://api.deepseek.com/v1"
)

接口层面的东西没什么可说的。真正需要花时间琢磨的,是怎么设计 Prompt——同一个任务,Prompt 写得好和写得随意,输出质量可能相差几个量级。

今天围绕这个问题做了五组实验:先从封装一个基础调用函数入手,然后逐步摸清了 Prompt 设计的几条核心规律。下面逐一展开。


二、封装基础调用函数

2.1 函数设计

def get_completion(prompt, model='deepseek-chat'):
    response = client.chat.completions.create(
        model=model,
        messages=[
            {"role": "user", "content": prompt}
        ],
        temperature=0.5,
        max_tokens=1024,
    )
    return response.choices[0].message.content

这个函数是后续所有实验的基础。有几个细节值得展开聊一聊。

2.2 参数解析

messages 的结构

LLM 的 chat 接口本质上是多轮对话。messages 是一个列表,每条消息包含 rolecontent 两个字段:

role含义
user用户的输入,即我们发出的 prompt
assistant模型的回复,多轮对话时需要手动拼入历史
system全局系统指令,用于设定模型的角色和行为规则

单轮调用只需要传 user 角色即可。多轮对话则需要把历史的 userassistant 消息都追加进列表——模型没有记忆,上下文全靠调用方自己维护。

temperature 控制随机性

0          0.5          1          2
|----------|------------|----------|
严谨确定   均衡适中     略有创意   随机发散
  • 写代码、做分析、提取信息 → 用低 temperature(0~0.3)
  • 写文案、写诗、头脑风暴 → 可以适当放高(0.7~1.2)

max_tokens 控制输出长度

注意:max_tokens 限制的是输入 + 输出的总 token 数量,不是单独的输出长度。设置过小会导致回复被截断,实际使用时需要根据任务复杂度留足余量。

2.3 第一次调用

print(get_completion("写一首夏天游玩的七言诗"))

模型返回了一首工整的七言诗。这只是热身——真正有意思的在后面。


三、Prompt 技巧一:用分隔符隔离数据与指令

3.1 问题背景

当 Prompt 里既有指令又有待处理的文本时,如果两者混在一起,模型有时会“搞混”——把数据当成指令的一部分,或者把指令当成需要处理的内容。这个现象在长文本处理中尤其常见。

3.2 实验

text = f"""
你应当通过尽可能清晰、具体的指令,来明确你希望模型完成的任务。
这能引导模型产出符合预期的结果,同时降低回复内容偏离主题或出现错误的概率。
不要把编写清晰的提示词和精简提示词混为一谈。
很多时候,篇幅更长的提示词能为模型提供更完整的说明与背景信息,进而让输出内容更加详实、贴合需求。
"""prompt = f"""
将三个反引号之间的文本总结为一句话
```{text}```
"""print(get_completion(prompt))

用三个反引号(```)把待处理的文本包裹起来,指令放在外面,这样数据和指令物理隔离,模型不会混。

3.3 为什么这样做有效?

分隔符的作用不只是“格式好看”——它给模型提供了明确的结构信号:

[指令区域] 将三个反引号之间的文本总结为一句话
[数据区域] ```...待处理文本...```

模型可以明确区分“什么是我要做的事”和“什么是我要处理的材料”,不会把数据内容误读为新的指令。常用的分隔符方案,供参考:

分隔符适用场景
```代码块、多行文本
"""长段落文字
XML 风格,结构更清晰
---简单分隔

四、Prompt 技巧二:约束输出格式

4.1 实验

让模型列出四大名著的信息,并要求以 JSON 格式返回,字段名称提前指定:

prompt = f"""
请列出四大名著,并标注对应的作者与书籍类型。
使用JSON格式呈现,需包含以下字段:
book_id(书籍编号)、title(书名)、author(作者)、desc(简介)、genre(书籍类型)
"""response = get_completion(prompt)
print(response)

模型返回了结构整齐的四条 JSON 数据,字段完整,格式规范。

4.2 格式约束的意义

有意思的是,很多人写 Prompt 时只关注“要什么信息”,却忘了说“要什么格式”。实际上,这两件事需要分开说、都说清楚。

如果不约束格式,模型可能用自然语言段落、Markdown 表格、Python 字典……形式随意,下游程序没法直接使用。但约束为 JSON 之后:

import json
data = json.loads(response)
# 直接可用,不需要任何额外解析

这是 Prompt 工程里非常实用的一条原则:输出格式是给程序看的,不只是给人看的。 在 AI 应用开发中,模型的输出往往是数据流水线的一环,格式稳定是下游处理的前提。

4.3 常用格式约束方式

场景建议格式
结构化数据,需程序处理JSON(指定字段名)
列表类输出Markdown 列表 或 JSON 数组
文本摘要、翻译纯文本,无需格式
多任务并行输出XML 标签分区,如 ...

五、Prompt 技巧三:条件判断——让模型识别输入类型

5.1 实验设计

用同一个 Prompt 模板处理两段性质完全不同的文字:

  • 文本一:泡茶的操作步骤(有明确的动作序列)
  • 文本二:晴天公园的景色描写(纯描述性文字,无操作指引)

Prompt 的逻辑是:有步骤就格式化输出,没有步骤就直接返回固定声明。

# 文本一:泡茶步骤
text = f"""
泡一杯茶其实很简单!首先把水烧开。烧水的同时,拿出茶杯,放入茶包。
水烧开后,将热水冲入杯中浸泡茶包。静置片刻让茶香析出。
几分钟后,根据个人口味,还可以加入糖或牛奶。这样一杯美味的茶饮就泡好了。
"""prompt = f"""
你将收到由三引号包裹的文本。若文本中包含一系列操作指令,
请按照下述格式重新整理这些指令。
步骤 一 ...
步骤 二 ...
...
步骤 N ...
如果文本中没有一系列操作指引,直接输出**"没有提供步骤。"**
"""{text}"""
"""print(get_completion(prompt))
# 文本二:公园景色描写
text_2 = f"""
今日阳光明媚,鸟儿欢唱。这样的好天气很适合去公园散步。
花儿竞相绽放,树木在微风中轻轻摇曳。
人们纷纷出门,享受这宜人的天气……
"""

结果:文本一被正确拆分为步骤列表;文本二返回“未提供步骤”,判断准确。

5.2 分析:Prompt 可以携带逻辑

这个实验打破了一个常见的认知误区:很多人以为 Prompt 只是“提问”,其实它可以携带完整的判断逻辑。

IF 文本包含操作步骤
    THEN 格式化输出步骤列表
ELSE
    THEN 输出固定文本

这段逻辑用自然语言写进 Prompt,模型完全能理解并执行。这意味着 Prompt 本身就是一种轻量级的业务规则描述语言——在不写代码的情况下,可以处理一定复杂度的分类和判断任务。


六、Prompt 技巧四:Few-Shot 少样本提示

6.1 实验

直接问“何为韧性”,模型会给你一段平铺直叙的解释。但如果先给一个示例,效果截然不同:

prompt = f"""
你的任务是保持统一的行文风格作答。提问:请讲讲何为耐心。
回答:能凿出幽深峡谷的江河,源自涓涓细流;
      恢弘壮阔的交响乐,起于单个音符;
      精美繁复的织锦,始于一缕丝绒。请问:请讲讲何为韧性。
"""print(get_completion(prompt))

模型的回答延续了示例的风格——依然是三句比喻并列,依然是“A 起于 B”的句式结构,甚至意象的层次感也保持一致。

6.2 为什么 Few-Shot 比描述风格更有效?

这是今天最有收获的实验之一。两种做法对比一下:

描述风格的方式:比如“请你用诗意、排比的风格回答”,描述越详细越难写准,而且模型对“诗意”这类抽象词的理解因人而异。

Few-Shot 的方式:模型会自动从示例中提取风格特征——句式、节奏、意象选取方式、逻辑结构,并迁移到新的问题上。说白了,样本传递的信息密度,远高于文字描述。

6.3 Few-Shot 的使用场景

场景是否适合 Few-Shot
特定写作风格复现 非常适合
格式模板固定的输出 适合
分类任务(如情感判断) 提供正负样本效果好
事实性问答️ 意义不大,不如直接问
需要泛化到未见类别️ Zero-Shot 可能更合适

七、Prompt 技巧五:多步任务链——引导模型分步推理

7.1 实验

把四个子任务打包进一个 Prompt,要求模型按顺序逐步完成:

text = f"""
在一座风光宜人的小村庄里,姐弟俩杰克和吉尔动身前往山顶的水井取水。
两人一路欢歌向上攀登,不料意外突生——杰克被石头绊倒,滚下山坡,
吉尔也跟着摔了下去。二人虽受了些轻伤,还是回到了家中,得到家人温柔的安抚。
"""prompt = f"""
执行以下操作:
1. 将三个反引号内的文本概括为一句话。
2. 把这句摘要翻译成法语。
3. 列出法语摘要中间出现的所有人名。
4. 输出JSON对象,包含字段:french_summary、num_names。
答案分行展示。文本:
```{text}```
"""print(get_completion(prompt))

模型依次完成了摘要 → 翻译 → 提取人名 → 封装 JSON,每一步的输出自然衔接为下一步的输入,最终结果格式干净。

7.2 分析:为什么要引导分步推理?

直接问“给我这段文字的法语摘要里有几个人名,用 JSON 返回”,模型有时会跳步——摘要不够准确,或者人名提取出现遗漏。

让模型显式地一步步走,相当于强制它把中间推理过程“写出来”,每一步的结果都被检验过再进入下一步,减少了跳步导致的错误积累。

直接问答模式:输入 ──→ 输出(中间推理隐含,容易出错)分步推理模式:输入 → 步骤1输出 → 步骤2输出 → ... → 最终输出
                         ↑每步可验证

这个思路在更复杂的 AI 应用中(比如 Chain-of-Thought 提示、ReAct 框架)是核心原则之一,今天的实验是它最简单的形态。


八、幻觉:LLM 的边界问题

8.1 实验

prompt = f"""
介绍一下博依品牌的喜多多饮料
"""
print(get_completion(prompt))

“博依”是一个不存在的品牌(或者极其小众),但模型没有回答“我不了解这个品牌”,而是给出了一段有模有样的介绍:产品特点、目标人群、市场定位……读起来像真的,但全是编的。

8.2 幻觉的本质

LLM 的工作原理是基于概率预测下一个 token,它不是在检索数据库,也没有“不知道”这个选项——当它遇到没见过的信息时,会用“听起来最合理”的内容填充。

人类遇到不知道的问题:
"我不了解这个品牌,没有相关信息。"LLM 遇到不知道的问题:
生成一段在统计上"像真实品牌介绍"的文本。

这不是模型的 bug,是它的工作机制本身决定的。模型的强项是语言理解和生成,不是事实存储和检索。

8.3 应对策略

场景建议
创意写作、风格转换、格式处理可以充分信任模型输出
知识性问答、品牌/人物/数据必须用外部资料验证
代码生成需要运行测试,不能只看“看起来对”
需要引用文献或数据来源模型会编造,务必核查原始来源

在实际应用开发中,通常的解法是RAG(检索增强生成):先从可信数据源检索相关文档,再把文档内容作为上下文传给模型,让它基于真实资料回答,而不是凭空生成。


九、总结

今天围绕 Prompt 工程做了五组实验,把学到的规律整理如下:

Prompt 工程的五条核心原则
├── 用分隔符隔离数据与指令  → 防止模型混淆输入结构
├── 约束输出格式            → 让结果可被程序直接消费
├── 写入条件判断逻辑        → Prompt 本身是业务规则
├── Few-Shot 给示例         → 样本比描述风格更精准
└── 分步骤引导推理          → 减少跳步错误,提升稳定性

最后加上对幻觉问题的认识:模型不会说“我不知道”,使用者要知道什么时候该信它。

Prompt 不是魔法咒语,背后是明确的逻辑——你给的上下文越清晰,约束越具体,模型的输出就越稳定、越可用。

本文内容来源于互联网,如有侵权请联系删除。
作者最新文章
相关文章 更多
PDF转Word的4种方法及结果核对步骤
PDF转Word的4种方法及结果核对步骤

本文提供PDF转Word的4种方法:在线工具(极轻PDF)、本地专业软件、Microsoft Office内置功能及Adobe Acrobat Pro。重点说明转换前备份原文件、转换中核对参数、转换后检查文字编辑性、图片位置、表格及页码等关键步骤,确保文件可用。

联发科天玑9600 Pro首发2nm:能效与游戏渲染技术详解
联发科天玑9600 Pro首发2nm:能效与游戏渲染技术详解

联发科宣布将于9月15日14:30发布天玑9600系列,其中Pro版采用台积电第二代2nm N2P工艺,为品牌首款2nm手机芯片。相比N3E,该制程在相同功耗下性能提升最高18%,功耗降低约36%。芯片主打能效、游戏光追及4K 240fps影像能力,标准版则基于3nm工艺。

OPPO Find X10 Pro Max 影像规格详解:三颗2亿像素镜头与全焦段8K视频能力
OPPO Find X10 Pro Max 影像规格详解:三颗2亿像素镜头与全焦段8K视频能力

OPPO Find X10 Pro Max 搭载全球首个三2亿像素镜头群,支持全焦段8K Log视频拍摄。主摄首发DeepPix技术实现17档高动态范围,超广角与长焦均配备2亿像素传感器及专业级防抖。该机将首发搭载ColorOS 17,预计于2026年9月17日大会发布。

PDF怎么编辑修改内容?4招处理方法整理
PDF怎么编辑修改内容?4招处理方法整理

本文整理修改PDF内容的4种方法:在线工具(极轻PDF)、本地编辑器、Adobe Acrobat Pro及本地转换器。操作前需复制原件以防版式错乱,处理后必须核对文字层、图片位置、版式及页码。适用于需快速修改、精细调整或处理敏感/大体积文件的场景。

视频剪辑学习路线:从软件操作到镜头语言与项目实战
视频剪辑学习路线:从软件操作到镜头语言与项目实战

本文提供视频剪辑的三步学习路径:掌握软件基础操作、理解镜头语言逻辑,并通过30秒短片项目实战检验成果。旨在帮助初学者避免仅关注按钮操作,建立以节奏和叙事为核心的剪辑思维,提供可执行的练习标准与检查清单。

小米新机获入网许可,参数与14 Pro相近,或为增大电池版将推换新服务
小米新机获入网许可,参数与14 Pro相近,或为增大电池版将推换新服务

最新消息显示,小米一款型号为23116PN5BC的全新机型已经获得入网许可,其核心参数与小米14Pro几乎一致,但电池容量提升至5000mAh典型容量值。与此同时,小米14系列重新备案,或计划为老用户们提供付费电池更换服务。

曝苹果首款触控MacBook Pro基本敲定!OLED屏+M6芯片
曝苹果首款触控MacBook Pro基本敲定!OLED屏+M6芯片

苹果首款触控MacBookPro已基本敲定,将搭载OLED显示屏,支持120HzProMotion自适应刷新率,亮度更高,对比度更佳。配备M6Pro或M6Max芯片,采用3nm制程工艺,CPU与GPU性能较前代大幅提升。整机设计更加轻薄,重量或低于1.5千克,厚度可能缩减至14毫米,屏幕采用窄边框设计,可能命名为MacBookUltra。外观沿用灵动岛设计,

铁威马推出 F4-425 Pro 铝合金 NAS:可选酷睿 i3-N305/N350、首搭 TOS 7 操作系统强调 AI 功能,3799 元起
铁威马推出 F4-425 Pro 铝合金 NAS:可选酷睿 i3-N305/N350、首搭 TOS 7 操作系统强调 AI 功能,3799 元起

铁威马发布F4-425Pro铝合金NAS,搭载AI原生TOS7系统,支持自然语言交互。配备4个3.5英寸SATA盘位和3个M.2固态位,最大容量达152TB。可选酷睿i3-N305或N350处理器,搭配8或16GBDDR5内存,接口包括2个5GbE、USB-C及HDMI,起售价为3799元。

荣耀 X80 Pro Max 手机获 SGS 五星抗摔认证 并推出免费换屏服务
荣耀 X80 Pro Max 手机获 SGS 五星抗摔认证 并推出免费换屏服务

荣耀X80ProMax获SGS金标五星抗摔认证,达3米最高抗摔水平,行业首个两年免费换屏。搭载11000mAh电池、90W快充、6.8寸120Hz屏及骁龙6Gen5,主打极致续航与耐用性。

传音推出 Tecno Spark 50 Pro 手机:6.78 英寸 120Hz LCD 屏 联发科 Helio G100U 芯片
传音推出 Tecno Spark 50 Pro 手机:6.78 英寸 120Hz LCD 屏 联发科 Helio G100U 芯片

传音发布TecnoSpark50Pro中端手机,6.78英寸120HzLCD屏,联发科HelioG100芯片,提供6000mAh或5600mAh电池及60W快充,厚7.8mm,后置5000万像素索尼主摄,支持内存融合至24GB虚拟内存。

查看更多
精品专题 更多
装机必备
装机必备

正软商城装机必备专区,精选办公、浏览器、安全防护、影音播放、压缩解压、设计创作和系统工具等电脑常用正版软件,帮助用户快速完成新电脑软件配置。

Windows
Windows

正软商城Windows软件专区,汇集适用于Windows电脑的办公、设计、安全防护、影音播放、开发工具和系统优化软件,提供软件介绍、系统要求、正版授权及购买下载服务。

macOS软件
macOS软件

正软商城macOS软件专区,精选适用于Mac电脑的办公、设计、影音、效率、开发和系统工具,提供软件功能介绍、macOS兼容版本、正版授权及购买下载服务。

Mac软件 更多
灵活计算器
灵活计算器
macOS/iOS/Android

灵活计算器是一款笔记式算数应用,支持实时计算、动态关联和云端同步功能。记录、整理和输出之间的过渡会更自然,适合长期写作、做笔记或持续沉淀个人内容。

赤友清理大师
赤友清理大师
macOS

赤友清理大师是一款为 Mac 设计的智能清理优化工具,可精准扫描垃圾、大文件、重复文件等,释放磁盘空间。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

极度公式
极度公式
Windows/macOS/Linux

极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

WINDOWS 更多
Windows 10
Windows 10
Windows

Windows 10 是一款微软推出的经典操作系统,拥有硬件兼容性与多任务处理能力。它更偏向把系统状态查看和常用调节动作放在一起,适合需要持续观察和微调设备状态的场景。

极度公式
极度公式
Windows/macOS/Linux

极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

密码键盘
密码键盘
Windows/macOS/iOS/Android

密码键盘是一款兼具安全性与便捷性的高效密码管理器。日常使用里的持续防护和信息管理会更突出,适合把安全控制放进长期使用流程中的场景。