准备 SFT 微调数据时,核心并不复杂:
给模型一条任务,再准备一个希望它学会的标准答案。
例如,想让模型学会把一句生硬的话改得更礼貌,就可以准备这样的训练数据:
用户输入:你这个文件写错了,重新改一下。标准回答:这份文件里有几处内容可能需要调整,麻烦你检查并修改一下。模型看过大量类似的“输入和标准回答”后,就会逐渐学会按照要求完成任务。
不过,不同模型和训练框架要求的数据写法并不相同:有的使用问答格式,有的拆分任务和答案,有的则采用对话格式。
这些写法看起来不同,但本质上都在表达同一件事:
用户给了什么内容,模型应该返回什么结果。
下面就用简单的例子,看看 SFT 最常见的数据格式分别是什么,以及它们适合哪些场景。
- 问答格式
问答格式最简单,适合知识问答。
{ "question": "什么是 RDB?", "answer": "RDB 是 Redis 的快照持久化方式。"}有些数据集也会写成:
{ "query": "什么是 RDB?", "response": "RDB 是 Redis 的快照持久化方式。"}虽然字段名称不同,但表达的意思相同:
- •
question或query:用户提出的问题; - •
answer或response:希望模型学会的答案。
这种格式适合:
- • 知识问答;
- • 客服问答;
- • 企业内部问答;
- • 专业领域助手。
- Instruction 格式
Instruction 格式也叫 Alpaca 格式。
它不只适合问答,还可以用来训练模型完成总结、翻译、分类和改写等任务。
{ "instruction": "解释 RDB 和 AOF 的区别", "input": "", "output": "RDB 通过快照保存数据,AOF 通过记录写命令保存数据。"}如果任务中还有需要处理的内容,可以放在input中:
{ "instruction": "总结下面的内容", "input": "Redis 支持 RDB 和 AOF 两种持久化方式。", "output": "Redis 提供两种主要的数据持久化方案。"}三个字段分别表示:
- •
instruction:要求模型做什么; - •
input:需要处理的内容; - •
output:希望模型生成的标准答案。
可以把它理解为:
instruction:任务要求input:任务材料output:标准结果- Messages 对话格式
Messages 是聊天模型微调中常见的数据格式。
它会按照真实聊天的方式,记录不同角色说了什么,既可以表示单轮对话,也可以表示多轮对话。
单轮对话
{ "messages": [ { "role": "system", "content": "你是一名 Redis 技术助手。" }, { "role": "user", "content": "什么是 RDB?" }, { "role": "assistant", "content": "RDB 是 Redis 的快照持久化方式。" } ]}其中常见的角色有:
- •
system:规定模型身份和回答要求; - •
user:用户输入; - •
assistant:希望模型学会的回答。
例如:
{ "role": "system", "content": "你是一名 Redis 技术助手,回答要通俗易懂。"}这句话是在告诉模型,应该以什么身份、什么方式回答用户。
多轮对话
如果一条数据中包含多次连续交流,就是多轮对话:
{ "messages": [ { "role": "user", "content": "什么是 RDB?" }, { "role": "assistant", "content": "RDB 是 Redis 的快照持久化方式。" }, { "role": "user", "content": "它有什么缺点?" }, { "role": "assistant", "content": "Redis 突然故障时,最近一次快照之后的数据可能会丢失。" } ]}第二个问题中的“它”,指的是上一轮提到的 RDB。模型需要结合前面的内容,才能正确理解并回答。
Messages 格式适合聊天助手、连续问答、客服沟通、故障排查和上下文追问。
需要注意,多轮对话必须前后相关,不能把几个完全无关的问题随意拼在一起。
- 3种格式有什么区别?
| 格式 | 常见字段 | 适合场景 |
|---|---|---|
| 问答格式 | question/answer | 简单知识问答 |
| Instruction 格式 | instruction/input/output | 总结、翻译、分类、改写等任务 |
| Messages 格式 | messages、role/content | 单轮聊天、多轮对话、角色设定和上下文追问 |
最后唠两句
为什么AI大模型成为越来越多程序员转行就业、升职加薪的首选
很简单,这些岗位缺人且高薪
智联招聘的最新数据给出了最直观的印证:2025年2月,AI领域求职人数同比增幅突破200% ,远超其他行业平均水平;整个人工智能行业的求职增速达到33.4%,位居各行业榜首,其中人工智能工程师岗位的求职热度更是飙升69.6%。
AI产业的快速扩张,也让人才供需矛盾愈发突出。麦肯锡报告明确预测,到2030年中国AI专业人才需求将达600万人,人才缺口可能高达400万人,这一缺口不仅存在于核心技术领域,更蔓延至产业应用的各个环节。
那0基础普通人如何学习大模型 ?
深耕科技一线十二载,亲历技术浪潮变迁。我见证那些率先拥抱AI的同行,如何建立起效率与薪资的代际优势。如今,我将积累的大模型面试真题、独家资料、技术报告与实战路线系统整理,分享于此,为你扫清学习困惑,共赴AI时代新程。
我整理出这套 AI 大模型突围资料包【允许白嫖】:
- ✅从入门到精通的全套视频教程
- ✅AI大模型学习路线图(0基础到项目实战仅需90天)
- ✅大模型书籍与技术文档PDF
- ✅各大厂大模型面试题目详解
- ✅640套AI大模型报告合集
- ✅大模型入门实战训练
这份完整版的大模型 AI 学习和面试资料已经上传CSDN,朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费领取【保证100%免费】
①从入门到精通的全套视频教程
包含提示词工程、RAG、Agent等技术点
② AI大模型学习路线图(0基础到项目实战仅需90天)
全过程AI大模型学习路线
③学习电子书籍和技术文档
市面上的大模型书籍确实太多了,这些是我精选出来的
④各大厂大模型面试题目详解
⑤640套AI大模型报告合集
⑥大模型入门实战训练
如果说你是以下人群中的其中一类,都可以来智泊AI学习人工智能,找到高薪工作,一次小小的“投资”换来的是终身受益!
应届毕业生:无工作经验但想要系统学习AI大模型技术,期待通过实战项目掌握核心技术。
零基础转型:非技术背景但关注AI应用场景,计划通过低代码工具实现“AI+行业”跨界。
业务赋能 突破瓶颈:传统开发者(Java/前端等)学习Transformer架构与LangChain框架,向AI全栈工程师转型。
👉获取方式:
有需要的小伙伴,可以保存图片到wx扫描二v码免费领取【保证100%免费】🆓