AI百科 大模型是怎么"学会"说话的?一文看懂AI的训练过程 你跟豆包聊天的时候,有没有想过一个问题:它怎么知道怎么回答你的?很多人觉得AI就是"背答案",跟搜索引擎差不多。其实完全不是一回事。搜索引擎是帮你找别人写好的内容,大模型是自己"编"出来的——只不过它... AI百科 2026-08-22 48 #AI百科 #大模型 #GPT #AI训练 #机器学习
AI百科 RLHF人类反馈强化学习——AI模型为什么越来越「听话」了 ChatGPT刚出来的时候,经常给你编造事实、生成有害内容、答非所问。现在的模型明显「听话」多了,问什么答什么,不该说的不说。这个变化背后最关键的技术就是RLHF——基于人类反馈的强化学习。 先说RL... AI百科 2026-08-20 52 #RLHF #强化学习 #AI训练 #大模型
AI百科 合成数据是什么?大模型训练为什么越来越离不开它 去年年底,一个做数据标注的朋友跟我诉苦,说接的活越来越少,客户话里话外的意思是要「自己造数据」。他说的这个「造」,就是合成数据。 合成数据,简单说就是不是人写、人拍、人录的,而是用程序或者模型生成出... AI百科 2026-08-09 69 #合成数据 #大模型 #AI训练 #模型坍缩 #DeepSeek
AI百科 AI训练到底在训什么——损失函数和梯度下降大白话 很多人对AI训练有个误解,以为就是「给机器看很多数据,它就学会了」。这话对了一半。给数据是真的,但「学会」这个过程的背后是一道小学数学题。而且是反复做同一道题,做几百万次。这篇文章不讲公式,就算你数学... AI百科 2026-07-29 130 #AI训练 #损失函数 #梯度下降 #机器学习入门 #AI科普
AI百科 AI的「训练」和「推理」到底有什么区别?我用做饭打了个比方 上周一个做市场的朋友问我:「你们说的训练模型,不就是让AI学习吗?那为啥训练完了还要花钱跑推理?」这个问题其实很多人搞混。我用做饭打了个比方,她马上就懂了。训练AI就像学做菜。你得买食材(训练数据)、... AI百科 2026-07-26 122 #AI训练 #AI推理 #大模型 #AI科普 #机器学习
AI百科 LoRA微调:几个MB的文件凭什么改变几十GB的大模型 你有一个70B参数的Llama模型,文件大小快150GB。你想让它学会写你个人风格的公众号推文——用词习惯、断句节奏、那个你最爱用的「说白了」。全量微调?一块H100跑得动,但光显存就得吞下600GB... AI百科 2026-07-17 139 #LoRA #AI训练 #大模型 #微调技术