AI百科 模型微调是什么?什么时候该微调,什么时候纯属浪费钱 这两年凡是做AI应用的,都绕不开一个词:微调,英文叫Fine-tuning。市场上卖课的把它吹成包治百病,网上教程把它写得像魔法。其实拆开看,它就是一件很朴素的事:在别人训练好的大模型基础上,用你自己... AI百科 2026-08-12 62 #模型微调 #Fine-tuning #AI科普 #大模型 #本地部署
AI百科 Transformer为什么是AI的基石?注意力机制用大白话讲清楚 这两年AI火成这样,背后最大的功臣是一个叫Transformer的技术,2026年所有主流大模型——GPT、Claude、豆包、DeepSeek——全是它家底子。这篇用大白话讲清楚它到底是什么,为什么... AI百科 2026-08-10 64 #Transformer #注意力机制 #大模型 #AI科普
AI百科 知识蒸馏是什么?大模型「缩水不缩智」的秘诀 手机里能跑的大模型,几乎都是蒸馏出来的。今天用大白话把这事讲清楚。蒸馏的意思很简单:大模型当老师,小模型当学生,学生不从头学,直接学老师给出的答案。老教授带研究生就是这么个逻辑,研究生不用把图书馆的书... AI百科 2026-08-08 118 #知识蒸馏 #大模型 #DeepSeek-R1 #AI科普 #模型压缩 #端侧AI
AI百科 MoE混合专家模型是什么?大模型省钱的秘密 DeepSeek-V3发布的时候,有个数字让很多人懵了一下:总参数六千七百多亿,但每回答一个问题,实际只激活三百七十亿参数。总参数和激活参数差着快二十倍,还能正常工作。它靠的就是MoE架构,全称混合... AI百科 2026-08-07 107 #MoE #混合专家模型 #大模型原理 #AI科普
AI百科 我拿一个7B模型跑了LoRA和全参微调,差距比想象的小 周末干了一件事:把Qwen2.5-7B模型用我自己写的200篇博客文章做微调,分别试了全参微调和LoRA两种方式。结论先说:LoRA的效果比我想的好,全参微调的成本比我想的高。 实验环境 租了RunP... AI百科 2026-07-31 115 #LoRA #大模型微调 #AI科普 #全参微调 #QLoRA
AI百科 AI训练到底在训什么——损失函数和梯度下降大白话 很多人对AI训练有个误解,以为就是「给机器看很多数据,它就学会了」。这话对了一半。给数据是真的,但「学会」这个过程的背后是一道小学数学题。而且是反复做同一道题,做几百万次。这篇文章不讲公式,就算你数学... AI百科 2026-07-29 137 #AI训练 #损失函数 #梯度下降 #机器学习入门 #AI科普
AI百科 不用写代码也能做AI应用?MCP到底是个什么东西 去年10月Anthropic发布MCP的时候,我其实没太当回事。心想又是一个"协议"——技术圈的协议太多了,大部分活不过半年。 结果今年3月份之后,事情不太对了。OpenAI、Google、微软全都... AI百科 2026-07-28 110 #MCP #AI Agent #协议 #AI科普 #AI百科
AI百科 Token到底是什么?说人话解释大模型怎么「看懂」你打的字 如果你用过ChatGPT、豆包或者DeepSeek的API,你一定见过「Token」这个词。定价表上写着「每百万Token XX元」,模型参数写着「上下文窗口128K Token」。但Token到底... AI百科 2026-07-27 161 #Token #大模型 #AI科普 #API #LLM
AI百科 AI的「训练」和「推理」到底有什么区别?我用做饭打了个比方 上周一个做市场的朋友问我:「你们说的训练模型,不就是让AI学习吗?那为啥训练完了还要花钱跑推理?」这个问题其实很多人搞混。我用做饭打了个比方,她马上就懂了。训练AI就像学做菜。你得买食材(训练数据)、... AI百科 2026-07-26 126 #AI训练 #AI推理 #大模型 #AI科普 #机器学习
AI百科 大模型的Token和上下文窗口:用人话讲清楚这两个概念 如果你用过ChatGPT或者Claude,你可能注意到过"上下文长度"和"Token限制"这两个词。今天用大白话把这俩概念说清楚——不堆术语,不写公式。 Token是什么? 大模型不能直接"读"汉... AI百科 2026-07-26 126 #ai #Token #上下文窗口 #大模型 #AI科普