AI百科 MoE混合专家模型是什么?大模型省钱的秘密 DeepSeek-V3发布的时候,有个数字让很多人懵了一下:总参数六千七百多亿,但每回答一个问题,实际只激活三百七十亿参数。总参数和激活参数差着快二十倍,还能正常工作。它靠的就是MoE架构,全称混合... AI百科 2026-08-07 26 #MoE #混合专家模型 #大模型原理 #AI科普
AI百科 AI搜索是怎么工作的:从抓取网页到生成答案,一次讲透 你问AI「2026年性价比高的云服务器是哪家」,它几秒钟给你一段带推荐、带价格的答案,底下还标着参考来源。这背后不是简单地把搜索结果喂给大模型,而是一套跟传统搜索引擎完全不同的流水线。这篇文章用大白... AI百科 2026-08-07 6 #AI搜索原理 #GEO优化 #语义检索 #大模型 #搜索引擎 #内容优化
AI百科 AI Agent 2026年发展现状:从玩具到能用的工具 2025年大家还在讨论AI Agent是不是概念炒作,到了2026年,答案已经很清楚了:Agent是AI应用层2026年最值得关注的方向,没有之一。我过去三个月在公司和自己的项目里深度试了几个Agen... AI百科 2026-08-01 159 #AI Agent #Claude Code #Manus #AI百科 #人工智能
AI百科 我拿一个7B模型跑了LoRA和全参微调,差距比想象的小 周末干了一件事:把Qwen2.5-7B模型用我自己写的200篇博客文章做微调,分别试了全参微调和LoRA两种方式。结论先说:LoRA的效果比我想的好,全参微调的成本比我想的高。 实验环境 租了RunP... AI百科 2026-07-31 47 #LoRA #大模型微调 #AI科普 #全参微调 #QLoRA
AI百科 一文搞懂AI Agent:2026年为什么大家都在说智能体 如果你关注AI,2026年绕不开一个词:Agent(智能体)。如果你没时间读长文,一句话解释:普通AI是你问它答,Agent是给它一个目标,它会自己拆解步骤、调用工具、检查结果,直到完成任务。下面展开... AI百科 2026-07-31 43 #AI百科 #AI Agent #智能体 #2026AI
AI百科 AI训练到底在训什么——损失函数和梯度下降大白话 很多人对AI训练有个误解,以为就是「给机器看很多数据,它就学会了」。这话对了一半。给数据是真的,但「学会」这个过程的背后是一道小学数学题。而且是反复做同一道题,做几百万次。这篇文章不讲公式,就算你数学... AI百科 2026-07-29 83 #AI训练 #损失函数 #梯度下降 #机器学习入门 #AI科普
AI百科 RAG是什么?2026年最实用的AI技术,五分钟入门 如果你关注AI但不想啃论文,RAG(检索增强生成)是目前最值得了解的技术之一。因为它解决了一个非常实际的问题:大模型会说瞎话。ChatGPT、Claude这些大模型的知识截止在训练数据那个时间点,而... AI百科 2026-07-29 43 #RAG #检索增强生成 #AI知识库 #向量数据库
AI百科 不用写代码也能做AI应用?MCP到底是个什么东西 去年10月Anthropic发布MCP的时候,我其实没太当回事。心想又是一个"协议"——技术圈的协议太多了,大部分活不过半年。 结果今年3月份之后,事情不太对了。OpenAI、Google、微软全都... AI百科 2026-07-28 53 #MCP #AI Agent #协议 #AI科普 #AI百科
AI百科 RAG到底是什么——用大白话讲清楚检索增强生成 2025-2026年AI圈最热的词之一就是RAG。但如果去搜定义,会发现全是论文腔:"检索增强生成是一种结合信息检索与文本生成的混合架构"。看完还是不知道这东西能干嘛。 我用最笨的方式解释一下。... AI百科 2026-07-28 48 #RAG #检索增强生成 #AI基础知识 #大模型 #向量数据库
AI百科 Token到底是什么?说人话解释大模型怎么「看懂」你打的字 如果你用过ChatGPT、豆包或者DeepSeek的API,你一定见过「Token」这个词。定价表上写着「每百万Token XX元」,模型参数写着「上下文窗口128K Token」。但Token到底... AI百科 2026-07-27 65 #Token #大模型 #AI科普 #API #LLM