AI百科 专家混合模型(MoE)到底是啥,为什么 2026 年大模型都在用 看 2026 年发布的大模型,参数动不动几万亿,但点一下回复也没等半天。秘密大多在一个叫 MoE 的结构上。今天用大白话讲。 把模型想象成一家公司。普通模型(稠密模型)是全员上阵,来一个活儿,从前台到... AI百科 2026-08-29 486 #AI术语 #MoE模型 #大模型原理
AI百科 大模型是怎么读懂文字的?先弄明白Embedding这件事 很多人以为大模型真的在「理解」语言,其实底层干的事特别机械:它先把每个词、每句话变成一串数字。这串数字就叫向量,或者Embedding。 打个比方。你给「苹果」这个词编一个1500位的数字列表,「香蕉... AI百科 2026-08-28 86 #Embedding #大模型原理 #向量 #语义搜索 #RAG
AI百科 MoE混合专家模型是什么?大模型省钱的秘密 DeepSeek-V3发布的时候,有个数字让很多人懵了一下:总参数六千七百多亿,但每回答一个问题,实际只激活三百七十亿参数。总参数和激活参数差着快二十倍,还能正常工作。它靠的就是MoE架构,全称混合... AI百科 2026-08-07 122 #MoE #混合专家模型 #大模型原理 #AI科普
AI百科 大模型为什么会“一本正经地胡说八道”?用大白话解释AI的原理 上周有个做外贸的朋友问我:“你们天天说大模型、大模型,这东西到底怎么工作的?为什么有时候特别聪明,有时候连'9.11和9.9哪个大'都能答错?”我想了想,这个问题确实值得写一篇。不是那种满篇“Tran... AI百科 2026-06-22 199 #AI科普 #大模型原理 #AI幻觉 #ChatGPT原理