王尘宇
  • 首页
  • 科技百科
  • 网站优化
  • 网络推广
  • 工具资源
  • 经验分享
  • 网站建设
首页 包含"AI科普"标签的文章
模型微调是什么?什么时候该微调,什么时候纯属浪费钱 AI百科

模型微调是什么?什么时候该微调,什么时候纯属浪费钱

这两年凡是做AI应用的,都绕不开一个词:微调,英文叫Fine-tuning。市场上卖课的把它吹成包治百病,网上教程把它写得像魔法。其实拆开看,它就是一件很朴素的事:在别人训练好的大模型基础上,用你自己...

AI百科 2026-08-12 62 #模型微调 #Fine-tuning #AI科普 #大模型 #本地部署

Transformer为什么是AI的基石?注意力机制用大白话讲清楚 AI百科

Transformer为什么是AI的基石?注意力机制用大白话讲清楚

这两年AI火成这样,背后最大的功臣是一个叫Transformer的技术,2026年所有主流大模型——GPT、Claude、豆包、DeepSeek——全是它家底子。这篇用大白话讲清楚它到底是什么,为什么...

AI百科 2026-08-10 64 #Transformer #注意力机制 #大模型 #AI科普

知识蒸馏是什么?大模型「缩水不缩智」的秘诀 AI百科

知识蒸馏是什么?大模型「缩水不缩智」的秘诀

手机里能跑的大模型,几乎都是蒸馏出来的。今天用大白话把这事讲清楚。蒸馏的意思很简单:大模型当老师,小模型当学生,学生不从头学,直接学老师给出的答案。老教授带研究生就是这么个逻辑,研究生不用把图书馆的书...

AI百科 2026-08-08 118 #知识蒸馏 #大模型 #DeepSeek-R1 #AI科普 #模型压缩 #端侧AI

MoE混合专家模型是什么?大模型省钱的秘密 AI百科

MoE混合专家模型是什么?大模型省钱的秘密

DeepSeek-V3发布的时候,有个数字让很多人懵了一下:总参数六千七百多亿,但每回答一个问题,实际只激活三百七十亿参数。总参数和激活参数差着快二十倍,还能正常工作。它靠的就是MoE架构,全称混合...

AI百科 2026-08-07 107 #MoE #混合专家模型 #大模型原理 #AI科普

我拿一个7B模型跑了LoRA和全参微调,差距比想象的小 AI百科

我拿一个7B模型跑了LoRA和全参微调,差距比想象的小

周末干了一件事:把Qwen2.5-7B模型用我自己写的200篇博客文章做微调,分别试了全参微调和LoRA两种方式。结论先说:LoRA的效果比我想的好,全参微调的成本比我想的高。 实验环境 租了RunP...

AI百科 2026-07-31 115 #LoRA #大模型微调 #AI科普 #全参微调 #QLoRA

AI训练到底在训什么——损失函数和梯度下降大白话 AI百科

AI训练到底在训什么——损失函数和梯度下降大白话

很多人对AI训练有个误解,以为就是「给机器看很多数据,它就学会了」。这话对了一半。给数据是真的,但「学会」这个过程的背后是一道小学数学题。而且是反复做同一道题,做几百万次。这篇文章不讲公式,就算你数学...

AI百科 2026-07-29 137 #AI训练 #损失函数 #梯度下降 #机器学习入门 #AI科普

不用写代码也能做AI应用?MCP到底是个什么东西 AI百科

不用写代码也能做AI应用?MCP到底是个什么东西

去年10月Anthropic发布MCP的时候,我其实没太当回事。心想又是一个"协议"——技术圈的协议太多了,大部分活不过半年。 结果今年3月份之后,事情不太对了。OpenAI、Google、微软全都...

AI百科 2026-07-28 110 #MCP #AI Agent #协议 #AI科普 #AI百科

Token到底是什么?说人话解释大模型怎么「看懂」你打的字 AI百科

Token到底是什么?说人话解释大模型怎么「看懂」你打的字

如果你用过ChatGPT、豆包或者DeepSeek的API,你一定见过「Token」这个词。定价表上写着「每百万Token XX元」,模型参数写着「上下文窗口128K Token」。但Token到底...

AI百科 2026-07-27 161 #Token #大模型 #AI科普 #API #LLM

AI的「训练」和「推理」到底有什么区别?我用做饭打了个比方 AI百科

AI的「训练」和「推理」到底有什么区别?我用做饭打了个比方

上周一个做市场的朋友问我:「你们说的训练模型,不就是让AI学习吗?那为啥训练完了还要花钱跑推理?」这个问题其实很多人搞混。我用做饭打了个比方,她马上就懂了。训练AI就像学做菜。你得买食材(训练数据)、...

AI百科 2026-07-26 126 #AI训练 #AI推理 #大模型 #AI科普 #机器学习

大模型的Token和上下文窗口:用人话讲清楚这两个概念 AI百科

大模型的Token和上下文窗口:用人话讲清楚这两个概念

如果你用过ChatGPT或者Claude,你可能注意到过"上下文长度"和"Token限制"这两个词。今天用大白话把这俩概念说清楚——不堆术语,不写公式。 Token是什么? 大模型不能直接"读"汉...

AI百科 2026-07-26 126 #ai #Token #上下文窗口 #大模型 #AI科普

1 2 3 4 5 下页 尾页

最新文章

  • 百度不收录新站?先把这几件事做齐,别天天只提交链接

    百度不收录新站?先把这几件事做齐,别天天只提交链接

    2026-08-29 0
  • 手机上这几个 AI 修图 App,发朋友圈不用再开电脑了

    手机上这几个 AI 修图 App,发朋友圈不用再开电

    2026-08-29 0
  • 抖音播放量上不去?先别怪算法,看看完播率这关过没过

    抖音播放量上不去?先别怪算法,看看完播率这关过没过

    2026-08-29 0
  • 做视频的人别错过,这三个 AI 字幕工具我天天在用

    做视频的人别错过,这三个 AI 字幕工具我天天在用

    2026-08-29 0
  • 专家混合模型(MoE)到底是啥,为什么 2026 年大模型都在用

    专家混合模型(MoE)到底是啥,为什么 2026 年

    2026-08-29 0
  • 网站突然 502 怎么办?照着这个顺序查,十次有八次能定位

    网站突然 502 怎么办?照着这个顺序查,十次有八次

    2026-08-29 0

热门标签

  • 淘宝 (14266)
  • 店铺 (6731)
  • 商家 (4549)
  • 卖家 (3493)
  • 天猫 (3420)
  • 商品 (3264)
  • 用户 (3081)
  • 抖音 (3051)
  • 京东 (2975)
  • 电商 (2931)
  • 活动 (2733)
  • 平台 (2725)
  • 多多 (2196)
  • 00 (2019)
  • 推广 (1987)
  • 关键词 (1889)
  • SEO (1725)
  • 视频 (1681)
  • 618 (1621)
  • 网站 (1604)

热门文章

  • 1.做视频的人别错过,这三个 AI 字幕工具我天天在用
  • 2.专家混合模型(MoE)到底是啥,为什么 2026 年大模型都在用
  • 3.百度不收录新站?先把这几件事做齐,别天天只提交链接
  • 4.手机上这几个 AI 修图 App,发朋友圈不用再开电脑了
  • 5.抖音本地生活团购实操:小店怎么上团购、找达人、做核销
  • 6.做视频缺BGM?8个免费音效音乐素材站,商用也不怕
  • 7.抖音视频播放量卡在500怎么办——5个我自己试过的方法
  • 8.抖音播放量上不去?先别怪算法,看看完播率这关过没过

关于本站

15余年西安SEO网站优化推广经验,提供百度推广优化,网络推广外包,网站排名优化服务,致力于前沿的网络推广技术,为中小企业提供全面的网络推广营销解决方案。
Copyright © 2009 本站由 王尘宇seo陕ICP备2022011564号

联系我们

合作或咨询可通过如下方式:

QQ:314111741

微博:weibo.com/24065479

微信:wangshifucn

关注我们

王尘宇二维码
二维码