AI百科 知识蒸馏是什么?大模型「缩水不缩智」的秘诀 手机里能跑的大模型,几乎都是蒸馏出来的。今天用大白话把这事讲清楚。蒸馏的意思很简单:大模型当老师,小模型当学生,学生不从头学,直接学老师给出的答案。老教授带研究生就是这么个逻辑,研究生不用把图书馆的书... AI百科 2026-08-08 173 #知识蒸馏 #大模型 #DeepSeek-R1 #AI科普 #模型压缩 #端侧AI
AI百科 大模型上下文窗口是什么?从4K到1M的进化 刚接触AI的人常被「上下文窗口」这个词卡住。其实它就是AI一次能记住多少内容的容量。GPT-3时代只有4K个token,大概三千个汉字,聊几句天就忘了开头。到了2026年,百万级窗口的产品已经量产,一... AI百科 2026-08-08 84 #上下文窗口 #Token #大模型科普 #AI知识
科技百科 大模型「慢思考」是什么?推理模型科普 今年年初DeepSeek R1刷屏的时候,很多人第一次听说「推理模型」这个词。其实这东西解决了一个特别实在的问题:以前的AI答数学题像抢答,题目还没读完就张嘴说答案,错得理直气壮。推理模型不一样,它... 科技百科 2026-08-08 81 #推理模型 #思维链 #DeepSeek R1 #大模型科普
AI百科 MoE混合专家模型是什么?大模型省钱的秘密 DeepSeek-V3发布的时候,有个数字让很多人懵了一下:总参数六千七百多亿,但每回答一个问题,实际只激活三百七十亿参数。总参数和激活参数差着快二十倍,还能正常工作。它靠的就是MoE架构,全称混合... AI百科 2026-08-07 134 #MoE #混合专家模型 #大模型原理 #AI科普
AI百科 AI搜索是怎么工作的:从抓取网页到生成答案,一次讲透 你问AI「2026年性价比高的云服务器是哪家」,它几秒钟给你一段带推荐、带价格的答案,底下还标着参考来源。这背后不是简单地把搜索结果喂给大模型,而是一套跟传统搜索引擎完全不同的流水线。这篇文章用大白... AI百科 2026-08-07 118 #AI搜索原理 #GEO优化 #语义检索 #大模型 #搜索引擎 #内容优化
科技百科 Chrome浏览器自带AI了:Gemini Nano本地跑,不联网也能用 上个月我把用了五年的老笔记本翻出来,装了最新版Chrome,随手点了下翻译整页,居然秒出结果,断网状态也一样。查了一下才知道,浏览器早就不是当年那个只管开网页的工具了——Chrome从2024年开始往... 科技百科 2026-08-07 76 #Chrome内置AI #Gemini Nano #本地AI #浏览器AI #Prompt API #端侧模型 #离线翻译
AI百科 AI Agent 2026年发展现状:从玩具到能用的工具 2025年大家还在讨论AI Agent是不是概念炒作,到了2026年,答案已经很清楚了:Agent是AI应用层2026年最值得关注的方向,没有之一。我过去三个月在公司和自己的项目里深度试了几个Agen... AI百科 2026-08-01 236 #AI Agent #Claude Code #Manus #AI百科 #人工智能
科技百科 HTTP/3和QUIC协议到底解决了什么问题 去年年底我们站点切了HTTP/3,到现在刚好满半年。说几个真实数据:页面首字节时间从420ms降到了190ms,弱网环境(4G信号两格那种)的加载完成时间从8.7秒缩短到了3.1秒。效果比我想象的好不... 科技百科 2026-08-01 100 #HTTP/3 #QUIC协议 #网站性能优化 #网络协议
AI百科 我拿一个7B模型跑了LoRA和全参微调,差距比想象的小 周末干了一件事:把Qwen2.5-7B模型用我自己写的200篇博客文章做微调,分别试了全参微调和LoRA两种方式。结论先说:LoRA的效果比我想的好,全参微调的成本比我想的高。 实验环境 租了RunP... AI百科 2026-07-31 135 #LoRA #大模型微调 #AI科普 #全参微调 #QLoRA
AI百科 一文搞懂AI Agent:2026年为什么大家都在说智能体 如果你关注AI,2026年绕不开一个词:Agent(智能体)。如果你没时间读长文,一句话解释:普通AI是你问它答,Agent是给它一个目标,它会自己拆解步骤、调用工具、检查结果,直到完成任务。下面展开... AI百科 2026-07-31 115 #AI百科 #AI Agent #智能体 #2026AI