![]()
编制说明:本手册专为彻底消除现代人工智能、大模型算法、智能体与底层硬件算力生态的行业黑话壁垒而打造。采用“技术原词 + 行业通用中文名 + 一句话大白话 + 接地气生活比喻 + 实际应用场景”的五维立体解析体系,涵盖 20 大核心板块、115 个高频专业术语。第 2 期聚焦【大模型大脑构造与核心机制】。
第一部分:软件、算法与大模型核心机制
二、大模型大脑构造与核心机制(Architecture & Mechanics)
本期收录第 07 ~ 15 号核心概念(全量配图版)
No.07Token
行业中文名:词元 / 标记 / 计费单位
一句话人话翻译
大模型阅读和输出文本时的“基本字符颗粒度”,也是大模型调用计费的基本度量衡。
☕ 通俗生活比喻
吃火锅串串香最后数的那根“竹签”,或者小学生作文本里的“方格”。在英文里 1 个单词约等于 1.3 个 Token;在中文里 1 个汉字通常占用 1~2 个 Token。
![]()
实际应用场景
“API 价格按每百万 Token 收费”、“对话输入加上回答一共消耗了 1500 个 Token”。
No.08Parameters (参数量,如 7B/70B/671B)
行业中文名:模型参数量 / 脑容量 / 神经网络权重数
一句话人话翻译
模型大脑内部负责储存知识与关联逻辑的“突触旋钮”总数量。
☕ 通俗生活比喻
大模型脑细胞的总数。7B(70亿)相当于机灵的小学生,70B(700亿)相当于博学大学生,671B(如 DeepSeek-V3 规模)相当于顶尖专家学者智囊团。
![]()
实际应用场景
决定了模型对硬件显存的需求以及解决复杂逻辑难题的能力上限。
No.09Transformer
行业中文名:变换器架构 / 变压器架构(大模型基石骨架)
一句话人话翻译
2017 年由 Google 提出的深度学习底层网络结构,它彻底改变了机器读文章的方式,可以同时看完一整篇文章并瞬间抓住所有词的相互联系。
☕ 通俗生活比喻
以前的 AI 读文章像用吸管喝珍珠奶茶,一次只能吸一颗(逐字读);Transformer 像把整杯奶茶倒在透明盘子里一眼看穿全局,谁和谁挨着一清二楚。
![]()
实际应用场景
所有现代大模型(GPT系列、Llama、BERT、Stable Diffusion 文本编码器等)的底层骨架。
No.10Attention Mechanism (Self-Attention)
行业中文名:注意力机制 / 自注意力机制
一句话人话翻译
模型在读一句话中的某个词时,能自动分配注意力,知道这句话里的其他哪些词与它关联最紧密。
☕ 通俗生活比喻
读悬疑小说看到“凶手在雨夜掏出了它”,你的大脑会瞬间把“它”和上一页提到的“带血的匕首”建立强连接,而不是连到“雨夜”。
![]()
实际应用场景
消除代词歧义、理解复杂长句修饰关系、跨段落上下文捕捉。
No.11Context Window
行业中文名:上下文窗口 / 上下文长度 / 工作记忆区
一句话人话翻译
AI 在单次对话中能同时“握在手里阅读和思考”的最大信息量上限。
☕ 通俗生活比喻
AI 办公桌的桌面面积。桌面是 8K 只能摊开两页信纸;桌面是 1M/2M(如 Gemini/Kimi)就能把整部《红楼梦》或十万行代码全摊在桌上随时查阅。
![]()
实际应用场景
一次性上传几百页 PDF 财报让 AI 做总结、输入一整个项目的全部源码让 AI 找 Bug。
No.12Temperature
行业中文名:温度值 / 随机性 / 脑洞系数
一句话人话翻译
控制 AI 答题时是“死板保守按套路来”还是“脑洞大开发挥创意”的调节旋钮。
☕ 通俗生活比喻
饮酒状态。Temperature=0(滴酒不沾)就像严谨古板的老会计,问十遍答案一字不差;Temperature=0.8~1.2(微醺)就像浪漫诗人,金句频出但可能偶尔放飞自我。
![]()
实际应用场景
算数学题、写 SQL 调低温度(如 0.1);写小说、做头脑风暴调高温度(如 0.8)。
No.13Hallucination
行业中文名:幻觉 / 机器胡说八道
一句话人话翻译
AI 在缺乏事实依据的情况下,用极其自信、极其专业的口吻编造出完全虚假的信息。
☕ 通俗生活比喻
考试遇到完全不会的论述题,硬是洋洋洒洒编出几千字看似高深莫测、实则全是胡扯的答卷。
![]()
实际应用场景
虚构并不存在的学术论文引用、凭空编造不存在的名人名言或法律法条。
No.14Multimodal
行业中文名:多模态
一句话人话翻译
AI 不仅能处理纯文字,还能同时看懂图片、听懂声音、看懂视频并进行综合交互。
☕ 通俗生活比喻
从前只能发纯文字短信的“笔友”,变成了能发语音、能视频连线、能看懂你发的生活照片的“真人视频伙伴”。
![]()
实际应用场景
拍一张冰箱照片让 AI 推荐菜谱、上传一段监控视频让 AI 查找异常、语音实时双向对话。
No.15MoE (Mixture of Experts)
行业中文名:混合专家架构 / 专家混合模型
一句话人话翻译
把大模型的大脑拆分成多个专科门诊,每次只激活与当前问题相关的少数专科专家参与计算。
☕ 通俗生活比喻
三甲医院门诊部分诊制。来看眼科只挂眼科号,不用全院所有医生一起开会,既省钱省电,看病速度还极快。
![]()
实际应用场景
DeepSeek-V3、Mixtral 8x7B、GPT-4 等(总参数几百 B,但每次推理只激活几十 B,极致降本增效)。
我是张渔歌,1999年生,国企辞职青年,AI Agent 探索者。《AI 常见技术与硬件名词“人话翻译库”手册》是我长期整理的自用硬核工具手册,旨在消除行业黑话壁垒。全手册共 20 大板块、115 个高频术语,后续将持续按板块连载更新,欢迎关注收藏!
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.