📚 知识大全 · 工具指南

每条词条按「是什么 → 什么时候用 → 怎么用 → 相关词条」组织;从文章跳进来,看完点右上「返回刚才的文章」就能回去。

⚠️ 安全提醒:教程和博客里不要写真实服务器 IP、SSH 账号、API Key、数据库密码等敏感信息,示例一律用占位符。

网络与建站(17 条)

AI 与大模型(15 条)

一、网络与建站

IP 地址 IP address

是什么:每台联网设备的“门牌号”,一串数字,比如 1.2.3.4。只有拿到对方的 IP,别人才找得到它。

什么时候用:登录服务器、配域名解析、排查网络时都会用到。注意区分「公网 IP」(外面能访问)和「内网 IP」(只在局域网内有效)。

怎么用
  1. 云服务器:控制台「实例」页看公网 IP。
  2. 登录:ssh root@你的公网IP
  3. 解析:在 DNS 的 A 记录里填这个 IP。
  4. ⚠️ 公网 IP 等于服务器的门牌号,别写进公开博客。

服务器 Server

是什么:一台长期开机、有公网 IP 的电脑,负责收请求、跑程序、回内容。网站、机器人、API、网盘都住在上面。

什么时候用:需要后端(登录、数据库、定时任务)、需要 24 小时在线、或者想把 AI 模型部署给别人用时。

怎么用(选机 → 放行 → 登录 → 装环境)
  1. 云厂商选「包年包月 + 中国大陆」机型(大陆建站要备案;香港/海外不用)。
  2. 重置/设置登录密码,安全组先放行 22。
  3. SSH 登录:ssh root@公网IP
  4. 装基础环境:apt update && apt install nginx php mysql
  5. 最后把域名 A 记录指向它。

网站 Website

是什么:浏览器能访问的内容,本质是「文件」(HTML/CSS/JS),需要互动时再加后端程序和数据库。

什么时候用:博客、作品集、工具站用静态页就够;需要登录/评论/动态内容再上后端。

怎么用(先区分静态还是动态)
  1. 纯展示:写 index.html,推 GitHub Pages / Vercel,免费。
  2. 动态站:买服务器,装 Nginx + PHP + 数据库(如 WordPress)。
  3. 访问方式:域名或 IP 都行,正式用域名 + HTTPS。

域名 Domain

是什么:IP 的好记名字,如 example.com。结构上由「名字 + 后缀」组成,后缀叫顶级域(.com / .icu / .cn),前面还可以加 wwwblog 等子域名。

什么时候用:让别人不用记一串数字;做邮箱、短链接、个人品牌时也需要。

怎么用
  1. 注册商购买(要实名)。
  2. 去 DNS 管理加 A 记录指向服务器。
  3. ping 你的域名 确认解析成功。
  4. 到期续费;备案前别用域名对外建站。

网址 URL

是什么:定位某个资源的完整地址,格式为「协议 + 域名 + 路径」,如 https://example.com/posts/a.html

什么时候用:填站点地址、发链接、配重定向时。

怎么用
  1. 协议:http(明文)→ 尽量用 https(加密)。
  2. 域名:去哪台服务器;路径:服务器上的哪个文件。
  3. 后台「站点地址」记得写完整的 https://域名

DNS / 解析 Domain Name System

是什么:把「域名」翻译成「IP」的分布式通讯录。你在域名服务商那里写的「解析记录」,决定访问域名时去哪个服务器。

什么时候用:把域名指向服务器、配邮箱、做子域名时。

怎么用
  1. 进入域名服务商后台 → DNS 解析/域名解析。
  2. 加 A 记录:主机记录 @(或 www),记录值填公网 IP。
  3. 保存后通常几分钟到几小时生效(全球同步)。
  4. 验证:ping 域名nslookup 域名

DNS 记录类型 DNS Records

是什么:同一条域名可以配置多种“指令”,不同类型管不同的事。

什么时候用:建站用 A,别名用 CNAME,邮箱用 MX,验证归属用 TXT。

怎么用(对照表)
  1. A:指向 IPv4,建站必配,值填公网 IP。
  2. AAAA:指向 IPv6(可选)。
  3. CNAME:指向另一个域名,如 www → 主域名。
  4. MX:邮件接收服务器;TXT:域名验证 / 邮件 SPF。

端口 Port

是什么:一台服务器有多个“门”,每个服务占一个门。比如网页走 80/443,SSH 走 22,数据库默认 3306。

什么时候用:配置防火墙、Nginx 监听、访问数据库/API 时都要写对端口。

怎么用
  1. 对外只开必要端口:22、80、443。
  2. 3306 等数据库端口不要对公网开放。
  3. 改监听端口后记得同步改安全组,否则外面连不上。

SSH Secure Shell

是什么:远程安全登录服务器的协议,默认端口 22。有两种登录方式:密码 和 密钥(更安全、免密)。

什么时候用:管理服务器、往服务器传代码、GitHub 免密推送。

怎么用
  1. 密码登录:ssh root@公网IP,回车输密码。
  2. 生成密钥:ssh-keygen -t ed25519(一路回车)。
  3. 公钥加服务器:ssh-copy-id root@公网IP;加 GitHub:Settings → SSH keys。
  4. 测试 GitHub:ssh -T git@github.com

防火墙 / 安全组 Firewall

是什么:控制“外面能不能访问某个端口”的门卫。云厂商的叫「安全组」,服务器系统里还可以用 ufw/iptables。

什么时候用:新服务器第一件事就是放行 22;建站再加 80/443。

怎么用
  1. 云控制台 → 安全组 → 入方向:允许 TCP 22/80/443,来源 0.0.0.0/0
  2. 系统内(可选):ufw allow 22/tcpufw allow 80/tcpufw enable
  3. 原则:默认全关,只开要用的;3306 绝不开。

ICP 备案 ICP Filing

是什么:中国大陆机房里的网站,上线前要在工信部登记网站主体(个人或企业)和内容。规则是「谁接入谁备案」——服务器在哪家云,就在哪家备案。

什么时候用:服务器在大陆、要用域名提供网站服务时。香港/海外服务器不需要。

怎么用
  1. 域名先完成实名认证。
  2. 云厂商控制台 → ICP 备案 → 填主体/网站信息 → 证件 + 人脸核验。
  3. 云厂商初审 → 管局终审(1~20 个工作日)。
  4. 通过后把备案号挂在页脚,并链接 beian.miit.gov.cn
  5. ⚠️ 审核期间别用域名开放网站,容易被退回。

HTTPS / SSL 证书 Certificate

是什么:把网站通信加密的“锁”。装了证书,地址变 https://,别人窃听不到内容,浏览器也不会提示“不安全”。

什么时候用:任何正式上线的网站都要用;有登录、支付、表单时尤其重要。

怎么用(Nginx + Let's Encrypt 免费方案)
  1. 装工具:apt install certbot python3-certbot-nginx
  2. 执行:certbot --nginx -d 你的域名 -d www.你的域名
  3. 按提示选邮箱、同意条款;certbot 自动改配置并续期。
  4. 完成后强制跳转:选 --redirect 或手动加 301。

Nginx / 反向代理 Web Server

是什么:最常用的 Web 服务器:接收浏览器请求,把静态文件直接返回,把 PHP/后端请求转给对应程序(这就是“反向代理”)。

什么时候用:几乎所有 Linux 建站都会用到;还能做 HTTPS、负载均衡、缓存。

怎么用
  1. 安装:apt install nginx
  2. 写站点配置:server_name 域名root 网站目录、PHP 转发到 php-fpm.sock
  3. 测试:nginx -t;生效:systemctl reload nginx
  4. 配置目录:/etc/nginx/sites-available + 软链到 sites-enabled

WordPress CMS

是什么:最流行的开源建站程序(PHP 写的),自带可视化后台,发文、换主题、装插件都在网页里点。

什么时候用:不想手写页面、想要后台管理文章和评论时,博客/作品集/企业站都能用。

怎么用
  1. 下载并解压到网站目录(如 /var/www/blog),目录属主设为 www-data
  2. 提前建好数据库(见「数据库」词条)。
  3. 浏览器访问域名,按向导填数据库信息、设管理员账号。
  4. 后台 /wp-admin 写文章、改主题;及时更新版本和插件。

PHP PHP

是什么:一种后端语言,WordPress 就是用它写的。Nginx 本身不处理 PHP,需要交给 php-fpm 处理。

什么时候用:跑 WordPress / Typecho 等 PHP 程序时。

怎么用
  1. 安装:apt install php8.1-fpm php8.1-mysql(按需加 gd/curl/xml 等扩展)。
  2. Nginx 配置里把 .php 请求转发给 php8.1-fpm.sock
  3. 重启:systemctl reload nginx

数据库 Database

是什么:程序持久化存数据的仓库。博客用 MySQL/MariaDB 存文章、用户、评论;大数据/灵活结构也会用 MongoDB。

什么时候用:WordPress 安装时、任何需要登录/存储的程序里。

怎么用(MySQL/MariaDB)
  1. 进入:sudo mysql
  2. 建库 + 建用户 + 授权:CREATE DATABASE blog ...; CREATE USER ...; GRANT ...; FLUSH PRIVILEGES;
  3. 程序填库名/用户名/密码,主机 localhost
  4. 备份:mysqldump blog > blog.sql;恢复:mysql blog < blog.sql

免费托管 Static Hosting

是什么:不买服务器也能放网站的云服务,如 GitHub Pages、Vercel、Netlify。适合静态站(无后端)。

什么时候用:作品集、文档站、纯展示页;想快速上线、省维护时。

怎么用
  1. 把网站文件夹推到一个 GitHub 仓库。
  2. Vercel/Netlify 登录 → Import 这个仓库,自动部署。
  3. 平台自动给 HTTPS 网址;设置里可绑定自己的域名。
  4. 有数据库/登录/API 需求时再换服务器。

二、AI 与大模型

LLM 大语言模型 Large Language Model

是什么:用海量文本训练出来的“文字大脑”,能理解问题并生成回答。常见的有 GPT、Claude、DeepSeek 等,以及 Llama、Qwen 等开源模型。

什么时候用:写文案、答疑、写代码、做助手。要“自己动”就升级成 Agent(加工具)。

怎么用(两条路)
  1. 云 API:注册 → 拿 Key → 用官方 SDK 调用(省事但按量计费)。
  2. 本地部署:用 Ollama 等跑开源模型(免费但要显卡/内存)。
  3. 调用本质:发一列 messages(system/user),取回 content

Token Token

是什么:模型处理文本的最小单位。中文大致 1 个字 ≈ 1~2 Token;它决定两件事:计费和能记住的长度。

什么时候用:估算成本、判断“怎么又超出上下文了”时。

怎么用
  1. 计费看「输入 + 输出」两边,长对话/长文档成本高。
  2. 上下文满了:精简输入、先让模型总结历史,或用 RAG 只取相关段。
  3. 选模型前看它的上下文窗口(几千~几十万 Token)。

API 与 API Key API

是什么:API 是“接口”,让程序按固定格式请求模型;API Key 是证明“你是谁”的钥匙,直接关系账户里的钱。

什么时候用:程序要调云端模型、或自己部署模型给别人调用时。

怎么用
  1. 环境变量存 Key:export OPENAI_API_KEY="sk-..."(Windows:$env:OPENAI_API_KEY="...")。
  2. 代码:from openai import OpenAI; client.chat.completions.create(...)
  3. 安全:Key 不进 Git、不贴网页、不截图外发;开额度限制。
  4. 本地模型也走同一套接口,只是换个 base_url(见 OpenAI 兼容 API)。

Prompt 提示词 Prompt

是什么:你发给模型的指令。同样的模型,指令写得好不好,结果天差地别。研究怎么把指令写好就叫 Prompt 工程。

什么时候用:每次调用都在写 Prompt;复杂任务尤其需要结构化。

怎么用(四件套模板)
  1. 角色:你是一位……
  2. 任务:请帮我……
  3. 要求:用大白话 / 不超 200 字 / 分点列出。
  4. 示例:给一个输入输出的样例,模型会照着学。

上下文窗口 Context Window

是什么:模型一次能“同时看到”的内容上限(按 Token 算)。超过部分它根本看不到。

什么时候用:长文档、长对话、多轮 Agent 循环时最容易“爆上下文”。

怎么用
  1. 对话太长:定期让模型“总结前面聊了什么”再继续。
  2. 文档太长:别整篇塞,用 RAG 只取相关段落。
  3. Agent 循环:每轮只保留最近几步 + 全局任务目标。

RAG 检索增强生成 Retrieval-Augmented Generation

是什么:让模型“带资料答题”:先把你的文档变成可检索的库,提问时先查出相关片段,再连问题一起交给模型。

什么时候用:想让 AI 回答你私有的 PDF/笔记/文档,而不是瞎编时。

怎么用
  1. 把文档切成小段(几百字一段)。
  2. 每段用 Embedding 转成向量存进向量库。
  3. 提问 → 检索最相近的 TopK 段 → 拼进 Prompt → 让模型基于资料回答。
  4. 资料更新后重新切片入库即可。

Embedding 向量 Embedding

是什么:把文字变成一串数字(向量)。语义越接近的文字,向量距离越近——这是“机器能算相似度”的基础。

什么时候用:做相似搜索、RAG 资料库、去重、推荐时。

怎么用
  1. 用 Embedding API 把文本转成向量(如 1536 维数组)。
  2. 存进向量库(如 Chroma、pgvector、MongoDB Atlas)。
  3. 查询时把问题也转成向量,按距离取最近几条。

Agent 智能体 AI Agent

是什么:能自己“规划 → 调工具 → 看结果 → 继续做”直到完成任务的小程序,而不是一问一答的聊天框。

什么时候用:任务需要多步、需要查数据/执行代码/操作文件时。

怎么用
  1. 定义工具:每个工具是一个函数(搜索、查数据库、执行代码…)。
  2. 写循环:模型选择工具 → 程序执行 → 结果作为消息喂回去 → 判断完成。
  3. 控制权:关键操作(删数据、花钱、发消息)加人工确认。
  4. 从最小 Demo 开始:1 个工具 + 明确目标,跑通再加。

Function Calling 工具调用 Function Calling

是什么:模型不自己执行操作,而是输出“我要调用函数 X,参数是 Y”,由你的程序真正执行——这是 Agent 的“手”。

什么时候用:让模型查天气、算数、读文件、发请求时。

怎么用
  1. 请求时声明工具(名称、参数 JSON Schema、说明)。
  2. 解析回复中的 tool_calls
  3. 执行函数,把结果作为 role:"tool" 消息返回。
  4. 模型基于结果继续回答或调用下一个工具。

微调 Fine-tuning

是什么:用你自己的数据继续训练模型,让它更懂你的语气、格式或业务规则。比 Prompt 重,属于“深度定制”。

什么时候用:Prompt/RAG 都试过仍不够,且你有成对的数据(问题+标准回答)时。

怎么用
  1. 先确认:大概率不需要微调,Prompt 最省事。
  2. 准备数据:JSONL,每行是 role 对话。
  3. 云平台一键微调,或本地用 LLaMA-Factory 等框架。
  4. 评估效果:拿没见过的问题测,别只看训练集。

量化 Quantization

是什么:把模型的数字精度降低(如 16 位 → 4/8 位),体积和显存占用大幅变小,质量略降。这是本地跑大模型的“魔法”。

什么时候用:显存/内存不够、想在个人电脑或小服务器上跑模型时。

怎么用
  1. 按显存选级别:Q4_K_M/Q5 家用推荐,Q8 更准但更大。
  2. Ollama 拉模型默认就是量化版:ollama run 模型名
  3. 还是跑不动 → 换更小参数的模型(7B → 3B/1.5B)。

推理 Inference

是什么:模型“生成回答”的运行过程,主要吃显卡显存(VRAM)。部署模型本质上就是“起一个推理服务”。

什么时候用:本地部署选工具、估算能不能跑、排查“怎么这么慢”时。

怎么用
  1. 先看显卡显存(nvidia-smi),决定能跑多大模型。
  2. 自己试:Ollama;服务多人:vLLM(吞吐高)。
  3. 慢/爆显存:降并发、升量化、换小模型、换更快硬盘。

Ollama Local Runner

是什么:一条命令在本地跑开源模型的小工具,会自动下载并管理量化模型,还自带一个 OpenAI 兼容接口,最适合入门本地部署。

什么时候用:想在个人电脑上免费跑模型、研究本地部署、不想把数据发到云端时。

怎么用
  1. 安装(官网下载/一行脚本)。
  2. 跑起来:ollama run llama3(或 qwen3 等)。
  3. 看列表:ollama list;删除:ollama rm 模型
  4. 代码接入:base_url="http://localhost:11434/v1",api_key 随意。

vLLM Inference Engine

是什么:面向高并发的推理引擎,显存利用率和吞吐比裸跑高很多,适合放在服务器上服务多个用户。

什么时候用:有 GPU 服务器、多人同时调用、追求吞吐和稳定时。

怎么用
  1. 安装:pip install vllm
  2. 启动:vllm serve Qwen/Qwen2.5-7B-Instruct
  3. 默认开在 http://0.0.0.0:8000/v1,OpenAI 格式直接调。
  4. 按显存调并发:--max-num-seqs 等参数。

OpenAI 兼容 API Compatible Endpoint

是什么:一套被广泛使用的调用格式。云厂商、Ollama、vLLM 都提供兼容接口,所以换模型常常只改一行 base_url

什么时候用:在云 API 和本地模型之间切换、或想“代码写一次到处跑”时。

怎么用
  1. base_url:云端填官方地址,本地填 http://localhost:11434/v1
  2. model:写服务端支持的模型名。
  3. api_key:云端填真 Key;本地一般随便填。
  4. messages 结构不变,代码无需大改。