到这里为止,一切只发生在屏幕上。Codex 自己不会思考,它是个壳——但 Skills 和 Agent 都装在这个壳里,下一站就用上。
AI 世界地图
刚接触 AI 的时候,最晕的不是不会用,是分不清谁是谁——Codex 到底是个 App 还是个模型? Claude 和 Claude Code 什么关系?Skills 和 Agent 是一回事吗? 这些问题解不开,是因为它们本来就不在同一层。把三层叠起来看,一眼就清楚了。
Skills 装在应用里:你在课前准备里装进 Codex 的,就是这一本本手册。Codex 每次都带着一份手册目录——有哪些手册、各管什么。你要的是古风提示词,「古风提示词」这本对得上,就整本翻开。里面写着该怎么想、按什么顺序写、哪些词绝对不能用。对不上的手册不会翻开,所以装再多 Skills,也不会每句话都背着全部内容。细一点说:「对上号」这一下,其实是模型看目录判断的;手册在 Codex 里,由 Codex 翻开、递下去。你不用点名,说人话就行。
虚线那格就是上一站翻开的手册,也一起装进来。
模型拿到的不只是你那句话:之前聊过的内容、Codex 自己的规矩、上一站翻开的手册,会和这句话一起打包——这一整包叫上下文(Context),也就是模型真正读到的那段「提示词」。所以它才「记得」你昨天聊过什么。窗口里有什么,模型就只知道什么;挤出去的,它就真的忘了。
模型不认字,只认 token。贵不贵、能记多少,全按 token 数。手册也要算:一本手册常常比你那句话重几十倍。这就是为什么目录只写一句话、用到才翻开——省 token,也省窗口。
这是唯一在思考的一层,它没有界面,你看不见它。它按手册的规矩写:先定光、再定镜头、不写「8K」这类没用的词——这些规矩不是它自己想的,是手册里写的。注意:Codex 是应用的名字,背后在算的是 GPT 系模型——同一个工具,壳和引擎不是一回事。
从 1 到 6 是一趟:你说一句人话,拿回一段能直接粘进 Midjourney 的英文提示词。Agent 就是让它自己连着跑很多趟:写完、自己检查一遍参数、改完再交给你。这也是应用的本事——是 Codex 在调度这一趟趟,模型每趟只管算。
一个壳。自己不思考,只把你的话转给模型、把结果摆给你看。Skills、Agent 也装在壳里。
判断:你在哪打字,那就是应用。
中间那一段。你打的字怎么变成模型能吃的东西、一次能带多少、能从哪接出去够到外面——都发生在这里。 这些词本身不是产品,是传输的零件和规则。听懂这四个,AI 圈九成的话你就能听明白了。
判断方法:它不显示,也不算,它在传。
干活的那个。你看不见它,它没有界面。所有的理解、生成、推理都发生在这一层。 模型分家族,每个家族下面还有一堆型号,型号大致对应「多聪明、多贵、多快」。
判断方法:它在算,不在显示。
型号每季度都在换,这里只记家族名。要具体到版本号,上课时现查。
读完了就点一下。只是给你自己一个收尾,不是考核。