大语言模型
一句话
读遍全网文字训练出来的「语言专家」(LLM, Large Language Model)——会聊天、写作、编程、推理。当前沿代表是 Gemini 4 Argon、GPT-6.1、Claude Opus 5 一档(2026-10),DeepSeek、GLM-5.3、Qwen3.5 同属这一类。
要点
- 学的是什么:文字里的规律——读过全世界对世界的「描述」,但没有真正的物理直觉(知道「球会落地」这句话,没「见过」球落地)
- 能做什么:对话、写作、编程、总结、推理
- 短板:纯文本 LLM 缺物理直觉;会一本正经地胡说(幻觉)。注意 2026 的旗舰模型已原生多模态,能直接看图,「LLM 看不见东西」的说法要限定在纯文本模型上
- 和世界模型的差别:世界模型学「物理世界本身」的规律,能在脑内模拟——详见 世界模型 笔记的对比表
相关笔记
相关日记
- 2026-09-12 - 在世界模型对比中学到