大语言模型 第3页
提示工程:一门被低估的手艺-子比笔记

提示工程:一门被低估的手艺

提示工程是设计输入以获得最佳输出的系统性方法。它不是“哄 AI”,而是把模糊需求转化为精确规格的能力。同样的模型,提示词水平的差异可以让产出质量差十倍。 提示工程的本质其实是沟通能力:...
DeepSeek:震撼世界的中国黑马-子比笔记

DeepSeek:震撼世界的中国黑马

DeepSeek 在 2025 年初以极低成本训练出媲美顶级闭源模型的 R1,并完全开源,引发全球震动。它证明了算法创新可以部分替代算力堆叠,一度让英伟达市值单日蒸发数千亿美元。 DeepSeek 给整个行业...
系统提示词:设定 AI 的“人设”-子比笔记

系统提示词:设定 AI 的“人设”

系统提示词(System Prompt)是对话开始前设定的“元指令”,定义 AI 的角色、风格、边界。它决定了整个对话的基调,是所有 AI 产品最核心的配置之一。 系统提示词就像组织的“文化与制度”:写...
智谱 GLM:清华系的技术中坚-子比笔记

智谱 GLM:清华系的技术中坚

智谱 AI 源自清华大学,GLM 系列大模型以扎实的研究功底著称。GLM-4 在多项评测中达到国际一流水平,在政企、金融、教育等行业有深厚积累。 智谱代表了中国 AI 的一种成功范式:学院派背景 + 工...
角色提示:让 AI 扮演合适的人-子比笔记

角色提示:让 AI 扮演合适的人

角色提示通过设定身份(“你是一位资深律师”)来约束模型的知识范围与表达风格。简单一行字,常常就能显著改变输出的专业度与准确性。 角色提示的巧妙在于它利用了模型训练数据中的“语料分布...
豆包:字节跳动的 AI 大众化-子比笔记

豆包:字节跳动的 AI 大众化

豆包是字节跳动的大模型产品,以极低的价格和极强的产品化能力,快速成为中国用户量最大的 AI 助手之一。它把大模型从“尝鲜玩具”变成了“日常工具”。 豆包的打法是典型的“后发制人”:不争...
结构化输出:让 AI 的回答机器可读-子比笔记

结构化输出:让 AI 的回答机器可读

结构化输出要求模型按 JSON 等固定格式回答,这是 AI 从“玩具”变成“零件”的关键一步——程序能直接解析结果,自动化流程才跑得通。 从自然语言到结构化数据,是 AI 商业化的关键跨越。最前...
Kimi:长文本处理的标杆-子比笔记

Kimi:长文本处理的标杆

Kimi 以超长上下文处理能力成名——能一次性读完整本书、几百页财报、几十个文件。它让“喂给 AI 一切资料,让它帮我读”成为无数打工人的日常工作方式。 Kimi 的成功是对“差异化竞争”的完美...
Llama:Meta 的开源战略武器-子比笔记

Llama:Meta 的开源战略武器

Llama 是 Meta 开源的大模型系列。扎克伯格赌上整个公司的 AI 未来,把顶级模型免费开放,彻底改变了行业格局——今天绝大多数开源模型都有 Llama 的血脉。 Meta 的开源策略堪称教科书级的“降...
Mistral:欧洲的 AI 骄傲-子比笔记

Mistral:欧洲的 AI 骄傲

Mistral AI 由前 DeepMind 与 Meta 研究员创立,是欧洲对抗美国 AI 霸主的希望。它以小而精的模型和极高的效率著称,7B 模型曾打败远大于自己的对手。 Mistral 让人看到,在这个看似赢家通吃的...
预训练:大模型如何“读完整个互联网”-子比笔记

预训练:大模型如何“读完整个互联网”

预训练是大模型获得通用能力的阶段:在数万亿 token 的文本上做“下一词预测”训练。这个看似简单的任务,逼迫模型学到了语法、常识、逻辑、世界知识。 下一词预测这个任务设计之精妙,在于它无...
预训练数据:模型的“食谱”决定上限-子比笔记

预训练数据:模型的“食谱”决定上限

预训练数据的质量直接决定模型上限。Common Crawl、维基百科、论文库、代码库是主要来源,清洗、去重、去毒、配比每一步都是技术活。模型的表现,其实在数据准备阶段就已注定大半。 预训练数据...