模型压缩:让大模型变小巧
模型压缩是一族技术的总称:量化、剪枝、蒸馏、低秩分解,目的都是同一个——用更小的体积、更少的计算,跑到几乎同样的效果。它是 AI 从云端走向终端的桥梁。 模型压缩的艺术是“取舍”:什么...
MobileNet:让 AI 跑进手机
MobileNet 专为移动设备设计:用深度可分离卷积把计算量降到普通 CNN 的八分之一到九分之一,让手机也能实时跑视觉模型。它是 AI 从云端走向终端的功臣。 MobileNet 证明了一个常被忽视的真相:...
知识蒸馏:大模型教小模型
知识蒸馏是用大模型(教师)的输出训练小模型(学生),让小模型在特定任务上逼近大模型的效果,同时保持小体积、低成本。这是“大而强”到“小而美”的转化桥梁。 对企业的实用价值是:不必所...




