什么是计算机视觉:让机器学会“看”

计算机视觉是让机器从图像和视频中提取信息、理解世界的学科。它要解决的核心问题是:把像素翻译成语义——从“这些颜色的排列”到“这是一只在睡觉的猫”。这是人类最依赖的感官能力,也是 AI 落地最成熟的领域。

人类看见一只猫只需 0.1 秒,但让机器做到这一点花了六十年。这个反差最能说明智能的奥秘:看似最“简单”的感知能力,恰恰是最难被形式化的。我们觉得容易的事,往往消耗了进化最多的算力。

## 核心要点


图片[1]-什么是计算机视觉:让机器学会“看”-子比笔记

图片来源:Openverse / playful.geometer(https://www.flickr.com/photos/24888685@N08/7025812193)

1. 视觉占据人类大脑处理信息的 80% 以上,重要性不言而喻。

2. 从像素到语义的鸿沟,是计算机视觉要跨越的核心挑战。

3. 深度学习前,特征工程是瓶颈;之后,数据成了瓶颈。

4. 自动驾驶、医疗影像、安防是它最重要的三大应用。

图片[2]-什么是计算机视觉:让机器学会“看”-子比笔记

图片来源:Openverse / seanmfreese(https://www.flickr.com/photos/66779558@N02/6799663908)

## 写在最后

以上是关于「什么是计算机视觉」的科普介绍。人工智能正在快速发展,相关概念和方法也在不断演进。希望本文能帮你建立对这一主题的基本认识。

© 版权声明
THE END
喜欢就支持一下吧
点赞9 分享
评论 抢沙发
头像
欢迎您留下宝贵的见解!
提交
头像

昵称

取消
昵称表情代码图片快捷回复

    请登录后查看评论内容