AnchorAI › Computer Vision › Foundations › Visual Perception
Visual Perception
视觉感知
一句话理解
视觉感知把像素转换成对象、属性、位置和场景等可用表示。
回答“看到了什么、在哪里”,但不一定回答“为什么、接下来怎么办”。
最好理解的例子
自动驾驶系统从摄像头画面中检测前车、分割道路区域并估计行人位置,这些都属于视觉感知。
核心机制
- 1
从图像或视频提取局部纹理、形状与运动线索。
- 2
把低层线索组合成对象、区域、深度等高层表示。
- 3
输出分类、检测、分割或几何估计结果。
关键关系
知识邻域
AI → Computer Vision → Foundations