AnchorAI › Computer Vision › Foundations › CV
CV
Computer Vision
计算机视觉
一句话理解
计算机视觉把图像或视频转换成机器能够识别、定位、比较或生成的信息。
像素不是答案;视觉系统要把像素逐步变成对象、位置、关系和任务结果。
最好理解的例子
自动驾驶相机的画面先变成视觉特征,再分别输出车辆类别、位置框和可行驶区域。
核心机制
- 1
接收图像、视频或其他视觉传感器输入。
- 2
经过预处理、表示学习以及 Backbone / Encoder 提取视觉信息。
- 3
由任务模块和 Head / Decoder 输出分类、检测、分割、检索、生成或推理结果。
关键关系
知识邻域
AI → Computer Vision → Foundations