JASONATLAS

搜索 Jason Atlas

搜索缩写、中英文名称、别名与关键词

AnchorAI › Computer Vision › Foundations › CV

CV

Computer Vision

计算机视觉

一句话理解

计算机视觉把图像或视频转换成机器能够识别、定位、比较或生成的信息。

像素不是答案;视觉系统要把像素逐步变成对象、位置、关系和任务结果。

最好理解的例子

自动驾驶相机的画面先变成视觉特征,再分别输出车辆类别、位置框和可行驶区域。

核心机制

  1. 1

    接收图像、视频或其他视觉传感器输入。

  2. 2

    经过预处理、表示学习以及 Backbone / Encoder 提取视觉信息。

  3. 3

    由任务模块和 Head / Decoder 输出分类、检测、分割、检索、生成或推理结果。

关键关系

知识邻域

AI → Computer Vision → Foundations