操作性图像、政策风格与适应性监管
在计算机视觉模型的训练过程中,认识论层面的不确定性是如何产生的?
计算机视觉常被理解成机器学会了像人类一样观看。但在真正的实验室里,图像并不总是以人能观看的方式存在。它会变成各种各样的参数和变量,在代码与硬件之间来回转换。第一篇是非常有 STS 调性的论文,作者进入新加坡一所大学的计算机视觉实验室,用扎实的实验室民族志回答模型在实验室内具体的训练过程、科学家如何与数据及算法互动?还是蛮喜欢这种把技术批判带回到具体的屏幕、代码、草图和实验室里的研究。
第二篇论文处理的是另一种看不见。AI 监管常被讲成欧盟重权利、美国重创新。但这种说法其实很容易遮住制度运作的细节。作者把欧盟《人工智能法案》、美国行政命令和州级立法放在一起看,核心切口落在监管风格的差异上。试图解释看似零散的美国州级立法,其实通过「实验室联邦制」实现了更具生命力的适应性监管。那么是否也意味着具体、小尺度的行业和地方规则,往往能比宏大的顶层设计提供更好的保护?
祝今日读写愉悦,洞见深省。
前沿速递
透过人眼打造计算机视觉:一项人工智能实验室民族志
核心概念
操作性图像(Operational image):指那些并不以供人类观看或再现现实为目的,而是直接参与机器技术系统运作的图像。在当代数字基础设施和机器学习流程中,图像往往脱离了表征功能,转变为可供计算的统计数据、特征向量或像素阵列。例如,在自动驾驶系统的传感器中,被捕捉到的路面信息不再是一张供人欣赏的照片,而是触发机器刹车或转向指令的运算元素。这种图像的存在状态经常游离于人类视觉之外,成为机器读取、分析和执行操作的基础素材。
集成开发环境(Integrated development environment,简称 IDE):这是指用于提供程序开发环境的计算机软件应用系统,通常包括代码编辑器、编译器、调试器和图形用户界面等工具。开发者可以通过这个统一的界面完成编写、修改、测试和运行源代码的全部工作。例如,在进行 AI 模型开发时,研究人员会依赖特定的集成开发环境来查看代码逻辑、监控后台变量并追踪程序运行时的报错信息,从而高效地管理复杂的软件工程项目。
研究问题
AI 的发展史本质上是一部赋予机器类人感官能力的历史。计算机视觉作为 AI 的核心子领域,在人脸识别和自动驾驶等应用中取得了巨大成功。然而,学术界对计算机视觉生成的知识是否具有确定性、透明度和鲁棒性一直存在争议。从传统科学史和实验室民族志的视角看,主观感官经验往往被实证主义的量化策略压抑。现有的研究大多聚焦于上游的数据标注劳工或下游的社会应用影响,而模型在实验室内具体的训练过程、科学家如何与数据及算法互动,仍然是一个未被充分探讨的缺口。
因此,这篇论文的研究问题是:在计算机视觉模型的训练过程中,认识论层面的不确定性是如何产生的?这种不确定性如何挑战了机器学习的常规实验流程?为了应对这些挑战,研究人员又采取了哪些具体的视觉沟通和干预策略?