论文落地 101：算法工程化的那些坑 - 专知

会员服务 ·

0

论文落地 101：算法工程化的那些坑

2018 年 11 月 3 日 PaperWeekly

笔者就职于泛化智能，一家专注于 AI 落地的计算机视觉公司。三年来，我们服务了大量需要 AI 的行业，比如电网、医院、无人机、机场甚至野生动物保护。在做这些项目的过程中，我们积累了很多经验（踩过很多，也挖过很多坑）。为了避免在工程中重复犯错，我们内部在做工程项目前，都会根据下面这个 check list 逐条检查。这里扩展一下，整理为 AI 落地中的常见问题，分享给大家：

你有显卡，我有显卡，但用户有显卡吗？

也许你不相信一个拥有几百人 IT 团队的公司会没有显卡，不过你真的确定你用户那里有显卡吗？在自己公司或者实验室内部，我们的硬件条件基本都能得到满足；但到了用户那里，一切可能都不一样了。

有很多项目，必须要在客户的电脑/服务器上去运行，而很多环境下是没有 GPU 的——或者说，如果你做工程化，GPU 可能是种奢侈品。对于计算机视觉项目来说，假如客户需要把模型搭载到他特有的硬件上（比如智能制造领域的缺陷检测设备），事先与用户确认硬件配置是至关重要的。

一个简单的判别标准：和客户交流的时候，客户知不知道什么是 GPU，绝对是合作难易程度的分水岭。知道且清楚什么是 GPU 的，合作起来会更简单；而如果对 GPU 一无所知的，或者只用过 Intel GPU的，项目落地难度就指数级增加。

显卡难求，务必事先与用户沟通。

数据有了吗？

我们所有项目，内部讨论时的第一个问题一定是：这项目有数据吗？

技术人员复现论文的时候，往往会有现成的数据集，清洗过的数据。一旦开始做工程化，取得数据集和数据集预处理才是最耗费时间的环节。我们接过很多项目，所有商务细节都谈好了，项目启动后，技术人员才发现客户没数据，或者数据不够。

数据有了，你......能看懂吗？

接着上一个问题，对于绝大部分计算机视觉项目来说，客户的数据我们真不一定能看懂。比如医疗影像，数据标注是医生都需要经过多年培训才能做好的事情，没有任何医疗背景的程序员很难在短时间内看懂这些数据。年初的时候我们给某工厂做缺陷识别，用什么网络什么部署模式都想好了，结果就是看不懂图片不能做标注。我们看所有地方都像是坏了，但工厂的质检员就能一眼分辨出来正常和缺陷。这种行业的 know how 很重要。

▲ 心脏造影图，非医务人员很难看出图中哪些是对诊断有帮助的血管

你了解对方的预期吗？

由于近年来媒体对人工智能行业夸大其词的报道，给大家造成了一种印象「人工智能是万能的」。用户与技术人员的信息不对称性就导致了对项目不同的预期。面对完全没接触过人工智能的用户，要确保用户明白以下几点：

1. 只保证测试集的准确率，但不能保证这个准确率在任何跟训练数据相差非常远的情况下，还能复现；

2. 机器学习项目不能做到 100% 的准确率；

3. 训练需要时间，不像是买个 Microsoft Office 下载就能用。

最后，工程化最烦的一点是，我们要给客户做特别多的 demo。任何一个需求都需要先给他们做个 demo 看看。这些 demo 太浪费时间了，但又不能不做。所以我们为了节省每个计算机视觉项目的时间，制作了 TeguCV——一款可视化计算机视觉以及神经网络工具。

TeguCV 支持 Windows，纯本地运行，目前支持图像识别、视频分类、人脸比对和车牌识别，同时包含自动参数选择、http server 等功能。十分钟开始训练计算机视觉模型。很多简单工作，直接用 TeguCV 就能实现。方便开发者快速做技术落地，而且可以把很多简单工作剥离出来。

▲ TeguCV软件截图

比如点击阅读原文，就可以看到我们如何用半小时内的时间，为无人机航拍图像做识别。

扫描下方二维码添加客服可以获得 TeguCV 免费下载链接。

🔍

现在，在「知乎」也能找到我们了

进入知乎首页搜索「PaperWeekly」

点击「关注」订阅我们的专栏吧

关于PaperWeekly

PaperWeekly 是一个推荐、解读、讨论、报道人工智能前沿论文成果的学术平台。如果你研究或从事 AI 领域，欢迎在公众号后台点击「交流群」，小助手将把你带入 PaperWeekly 的交流群里。

▽ 点击 | 阅读原文 | 查看案例分享

登录查看更多

13

相关内容

GPU

【经典书】算法基础：打开算法之门，Algorithm unlocked，237页pdf

【经典书】算法基础：打开算法之门，Algorithm unlocked，237页pdf

专知会员服务

147+阅读 · 2020年7月3日

干净的数据：数据清洗入门与实践，204页pdf

干净的数据：数据清洗入门与实践，204页pdf

专知会员服务

164+阅读 · 2020年5月14日

【2020新书】如何构建数据团队？:设计集成的技能、需求和解决方案，257页pdf

【2020新书】如何构建数据团队？:设计集成的技能、需求和解决方案，257页pdf

专知会员服务

115+阅读 · 2020年3月11日

深度学习用于新冠肺炎CT诊断表现如何？武大人民医院medRxiv论文揭示：诊断性能比肩医师，而用时少，大有可为

深度学习用于新冠肺炎CT诊断表现如何？武大人民医院medRxiv论文揭示：诊断性能比肩医师，而用时少，大有可为

专知会员服务

26+阅读 · 2020年2月29日

【综述】金融领域中的深度学习，附52页论文下载

【综述】金融领域中的深度学习，附52页论文下载

专知会员服务

165+阅读 · 2020年2月27日

【经典书】精通机器学习特征工程，中文版，178页pdf

【经典书】精通机器学习特征工程，中文版，178页pdf

专知会员服务

360+阅读 · 2020年2月15日

最新《分布式机器学习》论文综述最新DML进展，33页pdf

最新《分布式机器学习》论文综述最新DML进展，33页pdf

专知会员服务

121+阅读 · 2019年12月26日

深度学习算法与架构回顾

深度学习算法与架构回顾

专知会员服务

84+阅读 · 2019年10月20日

【综述】arXiv最新论文：自动驾驶中深度学习综述，附38页PDF

【综述】arXiv最新论文：自动驾驶中深度学习综述，附38页PDF

专知会员服务

107+阅读 · 2019年10月17日

斯坦福&谷歌Jeff Dean最新Nature论文：医疗深度学习技术指南（29页综述）

斯坦福&谷歌Jeff Dean最新Nature论文：医疗深度学习技术指南（29页综述）

专知会员服务

63+阅读 · 2019年1月7日

知识图谱的行业落地实现

知识图谱的行业落地实现

竹间智能Emotibot

51+阅读 · 2019年9月16日

那些酷炫的深度学习网络图怎么画出来的？

那些酷炫的深度学习网络图怎么画出来的？

计算机视觉life

5+阅读 · 2019年4月12日

NLP技术落地为何这么难？里面有哪些坑？

NLP技术落地为何这么难？里面有哪些坑？

AI100

4+阅读 · 2019年1月9日

在深度学习中处理不均衡数据集

在深度学习中处理不均衡数据集

极市平台

19+阅读 · 2018年11月27日

【知识图谱】知识图谱的技术与应用、落地实践中的问题与对策

【知识图谱】知识图谱的技术与应用、落地实践中的问题与对策

产业智能官

19+阅读 · 2018年8月15日

为什么“高大上”的算法工程师变成了数据民工？

为什么“高大上”的算法工程师变成了数据民工？

数据挖掘入门与实战

5+阅读 · 2018年2月25日

推荐｜机器学习中的模型评价、模型选择和算法选择！

推荐｜机器学习中的模型评价、模型选择和算法选择！

全球人工智能

10+阅读 · 2018年2月5日

论文 | 基于CNN的目标检测算法

论文 | 基于CNN的目标检测算法

七月在线实验室

9+阅读 · 2017年12月7日

<公益广告> 阿里巴巴招聘NLP算法专家

<公益广告> 阿里巴巴招聘NLP算法专家

深度学习与NLP

3+阅读 · 2017年11月30日

机器学习算法比较

机器学习算法比较

我爱机器学习

4+阅读 · 2016年12月11日

TResNet: High Performance GPU-Dedicated Architecture

TResNet: High Performance GPU-Dedicated Architecture

Arxiv

8+阅读 · 2020年3月30日

Deep Co-Training for Semi-Supervised Image Segmentation

Deep Co-Training for Semi-Supervised Image Segmentation

Arxiv

6+阅读 · 2019年10月30日

Manifold Approximation by Moving Least-Squares Projection (MMLS)

Manifold Approximation by Moving Least-Squares Projection (MMLS)

Arxiv

4+阅读 · 2019年3月7日

Global-and-local attention networks for visual recognition

Global-and-local attention networks for visual recognition

Arxiv

5+阅读 · 2018年9月6日

Convexity Shape Prior for Level Set based Image Segmentation Method

Arxiv

4+阅读 · 2018年5月22日

Image Captioning

Arxiv

11+阅读 · 2018年5月13日

Attention-based Group Recommendation

Arxiv

14+阅读 · 2018年4月18日

Correlated discrete data generation using adversarial training

Arxiv

5+阅读 · 2018年4月3日

Pose-Normalized Image Generation for Person Re-identification

Arxiv

11+阅读 · 2018年1月18日

Pyramidal RoR for Image Classification

Arxiv

3+阅读 · 2017年10月1日

VIP会员

相关主题

计算机视觉

相关VIP内容

【经典书】算法基础：打开算法之门，Algorithm unlocked，237页pdf

【经典书】算法基础：打开算法之门，Algorithm unlocked，237页pdf

专知会员服务

147+阅读 · 2020年7月3日

干净的数据：数据清洗入门与实践，204页pdf

干净的数据：数据清洗入门与实践，204页pdf

专知会员服务

164+阅读 · 2020年5月14日

【2020新书】如何构建数据团队？:设计集成的技能、需求和解决方案，257页pdf

【2020新书】如何构建数据团队？:设计集成的技能、需求和解决方案，257页pdf

专知会员服务

115+阅读 · 2020年3月11日

深度学习用于新冠肺炎CT诊断表现如何？武大人民医院medRxiv论文揭示：诊断性能比肩医师，而用时少，大有可为

深度学习用于新冠肺炎CT诊断表现如何？武大人民医院medRxiv论文揭示：诊断性能比肩医师，而用时少，大有可为

专知会员服务

26+阅读 · 2020年2月29日

【综述】金融领域中的深度学习，附52页论文下载

【综述】金融领域中的深度学习，附52页论文下载

专知会员服务

165+阅读 · 2020年2月27日

【经典书】精通机器学习特征工程，中文版，178页pdf

【经典书】精通机器学习特征工程，中文版，178页pdf

专知会员服务

360+阅读 · 2020年2月15日

最新《分布式机器学习》论文综述最新DML进展，33页pdf

最新《分布式机器学习》论文综述最新DML进展，33页pdf

专知会员服务

121+阅读 · 2019年12月26日

深度学习算法与架构回顾

深度学习算法与架构回顾

专知会员服务

84+阅读 · 2019年10月20日

【综述】arXiv最新论文：自动驾驶中深度学习综述，附38页PDF

【综述】arXiv最新论文：自动驾驶中深度学习综述，附38页PDF

专知会员服务

107+阅读 · 2019年10月17日

斯坦福&谷歌Jeff Dean最新Nature论文：医疗深度学习技术指南（29页综述）

斯坦福&谷歌Jeff Dean最新Nature论文：医疗深度学习技术指南（29页综述）

专知会员服务

63+阅读 · 2019年1月7日

热门VIP内容

开通专知VIP会员享更多权益服务

【CMU博士论文】数据驱动决策中的激励、信息与不确定性

DGP双粒度提示框架：图增强大模型助力欺诈检测

【ICCV2025】ESSENTIAL：用于视频类增量学习的情景记忆与语义记忆整合

唯快不破：大型语言模型高效架构综述

相关资讯

知识图谱的行业落地实现

知识图谱的行业落地实现

竹间智能Emotibot

51+阅读 · 2019年9月16日

那些酷炫的深度学习网络图怎么画出来的？

那些酷炫的深度学习网络图怎么画出来的？

计算机视觉life

5+阅读 · 2019年4月12日

NLP技术落地为何这么难？里面有哪些坑？

NLP技术落地为何这么难？里面有哪些坑？

AI100

4+阅读 · 2019年1月9日

在深度学习中处理不均衡数据集

在深度学习中处理不均衡数据集

极市平台

19+阅读 · 2018年11月27日

【知识图谱】知识图谱的技术与应用、落地实践中的问题与对策

【知识图谱】知识图谱的技术与应用、落地实践中的问题与对策

产业智能官

19+阅读 · 2018年8月15日

为什么“高大上”的算法工程师变成了数据民工？

为什么“高大上”的算法工程师变成了数据民工？

数据挖掘入门与实战

5+阅读 · 2018年2月25日

推荐｜机器学习中的模型评价、模型选择和算法选择！

推荐｜机器学习中的模型评价、模型选择和算法选择！

全球人工智能

10+阅读 · 2018年2月5日

论文 | 基于CNN的目标检测算法

论文 | 基于CNN的目标检测算法

七月在线实验室

9+阅读 · 2017年12月7日

<公益广告> 阿里巴巴招聘NLP算法专家

<公益广告> 阿里巴巴招聘NLP算法专家

深度学习与NLP

3+阅读 · 2017年11月30日

机器学习算法比较

机器学习算法比较

我爱机器学习

4+阅读 · 2016年12月11日

相关论文

TResNet: High Performance GPU-Dedicated Architecture

TResNet: High Performance GPU-Dedicated Architecture

Arxiv

8+阅读 · 2020年3月30日

Deep Co-Training for Semi-Supervised Image Segmentation

Deep Co-Training for Semi-Supervised Image Segmentation

Arxiv

6+阅读 · 2019年10月30日

Manifold Approximation by Moving Least-Squares Projection (MMLS)

Manifold Approximation by Moving Least-Squares Projection (MMLS)

Arxiv

4+阅读 · 2019年3月7日

Global-and-local attention networks for visual recognition

Global-and-local attention networks for visual recognition

Arxiv

5+阅读 · 2018年9月6日

Convexity Shape Prior for Level Set based Image Segmentation Method

Arxiv

4+阅读 · 2018年5月22日

Image Captioning

Arxiv

11+阅读 · 2018年5月13日

Attention-based Group Recommendation

Arxiv

14+阅读 · 2018年4月18日

Correlated discrete data generation using adversarial training

Arxiv

5+阅读 · 2018年4月3日

Pose-Normalized Image Generation for Person Re-identification

Arxiv

11+阅读 · 2018年1月18日

Pyramidal RoR for Image Classification

Arxiv

3+阅读 · 2017年10月1日

大家都在搜

无人机集群

CMU博士论文

国防科技创新

软件无线电

论文浅尝 - ICLR2020 | 通过神经逻辑归纳学习有效地解释

微信扫码咨询专知VIP会员