数据是人工智能和机器学习的基础
2018/10/20 14:40AI云资讯10969

图片来源原文配文
人工智能(AI)和机器学习(ML)将对制造业产生巨大影响。利用这些技术,制造商将获得解决人类无法解决的问题所需的计算能力。他们最终将能够为制造商几个世纪以来一直在寻求的生产问题提供规范的答案。也就是说,我们如何尽可能高效地生产产品,零浪费和最少的停机时间。
与大多数关于突破性技术的报道一样,对“圣杯”的讨论远远超过了行业惯例。愿景提供了一个有用的目的,建议什么是可能的。但是,由于许多制造商缺乏获得真正的AI和ML功能所必需的数据基础设施,完美生产的过程也可能如此抽象,以至于让想要实现它的人感到困惑。企业领导经常会问我“我们在哪里以及如何采用人工智能技术?”

从数据开始
虽然科幻声音的AI场景突出了该技术令人难以置信的计算能力,但实际有效的应用程序始于数据。实际上,数据既是制造商最未充分利用的资产,也是使AI如此强大的基本要素。想想马斯洛的需求层次,一种被描述为金字塔的动机理论,底层最基本,最重要的需求,以及顶层最复杂的需求。

图片来源原文配图
同样,Monica Rogati的数据科学需求层次是一个金字塔,显示了为生产系统添加智能所需的内容。最底层是需要以正确的格式和系统以适当的数量收集正确的数据。人工智能和机器学习的任何应用只会与收集的数据质量一样好。
当开始采用人工智能时,许多制造商发现他们的数据有多种不同的格式存储在几个MES,ERP和SCADA系统中。如果生产过程是手动的,那么收集和分析的数据非常少,而且它有很多差异。这就是所谓的“脏数据”,这意味着任何试图理解它的人- 甚至是数据科学家- 都将不得不花费大量的时间和精力。他们需要将数据转换为通用格式并将其导入通用系统,在那里它可用于构建模型。
一旦收集到良好,干净的数据,制造商必须确保他们拥有足够的关于他们正在努力改进的流程或他们试图解决的问题的正确数据。他们需要确保他们有足够的用例,并且他们正在捕获影响该用例的所有数据变量。
例如,只收集一个关于机器每分钟转数的变量,这不足以告诉您失败的原因。但是,如果添加有关机器故障的许多条件的振动,温度和数据,您可以开始构建模型和算法来预测故障。此外,随着更多数据的收集,您可以创建精度要求,例如此算法将能够在一天的时间内预测此故障,准确率为90%。
如果这听起来很复杂,可以使用解决方案自动从各种设备和系统收集数据,然后自动清理数据或格式。这使工程师可以专注于构建模型和算法,而不是花时间清理数据。

首先解决一个更简单的问题
使用数据优先方法开始人工智能之旅,使制造商能够从一开始就开始理解和控制他们的流程。这不仅有助于制造商实现受控流程并开始获得一些相对快速的好处,例如消除流程变化,还可以通过更先进的人工智能和机器学习模型改进他们未来可以进行的分析类型。
请记住:如果您的过程失控,向其中添加AI将不会神奇地修复它。
从收集数据和解决即时生产问题开始的另一个关键原因是在您的行业中获得先发优势。谷歌,亚马逊和Facebook等公司主导了他们的行业,因为他们是第一个开始构建数据集的公司。他们的数据集变得如此之大,他们的数据收集和分析非常复杂,以至于他们能够增强竞争优势。
对于制造商而言,方程式类似。制造商越早开始人工智能之旅,他们就越早建立大型数据集,使他们能够执行高级AI和ML模型。每次迭代,他们将在自己和竞争对手之间留出更多距离。
采用AI和ML是一个旅程,而不是一个可以瞬间解决问题的银弹。它首先将数据收集到简单的可视化和统计过程中,以便您更好地了解数据并控制流程。从那里开始,您将获得越来越先进的分析能力,直到您实现完美生产的乌托邦目标,即人工智能帮助您尽可能高效,安全地生产产品。
相关文章
- Agent成为数据“新消费者”,华为云重构面向Agent的数据基础设施
- 从“被动存储“到“主动服务“ 数据基础设施迎来“场景计算“新变量
- 数博会2026|以词元破局,东软打通数据要素价值化落地新范式
- 中国移动副总经理张冬:可信AI筑基,数据智能赋能——共建国际合作新生态
- 算力如水随取随用 中国移动携手湖北大数据集团筑牢算网底座,赋能中部算力枢纽建设
- 英伟达上季度营收破960亿,数据中心成绝对主力
- 数据不搬家,语义更明确:阿里云 Polar Lakebase 支撑千万Agent规模化运行
- 四维图新:数据合规业务同比增长56%
- 谁的数据,先成为AI的“原住民”?——从2026科学智能大会,看科技数据的下一个十年
- 从“山城链”到文旅数据集:趣链科技的重庆数据要素路径
- 2026时序数据技术创新大会:多模态时序数智化软件栈发布,生态计划启动
- 一句话查询商业信息,启信宝AI问企降低数据应用门槛
- 热浪之下,稳守机房“生命线”|科士达精密空调筑牢数据中心温控屏障
- 腾讯云发布 AI 数据底座 TDSQL Nexa,多项 AI 数据库能力进入生产环境
- 漏检率降超80%背后:趣链科技的可信数据空间落地路径
- 四维图新CEO程鹏:高质量数据是具身智能规模化发展的基石
AI企业
更多>>AI硬件
更多>>- 联合开源!因时机器人携手上海交大、复旦发布HandEdit数据集与评测基准
- 华沿机器人与骅升科技达成战略合作,携手布局具身智能与协作机器人市场
- 元点机器人Bridge斩获IFA年度创新奖,全球首款AI原生人形机器人柏林首秀
- 华硕 ProArt 创梦 27 OLED:以 4K QD-OLED 与专业色彩表现,支持精细化创作
- 芯展速 Gen 6 Retimer 正式上市,副总裁李蓁 ODCC大会演讲官宣 获媒体热议
- 行业首款60℃热雾巨无霸滚筒扫拖旗舰!iRobot Roomba 875发布,重新定义扫地机器人清洁力
- 华硕主板助国产颗粒内存达成四槽满插6000C30与双条8000C36双重突破
- 首日销量突破600台!8888元的元点机器人Bridge正在赢得开发者
AI产业
更多>>AI技术
更多>>- 全球最强开源模型 Kimi K3 发布,参数规模 3 万亿,真的是强!
- 范式变革!东软发布AI原生软件工程白皮书,重构软件产业底层逻辑
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练
- 高德发布鸿蒙首个生成式 UI 开源框架 AGenUI,告别传统 UI 开发模式
- 发布即适配| 天数智芯全力支持腾讯混元Hy3 preview 开源落地,共推国内大模型产业普惠









