您当前的位置:首页 > 电脑百科 > 人工智能

机器学习系统架构的十个要素

时间:2023-03-02 15:00:17  来源:微信公众号  作者:喔家ArchiSelf

这是一个AI赋能的时代,而机器学习则是实现AI的一种重要技术手段。那么,是否存在一个通用的通用的机器学习系统架构呢?

在老码农的认知范围内,Anything is nothing,对系统架构而言尤其如此。但是,如果适用于大多数机器学习驱动的系统或用例,构建一个可扩展的、可靠的机器学习系统架构还是可能的。从机器学习生命周期的角度来看,这个所谓的通用架构涵盖了关键的机器学习阶段,从开发机器学习模型,到部署训练系统和服务系统到生产环境。我们可以尝试从10个要素的维度来描述这样的一个机器学习系统架构。

图片

1.数据和特征工程流水线

在给定的时间内提供高质量的数据,并以可伸缩和灵活的方式生成有用的机器学习特征。一般来说,数据流水线可以与特征工程流水线分离。数据流水线是指提取、转换和加载(ETL)的流水线,其中,数据工程师负责将数据传输到存储位置,比如建立在对象存储之上的数据湖,特征工程流水线侧重于将原始数据转换成可以帮助机器学习算法更快、更准确地学习的机器学习特征。

特征工程一般分为两个阶段。在第一阶段,特征工程逻辑通常由数据科学家在开发阶段通过各种实验创建,以便找到最佳的特征集合,而数据工程师或机器学习工程师则负责特征工程流水线的生产,为模型训练和在生产环境中服务提供高质量的特征数据。

2. 特征存储

存储机器学习的特征数据,进行版本管理,用于发现、共享和重用,并为模型训练和服务提供一致的数据和机器学习特征,从而提高机器学习系统的可靠性。

面对机器学习的特征数据,特征存储是特征工程流水线创建的持久化存储方案。特性存储支持模型训练和服务。因此,它是一个非常重要的部分,是端到端机器学习系统架构的一个重要组件。

3.机器学习模型训练和再训练流水线

对于机器学习训练运行不同的参数和超参数,以一种简单和可配置的方式进行实验,并记录这些训练所运行的各种参数和模型性能指标。自动评估、验证、选择性能最好的模型并将其记录到机器学习模型库中。

4.训练与模型的元存储

存储并记录机器学习的运行,包括参数、指标、代码、配置结果和经过培训的模型,并提供模型的生命周期管理、模型注释、模型发现和模型重用等功能。

对于一个完整的机器学习系统来说,以工程、模型训练和模型服务为特征,可以从数据中生成大量的元数据。所有这些元数据对于了解系统如何工作非常有用,可以从数据-> 特征-> 模型-> 服务端来提供可跟踪性,并在模型停止工作时提供用于调试的有用信息。

5.机器学习模型服务流水线

为在生产环境中使用机器学习模型提供适当的基础设施,既考虑到全程服务,也要考虑延迟。

一般来说,有三种服务模式: 批量服务、流式服务和online服务。每种服务类型都需要完全不同的基础设施。此外,基础设施应该是容错和自动扩展的,以响应请求和吞吐量波动,特别是对于关键业务的机器学习系统。

6.监控生产中的 ML 模型

在生产环境中,在发现数据和模型漂移及异常时,提供数据收集、监控、分析、可视化和通知功能,并提供必要的信息协助系统调试。

7.机器学习流水线

与特定的机器学习工作流相比,机器学习流水线提供了一个可重用的框架,使数据科学家能够更快地开发和迭代,同时保持高质量的代码并减少生产时间。一些机器学习流水线框架还提供了编排和架构抽象的功能。

8.工作流编排

工作流编排是集成端到端机器学习系统的关键组件,协调和管理所有这些关键组件的依赖项。工作流编排工具还提供诸如日志记录、缓存、调试和重试等功能。

9.持续集成/持续培训/持续交付(CI/CT/CD)

持续测试和持续集成是指持续用新数据培训新模型,在需要时升级模型性能,并以安全、敏捷和自动化的方式持续为生产环境提供服务并部署模型。

10.针对数据和模型的端到端质量控制

在端到端机器学习工作流的各个阶段,需要嵌入可靠的数据质量检查、模型质量检查、数据和概念漂移检测,以确保机器学习系统本身是可靠且可信的。这些质量控制的检查包括描述统计学、整体数据形状、数据缺失、数据重复、几乎恒定的特征、统计测试、距离指标和模型预测质量,等等。

以上,可以称之为机器学习系统架构的10个要素。在我们的实践中,整个工作流应该保持大致相同,但可能需要对其中某些要素进行调整和定制。

如何对机器学习的系统架构进行调整呢?

如何在产品设计之初精简架构要素呢?

如何在引入机器学习系统系统时,保持原有系统架构的持续性呢? 



Tags:架构   点击:()  评论:()
声明:本站部分内容及图片来自互联网,转载是出于传递更多信息之目的,内容观点仅代表作者本人,如有任何标注错误或版权侵犯请与我们联系(Email:2595517585@qq.com),我们将及时更正、删除,谢谢。
▌相关推荐
这是一个AI赋能的时代,而机器学习则是实现AI的一种重要技术手段。那么,是否存在一个通用的通用的机器学习系统架构呢?在老码农的认知范围内,Anything is nothing,对系统架构而言...【详细内容】
2023-03-02  Tags: 架构  点击:(0)  评论:(0)  加入收藏
基本组件Nginx、Gateway、Nacos、Sentinel、Ribbon、Feign、Seata、Redis、RabbitMQ、MySQL、docker、Vue。大家好,我是哪吒。今天分享一篇一站式微服务架构,读哪吒编程,品技术...【详细内容】
2023-02-27  Tags: 架构  点击:(13)  评论:(0)  加入收藏
当我们在说云架构的时候,通常指的并不是云平台的自身架构,而是基于云平台的软件系统基础架构。云平台的自身架构满足了很多通用层面的需求,例如对象存储,弹性主机,虚拟网络等等,只...【详细内容】
2023-02-26  Tags: 架构  点击:(7)  评论:(0)  加入收藏
前言功能业务代码写多了,回看代码会发现用if-else if-else用的越来越多,因为有很多场景需要区分,不同场景下的功能不一样,因此需要通过if做判断,场景一旦多了起来起来,用if-else i...【详细内容】
2023-02-20  Tags: 架构  点击:(7)  评论:(0)  加入收藏
在本文中,深入了解基础架构即代码 (IaC) 的工作原理、其优势和常见挑战。基础架构即代码 (IaC) 是使用代码和软件开发技术配置和管理基础架构的实践。IaC 背后的主要思想是消...【详细内容】
2023-02-19  Tags: 架构  点击:(6)  评论:(0)  加入收藏
当你在构建一个分布式系统时,势必需要考虑的一个问题是:如何实现服务与服务之间的调用?当然,你可以使用 Dubbo 或 Spring Cloud 等分布式服务框架来封装技术实现的复杂性,以此完...【详细内容】
2023-02-17  Tags: 架构  点击:(16)  评论:(0)  加入收藏
一、为什么要设计股权架构?1、明晰合伙人的权,责,利亲兄弟都要明算账,所以合伙人之间的分工与回报,在早期是一定要明确分配好的。合伙创业讲究情怀没错,但最终也是要实现实际利...【详细内容】
2023-02-17  Tags: 架构  点击:(0)  评论:(0)  加入收藏
背景会员系统是一种基础系统,跟公司所有业务线的下单主流程密切相关。如果会员系统出故障,会导致用户无法下单,影响范围是全公司所有业务线。所以,会员系统必须保证高性能、高可...【详细内容】
2023-02-13  Tags: 架构  点击:(11)  评论:(0)  加入收藏
软件架构领域正在爆发一场新的革命。Gartner权威发布2023年十大科技趋势之一“可持续IT架构”,可持续架构得到越来越多从业人员认同。创建和维护可持续的软件架构对于架构师...【详细内容】
2023-02-10  Tags: 架构  点击:(28)  评论:(0)  加入收藏
机器之心转载来源:Suits and Hoodies 这里转载一篇深度剖析ChatGPT成功的一篇好文章:ChatGPT 实际上并不是普通人眼中的「黑科技」,而是持续开放科研的产物,是工程与产品的胜利...【详细内容】
2023-02-08  Tags: 架构  点击:(12)  评论:(0)  加入收藏
▌简易百科推荐
这是一个AI赋能的时代,而机器学习则是实现AI的一种重要技术手段。那么,是否存在一个通用的通用的机器学习系统架构呢?在老码农的认知范围内,Anything is nothing,对系统架构而言...【详细内容】
2023-03-02  喔家ArchiSelf  微信公众号  Tags:架构   点击:(0)  评论:(0)  加入收藏
AGI是Artificial General Intelligence的缩写,即通用人工智能。AGI的目标是实现人类般的通用智能,这意味着AI可以像人类一样理解任意通用任务, 并以人类的智力水平执行完成。...【详细内容】
2023-03-02  Web3天空之城   企鹅号  Tags:人工智能   点击:(1)  评论:(0)  加入收藏
边缘计算是指将数据和信息移动到更靠近用户的地方。以前,大多数数据存储在由通过互联网访问的服务器组成的云中。随着边缘计算迅速占据中心地位,各企业都在增加在边缘计算上的...【详细内容】
2023-02-28    千家网  Tags:边缘计算   点击:(3)  评论:(0)  加入收藏
新智元报道编辑:LRS【新智元导读】数据集包含葡萄牙语和汉语普通话。虽然全中国的人都在说汉语,但具体到各地的方言却略有不同,比如同样是 小巷的意思,「胡同」一开口就知道是老...【详细内容】
2023-02-28  新智元    Tags:   点击:(4)  评论:(0)  加入收藏
近期,ChatGPT成为人工智能领域现象级热点。这是由美国OpenAI公司发布的对话机器人,其“投人所好”的回答备受社会各领域关注,甚至产生是否意味人工智能新一轮技术革命、是否具...【详细内容】
2023-02-28    金融界  Tags:ChatGPT   点击:(4)  评论:(0)  加入收藏
每经记者 陈婷 每经编辑 刘雪梅 “两百多年前我们有了机器,所以人类进入了机械化时代,几十年前有了电子设备,所以人类进入电子化时代。未来几十年,算法是推动技术创新、科...【详细内容】
2023-02-28    每日经济新闻  Tags:ChatGPT   点击:(4)  评论:(0)  加入收藏
虽然ChatGPT已经被调教为符合人类的偏好,但在各种反向操作下,还是能够逼问出一些「不道德的内容」,比如ChatGPT可以给你列一份详细的毁灭世界计划列表,具体到每一步。 不过,现在...【详细内容】
2023-02-27  新智元    Tags:「终结者」走入现实?微软的野心:用ChatGPT控制机器人!   点击:(7)  评论:(0)  加入收藏
就在两年前,微软高管还在极力称赞元宇宙是改变游戏规则的事物,就像他们现在谈论ChatGPT一样。在OpenAI推出的ChatGPT风靡全球之前,很多人认为元宇宙将成为下一个大事件,并将以前...【详细内容】
2023-02-27    极客网  Tags:人工智能   点击:(7)  评论:(0)  加入收藏
“如果我们不采用 ChatGPT 类技术,像我这样的企业将在一年内不复存在。这对任何在家中进行语音控制的人的未来至关重要。”​Josh.ai 展示了使用其语音助手进行概念验证的 Ch...【详细内容】
2023-02-27  JENNIFER PATTISON TU  千家网  Tags:ChatGPT   点击:(6)  评论:(0)  加入收藏
作 者丨周潇枭编 辑丨陈洁图 源丨21世纪经济报道(甘俊 摄)2月24日,国务院新闻办公室举行“权威部门话开局”系列主题新闻发布会,邀请科学技术部部长王志刚介绍“深入实施创新驱...【详细内容】
2023-02-27  21世纪经济报道    Tags:ChatGPT   点击:(2)  评论:(0)  加入收藏
站内最新
站内热门
站内头条