基于非常简单的Python代码就能完成流水线开发-电子发烧友网

Mara-pipelines 是一个轻量级的数据转换框架，具有透明和低复杂性的特点。其他特点如下：

基于非常简单的Python代码就能完成流水线开发。

使用 PostgreSQL 作为数据处理引擎。

有Web界面可视化分析流水线执行过程。

基于 Python 的 multiprocessing 单机流水线执行。不需要分布式任务队列。轻松调试和输出日志。

基于成本的优先队列：首先运行具有较高成本（基于记录的运行时间）的节点。

此外，在Mara-pipelines的Web界面中，你不仅可以查看和管理流水线及其任务节点，你还可以直接触发这些流水线和节点，非常好用：

1.安装

由于使用了大量的依赖，Mara-pipelines 并不适用于 Windows，如果你需要在 Windows 上使用 Mara-pipelines，请使用 Docker 或者 Windows 下的 linux 子系统。

使用pip安装Mara-pipelines:

pip install mara-pipelines

或者：

pip install git+https://github.com/mara/mara-pipelines.git

2.使用示例

这是一个基础的流水线演示，由三个相互依赖的节点组成，包括任务1(ping_localhost), 子流水线(sub_pipeline), 任务2(sleep):

# 注意，这个示例中使用了部分国外的网站，如果无法访问，请变更为国内网站。
frommara_pipelines.commands.bash importRunBash
frommara_pipelines.pipelines importPipeline, Task
frommara_pipelines.ui.cli importrun_pipeline, run_interactively

pipeline = Pipeline(
id='demo',
description='A small pipeline that demonstrates the interplay between pipelines, tasks and commands')

pipeline.add(Task(id='ping_localhost', description='Pings localhost',
commands=[RunBash('ping -c 3 localhost')]))

sub_pipeline = Pipeline(id='sub_pipeline', description='Pings a number of hosts')

forhost in['google', 'amazon', 'facebook']:
sub_pipeline.add(Task(id=f'ping_{host}', description=f'Pings {host}',
commands=[RunBash(f'ping -c 3 {host}.com')]))

sub_pipeline.add_dependency('ping_amazon', 'ping_facebook')
sub_pipeline.add(Task(id='ping_foo', description='Pings foo',
commands=[RunBash('ping foo')]), ['ping_amazon'])

pipeline.add(sub_pipeline, ['ping_localhost'])

pipeline.add(Task(id='sleep', description='Sleeps for 2 seconds',
commands=[RunBash('sleep 2')]), ['sub_pipeline'])

可以看到，Task包含了多个commands，这些 command s会用于真正地执行动作。

而 pipeline.add 的参数中，第一个参数是其节点，第二个参数是此节点的上游。如：

pipeline.add(sub_pipeline, ['ping_localhost'])

则表明必须执行完 ping_localhost 才会执行 sub_pipeline.

为了运行这个流水线，需要配置一个 PostgreSQL 数据库来存储运行时信息、运行输出和增量处理状态：

importmara_db.auto_migration
importmara_db.config
importmara_db.dbs

mara_db.config.databases 
= lambda: {'mara': mara_db.dbs.PostgreSQLDB(host='localhost', user='root', database='example_etl_mara')}

mara_db.auto_migration.auto_discover_models_and_migrate()

如果 PostgresSQL 正在运行并且账号密码正确，输出如下所示（创建了一个包含多个表的数据库）：

Created database "postgresql+psycopg2://root@localhost/example_etl_mara"

CREATETABLEdata_integration_file_dependency (
node_path TEXT[] NOTNULL, 
dependency_type VARCHARNOTNULL, 
hashVARCHAR, 
timestampTIMESTAMPWITHOUTTIMEZONE, 
PRIMARY KEY(node_path, dependency_type)
);

.. more tables

为了运行这个流水线，你需要：

frommara_pipelines.ui.cli importrun_pipeline

run_pipeline(pipeline)

这将运行单个流水线节点及其 (sub_pipeline) 所依赖的所有节点：

run_pipeline(sub_pipeline, nodes=[sub_pipeline.nodes['ping_amazon']], with_upstreams=True)

3.Web 界面

我认为 mara-pipelines 最有用的是他们提供了基于Flask管控流水线的Web界面。

对于每条流水线，他们都有一个页面显示：

所有子节点的图以及它们之间的依赖关系

流水线的总体运行时间图表以及过去 30 天内最昂贵的节点（可配置）

所有流水线节点及其平均运行时间和由此产生的排队优先级的表

流水线最后一次运行的输出和时间线

对于每个任务，都有一个页面显示

流水线中任务的上游和下游

最近 30 天内任务的运行时间

任务的所有命令

任务最后运行的输出

此外，流水线和任务可以直接从网页端调用运行，这是非常棒的特点。

责任编辑：haq

声明：本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人，不代表电子发烧友网立场。文章及其配图仅供工程师学习之用，如有内容侵权或者其他违规问题，请联系本站处理。举报投诉

数据

数据

+关注

关注
8

文章
7221

浏览量
90069
python

python

+关注

关注
56

文章
4812

浏览量
85226

原文标题：超级方便的轻量级 Python 流水线工具，还有漂亮的可视化界面！

文章出处：【微信号：LinuxHub，微信公众号：Linux爱好者】欢迎添加关注！文章转载请注明出处。

工业读码器解决方案在自动化流水线上扫描条码的应用

工业读码器解决方案在自动化流水线上的应用主要包括以下几个方面：1、提高生产效率和准确性工业读码器嵌入在工业流水线中，无需人工扫描，大大提高了效率，节约了人力成本。读码效果稳定，准确率非常高，可以通过

发表于 11-20 16:28 •359次阅读

工业读码器解决方案在自动化<b class='flag-5'>流水线</b>上扫描条码的应用

SMT流水线布局优化技巧

在电子制造领域，SMT（表面贴装技术）流水线的布局优化对于提高生产效率、降低成本和提升产品质量至关重要。一个合理的流水线布局可以减少物料搬运时间，提高设备利用率，减少人为错误，并且提高整体的生产

发表于 11-14 09:11 •570次阅读

工业流水线的智能助手——智能计数，效率倍增

在工业流水线中，每一个产品的计数都至关重要。迪卡尔ITMC-DSeries-x02系列物联网测控终端，您的智能生产伙伴。

发表于 11-06 17:11 •410次阅读

工业<b class='flag-5'>流水线</b>的智能助手——智能计数，效率倍增

流水线中Half-Buffer与Skid-Buffer的使用

引发上述问题的原因是未能及时阻塞之前的流水线，再深究其原因，是因为其输入侧和输出侧的握手允许在相同时钟周期完成，所以阻塞的信息没有同步到上级。

发表于 11-05 17:16 •556次阅读

<b class='flag-5'>流水线</b>中Half-Buffer与Skid-Buffer的使用

行云流水线满足你对工作流编排的一切幻想～skr

流水线模型众所周知，DevOps流水线（DevOps pipeline）的本质是实现自动化工作流程，用于支持软件开发、测试和部署的连续集成、交付和部署（CI/CD）实践。它是DevOps方法论

发表于 08-05 13:42 •362次阅读

ADS930高速流水线模数转换器(ADC)数据表

电子发烧友网站提供《ADS930高速流水线模数转换器(ADC)数据表.pdf》资料免费下载

发表于 07-30 14:10 •1次下载

ADS930高速<b class='flag-5'>流水线</b>模数转换器(ADC)数据表

ADS901高速流水线模数转换器数据表

电子发烧友网站提供《ADS901高速流水线模数转换器数据表.pdf》资料免费下载

发表于 07-30 11:43 •1次下载

ADS901高速<b class='flag-5'>流水线</b>模数转换器数据表

ADS5421流水线式模数转换器(ADC)数据表

电子发烧友网站提供《ADS5421流水线式模数转换器(ADC)数据表.pdf》资料免费下载

发表于 07-30 11:16 •0次下载

ADS5421<b class='flag-5'>流水线</b>式模数转换器(ADC)数据表

ADS5413 CMOS流水线模数转换器(ADC)数据表

电子发烧友网站提供《ADS5413 CMOS流水线模数转换器(ADC)数据表.pdf》资料免费下载

发表于 07-29 13:21 •0次下载

ADS5413 CMOS<b class='flag-5'>流水线</b>模数转换器(ADC)数据表

ADS828流水线式CMOS模数转换器数据表

电子发烧友网站提供《ADS828流水线式CMOS模数转换器数据表.pdf》资料免费下载

发表于 07-23 09:17 •0次下载

ADS828<b class='flag-5'>流水线</b>式CMOS模数转换器数据表

ADS5422流水线式模数转换器(ADC)数据表

电子发烧友网站提供《ADS5422流水线式模数转换器(ADC)数据表.pdf》资料免费下载

发表于 07-16 11:17 •0次下载

ADS5422<b class='flag-5'>流水线</b>式模数转换器(ADC)数据表

固定式的扫码器在SMT流水线中的使用

新大陆固定式扫码器作为一种高效的条码扫描设备，广泛应用于各个行业中，尤其是在SMT（表面贴装技术）流水线中有重要的作用。以下是新大陆固定式扫码器在SMT流水线中的具体使用情况。提高生产效率和质量

发表于 07-03 10:18 •667次阅读

固定式的扫码器在SMT<b class='flag-5'>流水线</b>中的使用

新大陆工业读码器Soldier100，用于流水线上数据码采集

，非常适合在制造业中进行数据码的采集。高速流动条码的识别能力：在制造业的流水线上，尤其是在大企业和大产品生产的过程中，数据收集非常重要。传统的手工收集方法不仅效率低下

发表于 06-26 14:12 •417次阅读

新大陆工业读码器Soldier100，用于<b class='flag-5'>流水线</b>上数据码采集

RISC-V架构的多级流水线处理

有的单核RISC-V MCU支持四级流水线，有的只支持三级流水线，是不是级数越多，带来的开销越大，功耗也越高呢？

发表于 05-20 16:01

具有3态输出的多级流水线寄存器数据表

电子发烧友网站提供《具有3态输出的多级流水线寄存器数据表.pdf》资料免费下载

发表于 05-16 09:39 •0次下载

林超文PCB设计：PADS教程，PADS视频教程	郑振宇老师：Altium Designer教程，Altium Designer视频教程
张飞实战电子视频教程	朱有鹏老师：海思HI3518e教程，HI3518e视频教程
李增老师：信号完整性教程，高速电路仿真教程	华为鸿蒙系统教程，HarmonyOS视频教程
赛盛：EMC设计教程，EMC视频教程	杜洋老师：STM32教程，STM32视频教程
唐佐林：c语言基础教程，c语言基础视频教程	张飞：BUCK电源教程，BUCK电源视频教程
正点原子：FPGA教程，FPGA视频教程	韦东山老师：嵌入式教程，嵌入式视频教程
张先凤老师：C语言基础视频教程	许孝刚老师：Modbus通讯视频教程
王振涛老师：NB-IoT开发视频教程	Mill老师：FPGA教程，Zynq视频教程
C语言视频教程	RK3566芯片资料合集
朱有鹏老师：U-Boot源码分析视频教程	开源硬件专题

搜索历史

基于非常简单的Python代码就能完成流水线开发

评论