首页
/ PostgresML 开源项目教程

PostgresML 开源项目教程

2024-08-25 21:27:05作者:冯梦姬Eddie

项目介绍

PostgresML 是一个集成在 PostgreSQL 数据库中的机器学习框架,它允许用户直接在数据库内部进行机器学习任务,如文本分类、情感分析和翻译等。通过与 Hugging Face 的 Transformers 库集成,PostgresML 提供了访问数千个预训练模型的能力,使得用户可以在数据库层面直接处理和分析文本数据。

项目快速启动

安装与配置

首先,克隆项目仓库到本地:

git clone https://github.com/postgresml/postgresml.git
cd postgresml

接下来,使用 Docker 快速启动 PostgresML:

docker run -it -v postgresml_data:/var/lib/postgresql -p 5433:5432 -p 8000:8000 ghcr.io/postgresml/postgresml:2.7.12

启动后,可以使用以下命令连接到数据库:

sudo -u postgresml psql -d postgresml

基本使用

在数据库中,可以使用 SQL 查询来进行文本分类:

SELECT pgml.transform(
  task => 'text-classification',
  inputs => ARRAY['I love how amazingly simple ML has become']
);

应用案例和最佳实践

文本分类

在新闻分类系统中,可以使用 PostgresML 对新闻文章进行自动分类:

SELECT pgml.transform(
  task => 'text-classification',
  inputs => ARRAY['Breaking news: Major event happens in the city']
);

情感分析

在客户反馈分析中,可以对用户评论进行情感分析,以了解用户情绪:

SELECT pgml.transform(
  task => 'sentiment-analysis',
  inputs => ARRAY['The service was excellent and the staff very friendly']
);

典型生态项目

Hugging Face Transformers

PostgresML 与 Hugging Face 的 Transformers 库紧密集成,提供了访问大量预训练模型的能力。这些模型可以用于各种 NLP 任务,如文本生成、翻译和问答系统。

PostgreSQL

作为核心数据库,PostgreSQL 提供了强大的数据存储和查询能力,使得 PostgresML 能够在数据库层面直接进行复杂的机器学习任务。

通过这些集成和应用案例,PostgresML 展示了在数据库内部进行机器学习的强大能力和灵活性。

登录后查看全文

项目优选

收起
kernelkernel
openEuler内核是openEuler操作系统的核心,既是系统性能与稳定性的基石,也是连接处理器、设备与服务的桥梁。
C
511
551
docsdocs
暂无描述
Markdown
852
5.69 K
ops-transformerops-transformer
本项目是CANN提供的transformer类大模型算子库,实现网络在NPU上加速计算。
C++
1.05 K
2.49 K
kernelkernel
deepin linux kernel
C
33
16
pytorchpytorch
作为 Ascend for PyTorch 社区的核心组件,TorchNPU 是昇腾专为 PyTorch 打造的深度学习适配插件,使 PyTorch 框架能够直接调用昇腾 NPU,为开发者提供昇腾 AI 处理器的超强算力。
Python
839
1.28 K
ops-nnops-nn
本项目是CANN提供的神经网络类计算算子库,实现网络在NPU上加速计算。
C++
847
1.7 K
ops-mathops-math
本项目是CANN提供的数学类基础计算算子库,实现网络在NPU上加速计算。
C++
1.25 K
1.38 K
jiuwenswarmjiuwenswarm
JiuwenSwarm 是一款基于openJiuwen开发的智能AI Agent,它能够将大语言模型的强大能力,通过你日常使用的各类通讯应用,直接延伸至你的指尖。
Python
3.17 K
857
AscendNPU-IRAscendNPU-IR
AscendNPU-IR是基于MLIR(Multi-Level Intermediate Representation)构建的,面向昇腾亲和算子编译时使用的中间表示,提供昇腾完备表达能力,通过编译优化提升昇腾AI处理器计算效率,支持通过生态框架使能昇腾AI处理器与深度调优
C++
503
346
cann-learning-hubcann-learning-hub
CANN 学习中心仓,支持在线互动运行、边学边练,提供教程、示例与优化方案,一站式助力昇腾开发者快速上手。
Jupyter Notebook
787
415