Polars CLI 使用教程
2024-08-24 19:17:01作者:郜逊炳
项目介绍
Polars CLI 是一个基于 Rust 的开源项目,提供了一个命令行接口,用于执行 SQL 命令并使用 Polars 作为后端处理数据。Polars 是一个高性能的 DataFrame 库,适用于数据分析和处理。Polars CLI 允许用户通过命令行交互式地运行 SQL 查询,支持读取和写入多种数据格式,如 CSV、JSON 和 IPC/Apache Arrow 文件。
项目快速启动
安装 Polars CLI
推荐使用 pip 安装 Polars CLI:
pip install polars-cli
基本使用
安装完成后,可以通过以下命令启动 Polars CLI 的交互式 shell:
polars
在交互式 shell 中,可以运行 SQL 命令。例如,读取一个 CSV 文件并进行查询:
select * FROM read_csv('examples/datasets/foods.csv')
应用案例和最佳实践
数据分析
Polars CLI 可以用于快速数据分析。例如,读取一个包含食品信息的 CSV 文件,并查询每种食品的卡路里平均值:
SELECT category, AVG(calories) AS avg_calories
FROM read_csv('examples/datasets/foods.csv')
GROUP BY category
数据清洗
Polars CLI 也适用于数据清洗任务。例如,读取一个包含缺失值的 CSV 文件,并填充缺失值:
SELECT category, COALESCE(calories, 0) AS calories
FROM read_csv('examples/datasets/foods.csv')
典型生态项目
Polars
Polars 是一个高性能的 DataFrame 库,提供了丰富的数据处理功能。Polars CLI 利用 Polars 作为后端,提供了强大的数据处理能力。
Apache Arrow
Apache Arrow 是一个跨平台的内存数据格式,适用于高性能数据处理。Polars CLI 支持读取和写入 Apache Arrow 文件,便于与其他数据处理工具集成。
Rust
Rust 是一种系统编程语言,强调性能、可靠性和生产力。Polars CLI 使用 Rust 编写,确保了高效和稳定的性能。
通过以上教程,您可以快速上手 Polars CLI,并利用其强大的数据处理功能进行数据分析和清洗。
登录后查看全文
热门项目推荐
atomcodeClaude Code 的开源替代方案。连接任意大模型,编辑代码,运行命令,自动验证 — 全自动执行。用 Rust 构建,极致性能。 | An open-source alternative to Claude Code. Connect any LLM, edit code, run commands, and verify changes — autonomously. Built in Rust for speed. Get StartedRust0212
cann-learning-hubCANN 学习中心仓,支持在线互动运行、边学边练,提供教程、示例与优化方案,一站式助力昇腾开发者快速上手。Jupyter Notebook0137
JoyAI-EchoJoyAI-Echo,这是一个独立的、仅用于推理的版本,旨在实现分钟级多镜头音视频生成。它采用了经过蒸馏的DMD生成器、配对的跨模态记忆以及故事级别的一致性。其性能的核心在于,一个跨模态视听记忆库能够在长达五分钟的视频中保持角色外观和语音音色的一致性。同时,一个训练后处理流程将基于记忆的强化学习与分布匹配蒸馏相结合,实现了7.5倍的速度提升,显著增强了视觉质量和对齐效果。00
GLM-5.2智谱开源 GLM-5.2,这是针对长文本任务的最新旗舰模型。相较于前代产品 GLM-5.1,它在长文本任务处理能力上实现了显著飞跃,并且首次在稳定的 100 万 token 上下文中提供这一能力。Jinja00
SwanLab⚡️SwanLab - an open-source, modern-design AI training tracking and visualization tool. Supports Cloud / Self-hosted use. Integrated with PyTorch / Transformers / LLaMA Factory / veRL/ Swift / Ultralytics / MMEngine / Keras etc.Python00
tiny-universe《大模型白盒子构建指南》:一个全手搓的Tiny-UniverseJupyter Notebook03
项目优选
收起
deepin linux kernel
C
32
16
暂无描述
Dockerfile
774
5.07 K
本项目是CANN提供的transformer类大模型算子库,实现网络在NPU上加速计算。
C++
872
2.01 K
openEuler内核是openEuler操作系统的核心,既是系统性能与稳定性的基石,也是连接处理器、设备与服务的桥梁。
C
468
461
Ascend Extension for PyTorch
Python
757
960
本项目是CANN提供的神经网络类计算算子库,实现网络在NPU上加速计算。
C++
696
1.4 K
本项目是CANN提供的数学类基础计算算子库,实现网络在NPU上加速计算。
C++
1.1 K
1.14 K
本仓库是 Flutter SDK 与 Flutter Engine 的 OpenHarmony 适配版本,由 CPF-Flutter 团队维护。开发者可使用熟悉的 Flutter 技术栈开发 OpenHarmony 应用,3.35.7 及以后的适配版本可基于本仓库源码构建支持 OpenHarmony 的 Flutter Engine。
Dart
1.03 K
271
昇腾LLM分布式训练框架
Python
183
230
CANNBot 是面向 CANN 开发的用于提升开发效率的系列智能体,本仓库为其提供可复用的 Skills 模块。
Python
1.03 K
646