EvoJAX 开源项目教程
1. 项目介绍
EvoJAX 是一个可扩展的、通用性的硬件加速神经进化工具包。它基于 JAX 库构建,使得神经进化算法能够在多个 TPU/GPU 上并行运行。EvoJAX 通过将进化算法、神经网络和任务全部实现为 NumPy 代码,并即时编译以在加速器上运行,从而实现了非常高的性能。
EvoJAX 不仅支持监督学习、强化学习等任务,还适用于生成艺术等创新领域。项目的目标是让进化计算能够在各种任务中高效运行,特别是在使用加速器的情况下,显著缩短训练时间。
2. 项目快速启动
安装 JAX
首先,需要安装 JAX。请根据 JAX 的官方安装指南进行安装,并选择是否启用 GPU/TPU 支持。
pip install --upgrade pip
pip install --upgrade "jax[cuda]" -f https://storage.googleapis.com/jax-releases/jax_cuda_releases.html
安装 EvoJAX
安装 EvoJAX 可以通过 PyPI 或直接从 GitHub 仓库安装。
# 从 PyPI 安装
pip install evojax
# 或从 GitHub 仓库安装
pip install git+https://github.com/google/evojax.git@main
快速启动示例
以下是一个简单的示例,展示了如何使用 EvoJAX 进行 MNIST 分类任务的训练。
import evojax
from evojax.task.mnist import MNIST
from evojax.policy.convnet import ConvNetPolicy
from evojax.algo.pgpe import PGPE
# 初始化任务
task = MNIST()
# 初始化策略网络
policy = ConvNetPolicy(input_dim=task.obs_shape, output_dim=task.act_shape)
# 初始化算法
algo = PGPE(pop_size=100, param_size=policy.num_params)
# 初始化训练器
trainer = evojax.trainer.Trainer(
policy=policy,
task=task,
algo=algo,
max_iter=1000,
log_interval=100,
test_interval=500,
n_repeats=1,
n_evaluations=1,
seed=0,
log_dir='./logs'
)
# 开始训练
trainer.run()
3. 应用案例和最佳实践
监督学习任务
EvoJAX 可以用于解决监督学习任务,例如 MNIST 分类。通过使用卷积神经网络(ConvNet)策略,EvoJAX 能够在单个 GPU 上在 5 分钟内达到超过 98% 的测试准确率。
强化学习任务
EvoJAX 也适用于强化学习任务,如 Cart-Pole Swing Up。通过在 JAX 中实现经典控制任务,EvoJAX 能够显著加速训练过程。
生成艺术
EvoJAX 还可以用于生成艺术任务,如抽象绘画。通过使用进化策略,EvoJAX 能够在单个 GPU 上高效生成艺术作品,这在以前是不可行的。
4. 典型生态项目
JAX
JAX 是一个用于高性能数值计算的库,特别适用于机器学习和科学计算。EvoJAX 基于 JAX 构建,充分利用了 JAX 的即时编译(JIT)和自动微分功能。
Brax
Brax 是一个在 JAX 中实现的微分物理引擎。EvoJAX 可以与 Brax 集成,用于训练物理模拟任务,如机器人运动控制。
Slime Volleyball Gym Environment
Slime Volleyball 是一个经典的强化学习环境,EvoJAX 可以用于训练神经网络策略,以控制虚拟角色进行排球比赛。
通过这些生态项目的结合,EvoJAX 能够扩展其应用范围,支持更多复杂的任务和场景。
PaddleOCR-VLPaddleOCR-VL 是一款顶尖且资源高效的文档解析专用模型。其核心组件为 PaddleOCR-VL-0.9B,这是一款精简却功能强大的视觉语言模型(VLM)。该模型融合了 NaViT 风格的动态分辨率视觉编码器与 ERNIE-4.5-0.3B 语言模型,可实现精准的元素识别。Python00
unified-cache-managementUnified Cache Manager(推理记忆数据管理器),是一款以KV Cache为中心的推理加速套件,其融合了多类型缓存加速算法工具,分级管理并持久化推理过程中产生的KV Cache记忆数据,扩大推理上下文窗口,以实现高吞吐、低时延的推理体验,降低每Token推理成本。Python02
MiniCPM-V-4_5MiniCPM-V 4.5 是 MiniCPM-V 系列中最新且功能最强的模型。该模型基于 Qwen3-8B 和 SigLIP2-400M 构建,总参数量为 80 亿。与之前的 MiniCPM-V 和 MiniCPM-o 模型相比,它在性能上有显著提升,并引入了新的实用功能Python00
HunyuanWorld-Mirror混元3D世界重建模型,支持多模态先验注入和多任务统一输出Python00
MiniMax-M2MiniMax-M2是MiniMaxAI开源的高效MoE模型,2300亿总参数中仅激活100亿,却在编码和智能体任务上表现卓越。它支持多文件编辑、终端操作和复杂工具链调用Python00
Spark-Scilit-X1-13B科大讯飞Spark Scilit-X1-13B基于最新一代科大讯飞基础模型,并针对源自科学文献的多项核心任务进行了训练。作为一款专为学术研究场景打造的大型语言模型,它在论文辅助阅读、学术翻译、英语润色和评论生成等方面均表现出色,旨在为研究人员、教师和学生提供高效、精准的智能辅助。Python00
GOT-OCR-2.0-hf阶跃星辰StepFun推出的GOT-OCR-2.0-hf是一款强大的多语言OCR开源模型,支持从普通文档到复杂场景的文字识别。它能精准处理表格、图表、数学公式、几何图形甚至乐谱等特殊内容,输出结果可通过第三方工具渲染成多种格式。模型支持1024×1024高分辨率输入,具备多页批量处理、动态分块识别和交互式区域选择等创新功能,用户可通过坐标或颜色指定识别区域。基于Apache 2.0协议开源,提供Hugging Face演示和完整代码,适用于学术研究到工业应用的广泛场景,为OCR领域带来突破性解决方案。00- HHowToCook程序员在家做饭方法指南。Programmer's guide about how to cook at home (Chinese only).Dockerfile014
Spark-Chemistry-X1-13B科大讯飞星火化学-X1-13B (iFLYTEK Spark Chemistry-X1-13B) 是一款专为化学领域优化的大语言模型。它由星火-X1 (Spark-X1) 基础模型微调而来,在化学知识问答、分子性质预测、化学名称转换和科学推理方面展现出强大的能力,同时保持了强大的通用语言理解与生成能力。Python00- PpathwayPathway is an open framework for high-throughput and low-latency real-time data processing.Python00