探索数据模型的未来:jSchema

在浏览器中处理和理解复杂的数据集从未如此简单。jSchema 是一个基于JavaScript的数据建模框架,它使你能将多组不同的数据转化为统一的模式,定义数据间的关联性,并进行数据聚合、连接和筛选,以提高数据应用的效率。

jSchema 创建了一个名为 jSchema 的对象,该对象包含了所有数据集的元信息,包括表名、列名和键。数据本身存储在一个闭包内,通过获取器函数进行访问。数据的连接、聚合和过滤都会在你的WORK命名空间创建一个新的数据集,这些变化会一直保留到你删除表格或执行清理方法为止。默认情况下,jSchema是区分大小写的,但你可以选择关闭这一功能:
var s = new jSchema({
"caseSensitive": false
});
演示体验
在仓库中的demo目录可以找到一个完整的操作示例。此外,你还可以在在线演示中实时体验jSchema的强大功能。
如何使用
NPM
如果你使用npm,只需运行 npm install jschema 即可。
RequireJS
jSchema支持RequireJS,你可以在你的项目lib目录下移动requirejs并将其引入HTML文件:
<script data-main="main" src="lib/require.js"></script></body>
然后在如main.js这样的入口文件中添加jSchema:
requirejs(['lib/jschema'], function(jSchema){
var s = new jSchema;
s.add([{a:1, b:2}])
s.add([{b:2, c:3}], {name:"named_table", primaryKey:"b"})
});
或者从外部源加载数据:
fetch("education.json")
.then(response => response.json())
.then(json => s.add(json, {name:"education", primaryKey:"Age_Group"}))
.then(fetch("gender.json")
.then(response => response.json())
.then(json => s.add(json, {name:"gender", primaryKey:"Age_Group"}))
);
功能特性
JOIN
通过指定主键和外键,可以轻松地对两个有关系的数据集进行连接:
s.join("EDUCATION", "GENDER", {name: "joinTable"})
DROP
不再需要的表格可以通过drop方法删除:
s.drop("GENDER")
SORT
如果你想根据某属性对数据集进行排序,可以使用orderBy方法:
s.orderBy("GENDER", {
clause: "Count",
order: "asc",
name: "sortBy"
})
GROUP BY
通过提供数据集名称、分组维度以及要聚合的度量,可以实现数据的分组:
s.groupBy("GENDER", {
dim: "Gender",
metric: "Count",
name: "groupBy",
method: "sum", // 支持的计算方法包括sum, count, average, min, max
percision: 2, // 默认为2
dimName: "GenderPK" // 如果需要重命名维度
})
更多功能
除此之外,还有FILTER用于过滤数据、UPDATE用于更新现有数据集、INSERT用于插入新行、REMOVE COLS用于移除列、ADD COLS用于添加新的列,以及cleanUp用于清除临时工作区的数据等。
测试与联系方式
对于任何问题、建议或功能请求,欢迎随时联系我。我在Twitter上的ID是@ignoreintuition。要运行Mocha测试脚本,只需在终端输入:
npm install
npm run test
jSchema以其简洁而强大的API,让JavaScript数据建模变得简单易懂。无论你是数据分析新手还是经验丰富的开发者,都能快速上手并从中受益。立即加入我们,探索数据的无限可能吧!
atomcodeClaude Code 的开源替代方案。连接任意大模型,编辑代码,运行命令,自动验证 — 全自动执行。用 Rust 构建,极致性能。 | An open-source alternative to Claude Code. Connect any LLM, edit code, run commands, and verify changes — autonomously. Built in Rust for speed. Get StartedRust0423
jiuwenswarmJiuwenSwarm 是一款基于openJiuwen开发的智能AI Agent,它能够将大语言模型的强大能力,通过你日常使用的各类通讯应用,直接延伸至你的指尖。Python0737
Hy3Hy3 是由腾讯混元团队研发的快慢思考融合的混合专家模型,总参数量 295B,激活参数 21B,MTP 层参数 3.8B。4 月底发布 Hy3 Preview 后,我们在 50 多个业务中获得了广泛的反馈,修复了各种体验问题,进一步提升了后训练的质量和规模。今天,我们发布 Hy3。它展现出显著强于同尺寸并比肩旗舰(参数规模往往是 Hy3 的 2~5 倍)开源模型的智能水平,显著提升了在各类产品和生产力任务中的实用价值。Python00
LongCat-2.0LongCat-2.0,这是一款大规模混合专家(MoE)语言模型,总参数达1.6万亿,每 token 激活参数约480亿——相比前代 LongCat 模型实现了显著提升,同时带来多项架构改进。00
AscendNPU-IRAscendNPU-IR是基于MLIR(Multi-Level Intermediate Representation)构建的,面向昇腾亲和算子编译时使用的中间表示,提供昇腾完备表达能力,通过编译优化提升昇腾AI处理器计算效率,支持通过生态框架使能昇腾AI处理器与深度调优C++0296
PromptXPromptX · 领先的AI 智能体上下文平台 | PromptX · Leading AI Agent Context PlatformJavaScript05