推荐项目:Expansion Hunter - 精准估算重复序列长度的工具
2024-06-03 13:01:45作者:庞队千Virginia
在人类基因组中,存在着一些由短单位序列(通常是三核苷酸)重复组成的区域。这些重复区域可能会扩展到远超测序读长的大小,从而导致各种疾病,如脆性X综合症、肌萎缩侧索硬化症和亨廷顿病等。Expansion Hunter 正是为了精确估算这类重复序列的大小而设计的工具。
1. 项目介绍
Expansion Hunter 通过在BAM/CRAM文件中进行目标搜索,找到跨越、相邻或完全包含在每个重复区域内的读取片段,以此来估计重复序列的大小。目前,该软件支持Linux和macOS操作系统。
2. 项目技术分析
该项目依赖于高效的算法,能够在大量测序数据中识别出与已知致病性和功能性STRs相似性质的多态性STRs。其方法基于以下两篇学术论文:
- 检测PCR-Free全基因组序列数据中的长重复扩展(Egor Dolzhenko等人,Genome Research 2017)
- ExpansionHunter:一个用于分析短串联重复区域变异的序列图基工具(Egor Dolzhenko等人,Bioinformatics 2019)
3. 应用场景
Expansion Hunter 可广泛应用于医学研究、遗传学分析和罕见病诊断等领域。通过对全基因组序列数据的处理,科研人员可以更准确地鉴定可能导致疾病的重复序列变异,进一步推动对遗传性疾病机理的理解和治疗方案的研发。
4. 项目特点
- 高效精准:能有效检测并估算长重复序列的大小,提高遗传变异分析的准确性。
- 易用性强:提供详细的安装指南、使用手册和文件格式描述,方便用户上手操作。
- 兼容性好:支持BAM/CRAM格式的数据输入,兼容主流生物信息学分析流程。
- 开放源代码:采用PolyForm Strict License 1.0.0,开放源码,鼓励社区参与和改进。
- 配套资源丰富:包括一个全基因组STR目录,以及用于查看重复区域的REViewer工具,为用户提供一站式解决方案。
总体而言,Expansion Hunter 是一款强大且实用的工具,对于遗传学研究者和生物信息学家来说,是剖析重复序列变异不可或缺的助手。无论您是对特定疾病的研究,还是在探索未知基因组领域,它都能为您提供精确的分析结果。
登录后查看全文
热门项目推荐
atomcodeClaude Code 的开源替代方案。连接任意大模型,编辑代码,运行命令,自动验证 — 全自动执行。用 Rust 构建,极致性能。 | An open-source alternative to Claude Code. Connect any LLM, edit code, run commands, and verify changes — autonomously. Built in Rust for speed. Get StartedRust099- DDeepSeek-V4-ProDeepSeek-V4-Pro(总参数 1.6 万亿,激活 49B)面向复杂推理和高级编程任务,在代码竞赛、数学推理、Agent 工作流等场景表现优异,性能接近国际前沿闭源模型。Python00
MiMo-V2.5-ProMiMo-V2.5-Pro作为旗舰模型,擅⻓处理复杂Agent任务,单次任务可完成近千次⼯具调⽤与⼗余轮上 下⽂压缩。Python00
GLM-5.1GLM-5.1是智谱迄今最智能的旗舰模型,也是目前全球最强的开源模型。GLM-5.1大大提高了代码能力,在完成长程任务方面提升尤为显著。和此前分钟级交互的模型不同,它能够在一次任务中独立、持续工作超过8小时,期间自主规划、执行、自我进化,最终交付完整的工程级成果。Jinja00
Kimi-K2.6Kimi K2.6 是一款开源的原生多模态智能体模型,在长程编码、编码驱动设计、主动自主执行以及群体任务编排等实用能力方面实现了显著提升。Python00
MiniMax-M2.7MiniMax-M2.7 是我们首个深度参与自身进化过程的模型。M2.7 具备构建复杂智能体应用框架的能力,能够借助智能体团队、复杂技能以及动态工具搜索,完成高度精细的生产力任务。Python00
项目优选
收起
暂无描述
Dockerfile
710
4.51 K
Claude Code 的开源替代方案。连接任意大模型,编辑代码,运行命令,自动验证 — 全自动执行。用 Rust 构建,极致性能。 | An open-source alternative to Claude Code. Connect any LLM, edit code, run commands, and verify changes — autonomously. Built in Rust for speed.
Get Started
Rust
578
99
本项目是CANN提供的数学类基础计算算子库,实现网络在NPU上加速计算。
C++
958
955
deepin linux kernel
C
28
16
🎉 (RuoYi)官方仓库 基于SpringBoot,Spring Security,JWT,Vue3 & Vite、Element Plus 的前后端分离权限管理系统
Vue
1.61 K
942
Ascend Extension for PyTorch
Python
573
694
🍒 Cherry Studio 是一款支持多个 LLM 提供商的桌面客户端
TypeScript
1.43 K
116
openEuler内核是openEuler操作系统的核心,既是系统性能与稳定性的基石,也是连接处理器、设备与服务的桥梁。
C
414
339
暂无简介
Dart
952
235
Nop Platform 2.0是基于可逆计算理论实现的采用面向语言编程范式的新一代低代码开发平台,包含基于全新原理从零开始研发的GraphQL引擎、ORM引擎、工作流引擎、报表引擎、规则引擎、批处理引引擎等完整设计。nop-entropy是它的后端部分,采用java语言实现,可选择集成Spring框架或者Quarkus框架。中小企业可以免费商用
Java
12
2