Pillow库新增XMP元数据写入功能解析
2025-05-18 00:44:11作者:侯霆垣
背景介绍
Pillow作为Python生态中最重要的图像处理库之一,近期在其11.0.0版本中新增了对XMP(Extensible Metadata Platform)元数据的写入支持。XMP是一种基于XML的元数据标准,由Adobe公司开发,广泛应用于图像、视频等多媒体文件中,用于存储版权信息、拍摄参数、编辑历史等重要数据。
功能实现细节
新版本Pillow通过两种方式实现了XMP写入功能:
- 直接写入方式:通过
Image.save()方法的xmp参数直接传入XMP数据
from PIL import Image
im = Image.open("test.png")
im.save("output.jpg", xmp=b"<x:xmpmeta>...</x:xmpmeta>")
- 通过info字典写入:在图像对象的info属性中设置xmp键值
im.info["xmp"] = b"<x:xmpmeta>...</x:xmpmeta>"
im.save("output.jpg")
值得注意的是,当前实现要求XMP数据以bytes类型传入,而非字符串。这是考虑到不同图像格式可能使用不同的字符编码,而bytes类型可以确保数据的一致性。
多图像格式支持
该功能不仅支持常见的JPEG格式,还支持MPO(Multi-Picture Object)格式,这在创建多帧图像或Android UltraHDR图像时特别有用。对于MPO格式的多帧图像,可以通过以下方式为不同帧设置不同的XMP数据:
im = Image.open("source.png")
second_im = Image.new("RGB", (128, 128))
second_im.encoderinfo["xmp"] = b"第二帧的XMP数据"
im.save("output.mpo", save_all=True, append_images=[second_im])
技术考量与限制
当前实现有几个重要的技术考量点:
-
数据大小限制:目前实现不处理大于64KB的XMP数据,这是为了避免复杂的分段存储逻辑。
-
数据结构简化:初期仅支持原始XML字符串/字节数据,未来可能会扩展支持结构化数据如字典等。
-
编码一致性:强制使用bytes类型可以避免字符编码带来的潜在问题。
实际应用场景
这一功能的加入使得开发者能够:
- 为图像添加版权信息和数字水印
- 保留图像编辑历史和工作流程数据
- 创建符合专业摄影标准的图像文件
- 开发支持HDR等高级图像格式的应用
未来发展方向
根据开发讨论,未来可能会:
- 增加对字符串类型的自动转换支持
- 提供更高级的XMP数据结构接口
- 解除64KB的大小限制
- 增强对XML命名空间等复杂结构的支持
总结
Pillow 11.0.0引入的XMP写入功能填补了该库在专业图像元数据处理方面的一个重要空白。虽然当前实现还较为基础,但已经能够满足大多数应用场景的需求,为Python图像处理生态增添了重要的专业能力。随着后续版本的迭代,这一功能有望变得更加完善和易用。
登录后查看全文
热门项目推荐
GLM-5智谱 AI 正式发布 GLM-5,旨在应对复杂系统工程和长时域智能体任务。Jinja00
GLM-5.1GLM-5.1是智谱迄今最智能的旗舰模型,也是目前全球最强的开源模型。GLM-5.1大大提高了代码能力,在完成长程任务方面提升尤为显著。和此前分钟级交互的模型不同,它能够在一次任务中独立、持续工作超过8小时,期间自主规划、执行、自我进化,最终交付完整的工程级成果。Jinja00
MiniMax-M2.7MiniMax-M2.7 是我们首个深度参与自身进化过程的模型。M2.7 具备构建复杂智能体应用框架的能力,能够借助智能体团队、复杂技能以及动态工具搜索,完成高度精细的生产力任务。Python00- QQwen3.5-397B-A17BQwen3.5 实现了重大飞跃,整合了多模态学习、架构效率、强化学习规模以及全球可访问性等方面的突破性进展,旨在为开发者和企业赋予前所未有的能力与效率。Jinja00
HY-Embodied-0.5这是一套专为现实世界具身智能打造的基础模型。该系列模型采用创新的混合Transformer(Mixture-of-Transformers, MoT) 架构,通过潜在令牌实现模态特异性计算,显著提升了细粒度感知能力。Jinja00
LongCat-AudioDiT-1BLongCat-AudioDiT 是一款基于扩散模型的文本转语音(TTS)模型,代表了当前该领域的最高水平(SOTA),它直接在波形潜空间中进行操作。00
项目优选
收起
deepin linux kernel
C
28
15
OpenHarmony documentation | OpenHarmony开发者文档
Dockerfile
663
4.27 K
🎉 (RuoYi)官方仓库 基于SpringBoot,Spring Security,JWT,Vue3 & Vite、Element Plus 的前后端分离权限管理系统
Vue
1.54 K
894
Ascend Extension for PyTorch
Python
506
612
openEuler内核是openEuler操作系统的核心,既是系统性能与稳定性的基石,也是连接处理器、设备与服务的桥梁。
C
392
290
暂无简介
Dart
909
219
🔥LeetCode solutions in any programming language | 多种编程语言实现 LeetCode、《剑指 Offer(第 2 版)》、《程序员面试金典(第 6 版)》题解
Java
69
21
昇腾LLM分布式训练框架
Python
142
168
本项目是CANN提供的数学类基础计算算子库,实现网络在NPU上加速计算。
C++
940
867
🍒 Cherry Studio 是一款支持多个 LLM 提供商的桌面客户端
TypeScript
1.33 K
108