<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>Document Processing on SoloSoft</title><link>https://www.solosoft.dev/es/tags/document-processing/</link><description>Recent content in Document Processing on SoloSoft</description><generator>Hugo</generator><language>es-es</language><lastBuildDate>Fri, 01 May 2026 00:00:00 +0000</lastBuildDate><atom:link href="https://www.solosoft.dev/es/tags/document-processing/index.xml" rel="self" type="application/rss+xml"/><item><title>PyMuPDF: Procesamiento PDF de Alto Rendimiento para Python</title><link>https://www.solosoft.dev/es/post/pymupdf-pdf-2026/</link><pubDate>Fri, 01 May 2026 00:00:00 +0000</pubDate><guid>https://www.solosoft.dev/es/post/pymupdf-pdf-2026/</guid><description>&lt;p&gt;Cuando necesitas velocidad bruta para el procesamiento de PDFs, PyMuPDF es el líder en rendimiento entre las bibliotecas PDF de Python. Construido como un binding de Python para la biblioteca MuPDF en C de Artifex, PyMuPDF combina la facilidad de uso de Python con rendimiento a nivel C para renderizar, extraer y manipular documentos PDF.&lt;/p&gt;
&lt;p&gt;PyMuPDF procesa PDFs 10-100 veces más rápido que las alternativas de Python puro. Renderiza páginas a imágenes en milisegundos, extrae texto con posicionamiento preciso, gestiona anotaciones y maneja formularios. Además de PDFs, también soporta XPS, EPUB, MOBI, FB2 y formatos de imagen comunes, convirtiéndolo en un motor versátil de procesamiento de documentos.&lt;/p&gt;</description></item><item><title>pypdf: Kit de Herramientas PDF en Python Puro</title><link>https://www.solosoft.dev/es/post/pypdf-library-2026/</link><pubDate>Fri, 01 May 2026 00:00:00 +0000</pubDate><guid>https://www.solosoft.dev/es/post/pypdf-library-2026/</guid><description>&lt;p&gt;Cuando necesitas manipular PDFs en Python sin dependencias externas pesadas, pypdf es la solución de referencia. Esta biblioteca de Python puro proporciona capacidades integrales de manipulación de PDFs, incluyendo división, combinación, recorte, rotación, cifrado y extracción de texto, todo sin ningún código nativo o bibliotecas del sistema.&lt;/p&gt;
&lt;p&gt;Pypdf ha sido la biblioteca de PDFs estándar de Python durante más de una década. Ha evolucionado a través de múltiples versiones principales y ahora ofrece una API limpia y moderna que es fácil de usar y a la vez increíblemente potente. La biblioteca analiza la especificación PDF directamente, por lo que puede acceder a cada elemento de la estructura del documento.&lt;/p&gt;</description></item></channel></rss>