PDF a Markdown para Ollama y modelos locales
Prepara tu PDF para Ollama y modelos locales: texto limpio en Markdown, datos personales anonimizados y conteo de tokens. Todo en tu dispositivo.
Sobre esta herramienta
Ollama y modelos locales responde mejor con texto bien estructurado: encabezados, listas y párrafos, sin cabeceras repetidas ni números de página en medio. Convertimos tu PDF a Markdown con esa estructura y estimamos los tokens para que sepas si cabe en una conversación.
Antes de que pegues nada en Ollama y modelos locales, reemplazamos los datos personales por etiquetas coherentes ([NOMBRE_1], [DOCUMENTO_1]…): el mismo dato recibe siempre la misma etiqueta, así el modelo entiende el documento sin conocer a las personas.
Con un modelo local (Ollama, LM Studio) el texto tampoco sale de tu equipo; aun así, anonimizar evita que datos personales queden en historiales y registros.
Cómo funciona
- 1
Suelta el PDF.
- 2
Revisa el Markdown y los datos marcados en color.
- 3
Copia (o descarga el .md) y pégalo en Ollama y modelos locales.
Preguntas frecuentes
- ¿Ollama y modelos locales no puede leer el PDF directamente?
- Muchos asistentes aceptan PDF, pero al subirlo el archivo viaja a sus servidores. Con Sırdaş el PDF nunca sale de tu equipo: solo compartes con Ollama y modelos locales el texto ya anonimizado que decidas pegar.
- ¿Qué datos se ocultan antes de pegarlo en Ollama y modelos locales?
- Cédulas y otros documentos de identidad, NIT, correos, teléfonos, fechas, direcciones, tarjetas, números de historia clínica y nombres con etiqueta (paciente, arrendador, firmado por…). La detección es automática y puede omitir datos: revisa el resultado.
- ¿Cómo sé cuántos tokens ocupa?
- Mostramos una estimación (unos 4 caracteres por token). Es orientativa; cada modelo cuenta un poco distinto.