🚨 Google acaba de cargarse la industria de la extracción de...

@_guillecasaus
Guillermo Casaus@_guillecasaus
98 views Mar 24, 2026 ~1 min read
Advertisement
1
🚨 Google acaba de cargarse la industria de la extracción de documentos.

Ha lanzado LangExtract, una librería que convierte texto desordenado en datos estructurados y verificables, incluso en documentos enormes.

Es gratis y open-source 👇
Media image
2
1/ ¿Qué hace exactamente LangExtract?

- Extrae datos estructurados desde texto desordenado
- Mapea cada entidad a su posición exacta en el documento
- Funciona con documentos de 100+ páginas sin perder precisión
- Genera HTML interactivo para verificar los resultados
- Compatible con Gemini, Ollama y modelos locales
3
2/ Lo interesante es todo lo que reemplaza

- Regex frágiles
- Pipelines NER hechos a mano
- APIs carísimas de extracción
- Entrada manual de datos

Defines la tarea con unos pocos ejemplos, apuntas a cualquier documento y obtienes resultados estructurados y verificables.
5
BONUS🪙

Por cierto, Google acaba de lanzar un Certificado Profesional en IA con 7 cursos completos para aprender desde cero y aplicarla en proyectos reales.

Si estás aprendiendo IA, guárdalo porque merece mucho la pena 👇

x.com/_guillecasaus/…
Actions
What You Can Do
  • Export as PDF or Markdown
  • Batch Export to Notion
  • Bookmark & Highlight
  • LinkedIn & Instagram Carousel Maker
Create Free Account

Includes 7-day Premium trial

Advertisement