Banco de IA / para quien construye
Herramientas de IA y LLM.
Para quienes construyen con modelos de lenguaje y para quienes tienen sitios que esos modelos leen: da forma a prompts y esquemas de herramientas, repara el JSON que devuelve un modelo, mira cómo se divide un documento para la recuperación y decide qué crawlers de IA pueden leer tus páginas. El último grupo ejecuta modelos pequeños dentro del navegador, así que la foto o el escaneo nunca salen de tu equipo.
disponibles ya
Construir con LLM
Prompts, esquemas para llamadas a herramientas y la salida estructurada que devuelve un modelo.
Generador de prompts de sistema
Genera prompts de sistema estructurados con secciones XML y esquemas JSON formateados de llamadas a herramientas para OpenAI y Claude.
Reparar JSON
Repara JSON truncado, malformado, con comillas simples o sin escapar generado por LLMs, sin idas y vueltas al servidor.
Objeto JS a JSON
Convierte literales de objeto de JS con claves sin comillas, comillas simples y comas finales en JSON estricto.
Generador de JSON Schema
Infiere y genera automáticamente definiciones de JSON Schema a partir de JSON de ejemplo.
JSON Schema
Valida datos JSON con definiciones de JSON Schema localmente en tu navegador y consulta rutas de error claras.
Fragmentador de texto para RAG
Visualiza divisiones de texto, tamaños de fragmento en tokens/caracteres y superposiciones para indexación vectorial RAG en tu navegador.
Hacer tu sitio legible para la IA
Qué pueden descargar los crawlers de IA y qué encuentran cuando lo hacen.
Comprobador de rastreadores de IA
Comprende cómo las reglas de robots.txt de un sitio tratan a los crawlers de IA conocidos.
llms.txt
Inspecciona la estructura opcional de llms.txt de un sitio, sus enlaces y texto original.
Comprobador de robots.txt
Lee las reglas para rastreadores, las declaraciones de sitemap y la accesibilidad de un vistazo.
Schema Checker
Encuentra bloques JSON-LD, tipos de schema, errores de análisis y advertencias básicas.
IA en tu propio dispositivo
Modelos que se ejecutan en la pestaña del navegador, así que el archivo nunca se sube.
Imagen a texto
Extrae el texto de una foto o captura de pantalla sin subirla.
PDF OCR
Lee el texto de un PDF escaneado sin texto seleccionable.
Foto de pasaporte
Crea una foto para pasaporte o documento con tamaño correcto, fondo blanco, azul o rojo, encuadre automático y hoja de impresión a 300 dpi.
Obtener una salida que se pueda procesar
La mayoría de los fallos de una función con LLM no son respuestas incorrectas, sino inservibles: una respuesta envuelta en prosa, una coma de sobra al final, una clave entre comillas simples, un objeto cortado porque se agotó el límite de tokens. Describe la forma que quieres como JSON Schema —el generador de JSON a JSON Schema crea uno a partir de un ejemplo— y pásalo a la función de salida estructurada o de llamadas a herramientas del modelo en lugar de pedir JSON en prosa.
Si aun así llega una respuesta rota, la herramienta de reparación de JSON de LLM corrige los fallos mecánicos, el conversor de objetos JS a JSON se ocupa de los literales al estilo JavaScript y el validador de JSON Schema confirma que el resultado encaja antes de que tu código dependa de él. El constructor de prompts de sistema mantiene las instrucciones y definiciones de herramientas en un formato coherente.
Chunking para la recuperación
Un sistema de recuperación responde con los fragmentos que encuentra, así que la división decide lo que un modelo puede ver. Los fragmentos demasiado pequeños pierden la frase que les da sentido; los demasiado grandes entierran la línea relevante entre otras ajenas y cuestan más de incrustar y enviar. El solapamiento hace que una frase que cruza un límite se encuentre desde ambos lados, a cambio de guardarla dos veces.
El chunker de texto para RAG muestra exactamente dónde se corta un documento con un tamaño y un solapamiento dados, lo que es más rápido que rastrear una mala respuesta hasta la división que la causó.
Decidir qué leen los crawlers de IA
Los crawlers de entrenamiento, los de búsqueda con IA y las descargas hechas en nombre de un usuario usan tokens de User-agent distintos, así que un sitio puede negarse al entrenamiento y seguir visible en las respuestas de IA. El comprobador de crawlers de IA lee el robots.txt de un sitio frente a diez de ellos y explica cada uno; el comprobador de robots.txt muestra el archivo completo.
Para las páginas que sí quieres que se lean, un archivo llms.txt dirige a los modelos a tus documentos más útiles y los datos estructurados dicen con claridad de qué trata una página. Ninguno es una garantía, pero ambos cuestan poco.
Modelos que se quedan en el navegador
Las herramientas de OCR y de fotos ejecutan sus modelos dentro de la página. El primer uso descarga el modelo —unos pocos megabytes— y a partir de ahí el trabajo se hace en tu propio procesador: un contrato escaneado, una foto de pasaporte o una captura de pantalla se leen y procesan sin subirse a ningún sitio.
El precio es la velocidad en equipos antiguos y los límites de un modelo pequeño. Imagen a texto y PDF escaneado a texto reconocen bien el texto impreso y mal la escritura a mano; el creador de fotos de pasaporte encuentra la cara y el fondo automáticamente, pero te pide que compruebes el resultado con las normas de tu país.