Recursos
Claix Trust
Verifica cada archivo antes de que se convierta en contexto. Claix Trust bloquea contenido malicioso e instrucciones inseguras antes de que lleguen al procesamiento documental, a la memoria RAG o a los agentes de IA.
Se aplica a todos los formatos que Claix acepta — PDF, hojas de cálculo, documentos, imágenes, audio y texto — y se ejecuta antes de que un parser, un modelo o un espacio de conocimiento vean el archivo. Si falla una comprobación crítica, el archivo no se abre, no se convierte y no se recuerda.
Endpoints protegidos
Por qué importa
Un documento es una entrada para un agente, no solo un archivo
Backends, pipelines RAG y agentes tratan una subida como contexto de confianza. Un PDF, una hoja de cálculo, una imagen o un fragmento HTML pueden llevar más que los campos que pediste: scripts, macros, enlaces remotos, texto oculto e instrucciones escritas para el modelo y no para una persona.
Cuando ese contenido se parsea, se transcribe o se guarda en un espacio de conocimiento, es difícil retirarlo. Puede desviar una respuesta, envenenar una recuperación posterior o colarse en la siguiente llamada de un agente. El daño ocurre después de la ingesta, así que la comprobación tiene que ocurrir antes.
Claix Trust es esa comprobación. Decide si un archivo es seguro de abrir, convertir y recordar. No sustituye a Source Tracing. Trust protege la entrada. Source Tracing hace auditable el resultado cuando el archivo ya está dentro.
Cada subida
Comprobaciones que aplican a todo archivo, antes de la revisión del formato
Se ejecutan primero, sin excepción. Si algo crítico falla aquí, Claix se detiene. Nada posterior lee el archivo.
El archivo es lo que dice ser
El nombre y el tipo declarado tienen que coincidir con el archivo. Un ejecutable renombrado, una imagen etiquetada como PDF o un documento que en realidad es otro formato se rechazan en lugar de abrirse.
- Contenido que no coincide con la extensión
- Ejecutables disfrazados de documentos
- Archivos vacíos
- Archivos más grandes de lo que admite el endpoint
- Tipos que Claix no soporta, rechazados en lugar de abrirse igualmente
Nombres que ocultan lo que es el archivo
El nombre forma parte del ataque. Claix Trust rechaza nombres que disfrazan la extensión, escapan de una carpeta o se hacen pasar por un dispositivo del sistema.
- Caracteres que muestran una extensión distinta de la almacenada
- Una segunda extensión que esconde un ejecutable
- Fragmentos de ruta dentro del nombre
- Nombres reservados de dispositivo
- Bytes nulos incrustados en el nombre
Archivos comprimidos hechos para agotar o para colar algo
Las hojas de cálculo y los documentos de Word son contenedores. Claix Trust rechaza los que están hechos para tumbar un servidor, para esconder otro archivo dentro o para salir de su propia carpeta.
- Bombas de compresión
- Archivos anidados dentro del contenedor
- Demasiadas entradas
- Un tamaño descomprimido que no guarda relación con la subida
- Rutas que salen del archivo
- Archivos sin directorio legible, sin entradas o de una variante no admitida
Instrucciones dirigidas al modelo
Cuando un archivo seguro ya es texto, Claix Trust lo revisa en busca de contenido que una persona no vería y un modelo podría obedecer. Una frase citada en un documento normal no basta, por sí sola, para rechazarlo. Los canales ocultos y un intento claro de anular el sistema, sí.
- Caracteres invisibles y caracteres que no ocupan espacio
- Caracteres que invierten cómo se muestra el texto
- Instrucciones ocultas y órdenes que intentan anular el sistema
- Marcadores de Source Tracing falsificados, que simulan que un valor fue citado
Cada formato
Qué evita Claix Trust en cada formato
Las comprobaciones genéricas se ejecutan siempre primero. Después, la revisión propia de ese formato. Ningún formato soportado se queda sin su capa.
PDF
Un PDF puede ejecutar código, ocultar texto y llevar otros archivos dentro. Claix Trust lo corta antes de que el documento se lea o se envíe a extraer.
- Scripts incrustados en el documento
- Acciones que se ejecutan al abrir el archivo, o en eventos posteriores
- Otros archivos incrustados dentro del PDF
- Acciones que lanzan un programa externo
- Enlaces que ejecutan script, abren un archivo local o llevan una carga HTML
- Formularios que envían datos a un destino remoto
- Rich media, vídeo y audio usados como carga
- Formularios dinámicos y capas de contenido opcional
- Documentos cifrados que no se pueden inspeccionar
- Texto pintado para que una persona no lo vea, incluido el texto del mismo color que la página
- Contenido escondido dentro de partes comprimidas del archivo
- Nombres disfrazados para que una lectura superficial no los vea
- Estructura ausente o rota: sin cabecera real, sin final de archivo, referencia cruzada inválida, objetos desequilibrados o sin páginas
- Un número de páginas que no tiene sentido para el tamaño del archivo
Word, RTF, Excel y CSV
Documentos y hojas comparten una misma revisión, porque las macros, los objetos incrustados y los enlaces remotos aparecen en ambos. Los formatos binarios antiguos de Word y Excel no se aceptan como documentos modernos.
- Macros, incluidos los archivos marcados como habilitados para macros
- Objetos incrustados y cargas empaquetadas
- Relaciones que adjuntan una plantilla remota, un subdocumento, otro libro o un paquete incrustado
- Enlaces y destinos que apuntan a la máquina local
- Fórmulas que llaman a servicios externos, importan datos remotos o lanzan un comando
- Celdas que empiezan como una fórmula para que otra hoja las ejecute más tarde
- Conexiones de datos externas y enlaces a otros libros
- Nombres definidos que salen del libro
- Hojas ocultas, y filas ocultas que aun así contienen valores
- Campos que traen texto o imágenes remotas, o que inician un intercambio de datos con otro programa
- Plantillas adjuntas cargadas desde fuera del archivo
- Marcado dentro del paquete que intenta traer datos externos al documento
- RTF con estructura inválida, anidado en exceso, o que lleva objetos binarios, un almacén de datos o un campo externo
- Una hoja empaquetada como documento, o al revés
- Paquetes corruptos, rutas inseguras dentro del paquete, y CSV que en realidad es binario o no tiene estructura de líneas
Imágenes
JPEG, PNG, WebP, HEIC y HEIF. Los píxeles no son lo único que leerá un modelo. Los metadatos pueden llevar instrucciones que no aparecen en la imagen.
- Un formato que no coincide con la extensión
- Un tipo declarado que no coincide con el archivo
- Archivos que no terminan donde termina la imagen
- Un tamaño declarado que no coincide con el contenedor
- Datos añadidos después de la imagen
- Dimensiones que no coinciden con el tamaño del archivo, incluidas imágenes hechas para agotar la memoria al decodificarse
- Metadatos de un tamaño anómalo
- Una carga escondida junto a los datos de la imagen
- Instrucciones guardadas en metadatos, que pueden llegar al prompt sin aparecer en ningún píxel
Audio
MP3, WAV, M4A y OGG. Claix Trust revisa la grabación antes de transcribirla, y revisa las etiquetas, porque un campo de comentario puede desviar a un modelo sin haberse pronunciado nunca.
- Un contenedor que no coincide con la extensión
- Un tipo declarado que no coincide con el archivo
- Un tamaño declarado que desborda el archivo
- Datos después de que termina el audio
- Contenedores mal formados, flujos ausentes y huecos inesperados
- Relleno lo bastante grande como para esconder otra cosa
- Un flujo vacío, o una duración que no coincide con el tamaño
- Archivos mucho más largos que una subida normal
- Una carga escondida en el archivo, o instrucciones guardadas en etiquetas como título, artista o comentarios
Texto, HTML, XML y JSON
Sin una capa binaria que rechazar primero, el propio contenido carga con más riesgo. El texto oculto pesa más, porque esconderlo ya es una señal.
- Codificaciones que Claix no acepta, texto inválido y contenido binario etiquetado como texto
- Texto sin estructura de líneas, o texto por encima del tamaño que admite el endpoint
- Marcado que no corresponde a una subida de texto plano
- Scripts, manejadores de eventos, iframes, objetos incrustados y applets
- Páginas que redirigen a otra dirección, reescriben su URL base o cargan recursos externos
- Enlaces que ejecutan script o llevan una carga activa
- Hojas de estilo cuya única función es ocultar contenido
- Texto oculto para un lector — fuera de pantalla, transparente, de tamaño cero o recortado — que sigue presente para un modelo
- XML que declara un tipo de documento, entidades o una referencia externa
- Inclusiones y transformaciones que traen marcado de fuera
- Instrucciones de procesamiento, anidado excesivo y elementos que no se cierran
- JSON que no es JSON válido
- Claves que intentan alterar cómo se comporta el objeto, incluidos nombres reservados
- JSON anidado o repetido hasta agotar un parser
Qué evita
Los fallos que Claix Trust está para cortar
Cada comprobación existe porque ese fallo tiene un coste cuando el archivo ya está dentro del sistema. Juntas cubren el camino desde la subida hasta el momento en que un modelo, un espacio de conocimiento o un agente tratarían el archivo como contexto normal.
- Inyección de instrucciones que llega dentro de un archivo del cliente y no en el chat.
- Malware y ejecutables subidos con nombre de documento.
- Macros y objetos incrustados que llegan a un parser.
- Fórmulas que salen de Claix y se ejecutan cuando alguien abre la hoja en otro sitio.
- Bombas de descompresión y archivos patológicos usados para agotar el servicio.
- Texto oculto que se convierte en memoria RAG y reaparece en una respuesta posterior.
- Metadatos de imagen o etiquetas de audio que desvían una extracción sin aparecer en los píxeles ni en la grabación.
- Un documento envenenado guardado en un espacio de conocimiento y recuperado por un agente días después.
- Citas falsificadas que parecen Source Tracing.
- Un archivo que no se puede inspeccionar a tiempo. Se rechaza. No se procesa mientras la comprobación sigue abierta.
Dónde se sitúa
Antes de procesar, antes de la memoria, antes del agente
Claix Trust no es un producto aparte al que llamar. Es el primer paso de la ingesta, en la extracción, en la conversión a Markdown y en las llamadas de agente.
| Sin la comprobación | Con Claix Trust |
|---|---|
| El parser, el modelo o el agente son los primeros en tocar el archivo. | El archivo se verifica antes de parsearse, convertirse o enviarse. |
| Una subida mala puede escribirse en un espacio de conocimiento. | Un archivo bloqueado no se guarda como memoria. |
| Una llamada de agente gasta la extracción y luego construye un prompt con el archivo en crudo. | La llamada de agente se comprueba antes de que empiece ese trabajo. |
| Una respuesta JSON tipada puede seguir anclada a un documento hostil. | Trust decide si el archivo puede entrar. Source Tracing decide después si cada campo está anclado. |
Preguntas
- ¿Claix Trust cambia una respuesta correcta?
- No. Un archivo que pasa se procesa como antes, y la respuesta mantiene la misma forma. Un archivo que falla una comprobación crítica se rechaza con un error y no se procesa.
- ¿Qué llamadas cubre?
- Todos los endpoints documentales: PDF, Excel y CSV, Word, RTF y documentos de texto, imágenes, audio, y texto, HTML, XML y JSON — tanto las rutas de extracción y Markdown como las rutas de agente que van delante.
- ¿Sustituye a Source Tracing?
- No. Claix Trust se ejecuta antes de ingerir el archivo. Source Tracing actúa sobre los campos extraídos: adjunta evidencia o marca un campo para revisión humana cuando el documento no sostiene la respuesta.
- ¿Se rechaza un documento legítimo que cita un ataque?
- Una frase desafortunada no basta para rechazar un documento normal. Los canales ocultos, los scripts, las macros y un intento claro de anular el sistema sí detienen el archivo.
- ¿Tengo que llamar a Claix Trust yo?
- No. Forma parte de la ingesta. Sigues llamando a los mismos endpoints.
- ¿Qué pasa con un archivo sospechoso que no es concluyentemente peligroso?
- Los hallazgos críticos detienen el archivo. Los hallazgos sospechosos quedan en el registro de auditoría y no rechazan, por sí solos, un documento legítimo.
El archivo se comprueba antes de que nada más pueda fiarse de él.
La extracción, el Markdown, los espacios de conocimiento y los agentes parten de la misma subida. Claix Trust es la puerta delante de ese camino: primero la ingesta segura, después la extracción anclada a la fuente, la salida validada por schema y la revisión humana cuando una respuesta no se puede verificar.