Saltar al contenido
Inteligencia artificial

IA Soberana

Modelos que trabajan con tus datos sin que tus datos salgan de tu jurisdicción

Sector públicoSaludServicios financierosInfraestructura crítica

Asistentes y agentes sobre modelos desplegados donde la organización decide: en su propio centro de datos, en nube soberana o en un entorno aislado, con cada respuesta citada y trazada.

datos fuera del perímetro que definís
0
puede operar sin salida a internet
Aislado
de las respuestas con fuente y traza
100%

Qué resuelve

La pregunta ya no es si la organización va a usar inteligencia artificial, sino dónde van a estar sus datos cuando lo haga. Cada consulta a un asistente comercial es un expediente, una historia clínica o un pliego que sale del perímetro y viaja a una infraestructura que la organización no controla ni puede auditar.

IA Soberana invierte ese orden. Los modelos se despliegan donde el organismo lo determina —su propio hardware, una nube soberana en la región elegida o un entorno sin salida a internet— y trabajan sobre su acervo documental heredando los permisos que ya existen: cada persona obtiene respuesta únicamente sobre aquello que tiene derecho a leer.

La soberanía acá no es una cláusula del contrato: es una propiedad de la arquitectura. Se verifica mirando dónde están los pesos del modelo, por dónde viaja cada consulta y quién puede leer la traza de lo que se preguntó y se respondió.

Modelo de despliegue

On-premise sobre hardware del organismo, nube soberana en la región elegida o entorno aislado sin salida a internet. El dimensionamiento parte del modelo y de la concurrencia esperada: un modelo del orden de 30.000 millones de parámetros se sirve con 48 a 80 GB de memoria de video, y uno del orden de 70.000 millones con dos a cuatro placas de 80 GB —o con una sola si se cuantiza y la concurrencia es moderada.

Los pesos y los datos, donde vos decidas

On-premise, nube soberana o instalación aislada. El modelo se acerca al dato, en lugar de que el dato viaje al modelo.

Nada entrena a nadie

Ni las consultas ni los documentos se usan para entrenar modelos de terceros. No hay retención fuera del perímetro que la organización define.

Sin fuente no hay respuesta

Cada afirmación se apoya en el fragmento del documento que la sustenta, con su enlace. Lo que el sistema no puede fundamentar, lo dice en lugar de inventarlo.

Funcionalidades

Todo lo que incluye

Funcionalidad probada en producción, no un listado de intenciones.

Despliegue on-premise

Modelos de pesos abiertos servidos con motores de inferencia de producción, con paralelismo entre placas y cuantización para ajustar el modelo al hardware disponible sin perder calidad utilizable.

Nube soberana o región elegida

Para organizaciones sin centro de datos propio: la misma plataforma sobre infraestructura dedicada, en la jurisdicción que exija la normativa aplicable.

Operación aislada

Instalación sin salida a internet para entornos críticos. Los modelos, los índices y las actualizaciones ingresan como paquetes firmados y verificados.

Catálogo de modelos y ruteo

Varios modelos conviviendo por tamaño y especialidad, con ruteo por tarea: el trabajo simple no paga el costo del modelo grande, y la clasificación del dato determina qué modelo puede verlo.

Recuperación con permisos heredados

El filtro de acceso se aplica en el momento de recuperar, no después: se evalúa fragmento por fragmento, para que un documento parcialmente reservado no se filtre por su resumen.

Asistentes por rol y agentes

Asistentes con el alcance de cada perfil y agentes que ejecutan tareas acotadas sobre sistemas propios, con las acciones permitidas declaradas de antemano.

Guardarraíles

Clasificación de entrada y salida, detección de datos personales, temas vedados y límites duros a lo que un agente puede hacer, con la decisión registrada.

Evaluación continua

Conjuntos de prueba construidos con el propio material del organismo, con medición de exactitud y de calidad de las citas. Ningún modelo ni versión pasa a producción sin superar ese umbral.

Trazabilidad y costo

Quién preguntó, qué se recuperó, qué modelo respondió y con qué versión, junto al consumo por área. La auditoría y el presupuesto miran la misma bitácora.

Módulos

Se contrata completo o por partes

Catálogo de modelos
Motor de inferencia
Ingesta y recuperación
Control de acceso
Asistentes por rol
Agentes y herramientas
Guardarraíles
Evaluación y pruebas
Observabilidad y costos
Auditoría
Consola de administración
Integraciones
Integraciones

Convive con lo que ya tenés

Directorio corporativo (LDAP/AD y SSO) para heredar permisos en la recuperación
Repositorios documentales, gestores de expedientes y Archivo Digital
Bases de datos y almacenes analíticos de la organización
Motores de inferencia de producción y modelos de pesos abiertos
Modelos comerciales por API, cuando la clasificación del dato lo permite
Observabilidad: métricas, trazas y consumo por área
Arquitectura

Dónde corre el modelo lo decide la organización

La misma plataforma se despliega en cuatro modos. La elección no es técnica sino normativa: depende de la clasificación del dato, de la infraestructura disponible y de lo que la organización deba poder demostrar ante una auditoría.

Piezas del despliegue

Modelos de pesos abiertosMotor de inferencia de producciónParalelismo entre placasCuantizaciónEmbeddings localesBase vectorialPasarela de modelos

Marcos que empujan a la soberanía

Protección de datos personalesDatos sensibles de saludSecreto fiscal y estadísticoReglamento europeo de IAInfraestructura crítica

On-premise

Los pesos del modelo y los índices viven en el hardware del organismo. Ninguna consulta abandona la red interna. Es el modo que exigen las normativas más estrictas y el que permite responder «acá» a la pregunta de dónde están los datos.

Nube soberana

Infraestructura dedicada en la jurisdicción elegida, con cifrado y claves gestionadas por el cliente. Para organizaciones que no quieren operar hardware propio pero sí controlar la residencia del dato.

Aislado

Sin ninguna conexión a internet. Modelos, índices y actualizaciones entran como paquetes firmados que se verifican antes de aplicarse. Es el modo de los entornos de infraestructura crítica.

Híbrido por clasificación

La información reservada se procesa con modelos locales y las tareas sobre información pública pueden usar modelos de mayor capacidad por API. La regla la define la clasificación del dato, no la conveniencia del desarrollo.

Cómo se verifica la soberanía

No con una cláusula de confidencialidad, sino con tres preguntas concretas: dónde están alojados los pesos del modelo, por qué red viaja cada consulta y quién tiene permiso para leer la bitácora de lo que se preguntó. Si las tres respuestas apuntan a infraestructura que la organización controla, el sistema es soberano. Si alguna apunta afuera, no lo es.

Casos de uso

Dónde rinde primero

Los casos que damos por buenos comparten una condición: la respuesta tiene que poder fundamentarse en un documento del propio organismo. Donde eso no ocurre, la IA generativa entretiene pero no sirve para decidir.

Gobierno

Consulta sobre el acervo normativo

Un agente responde qué dice la normativa vigente sobre un tema, citando el artículo y la norma que lo sustenta, y advierte cuando hay disposiciones derogadas o en conflicto.

La respuesta llega con la cita, no con una interpretación.

Atención ciudadana

Asistente de primer nivel

Responde consultas sobre trámites con la fuente oficial del procedimiento, en el canal que ya usa el organismo, y deriva a una persona cuando la pregunta excede lo que puede fundamentar.

Menos consultas repetidas en la mesa de entradas.

Compras públicas

Análisis de pliegos y ofertas

Compara cada oferta contra los requisitos del pliego, señala faltantes y diferencias, y arma el cuadro comparativo con la referencia a la página de cada documento.

El comité evalúa sobre un cuadro armado, no en blanco.

Gestión documental

Clasificación e indexación

Tipifica el documento digitalizado, extrae los metadatos de su tipología y propone la carátula del expediente. Se integra con Archivo Digital, sobre el material que la planta ya procesó.

La indexación deja de ser trabajo manual por lote.

Salud

Resumen clínico y codificación

Resume la evolución de un paciente y propone la codificación de la prestación, siempre con el texto de la historia clínica que respalda cada dato. La sugerencia la valida el profesional.

El profesional revisa en lugar de transcribir.

Cumplimiento

Fundamento de alertas

Redacta el fundamento de la decisión sobre una alerta de monitoreo transaccional, con la evidencia que la sustenta adjunta al caso. Se integra con Complybox.io.

El expediente queda listo para el auditor, no para reescribirse.

En todos los casos la decisión sigue siendo de una persona. El sistema prepara, fundamenta y deja la traza; no resuelve por sí mismo aquello que la normativa asigna a un funcionario o a un profesional.

Preguntas frecuentes

Sobre IA Soberana

Las consultas más habituales de los equipos técnicos y de compras.

En dónde termina el dato. Un asistente comercial procesa la consulta en infraestructura de un tercero, bajo sus términos y su jurisdicción. Acá los modelos corren donde la organización decide y la información no sale de ese perímetro. Para datos de salud, tributarios o de expedientes reservados, esa diferencia suele ser la que define si el proyecto puede aprobarse.

Depende del modelo y de cuánta gente lo use en simultáneo. Como referencia, un modelo del orden de 30.000 millones de parámetros necesita entre 48 y 80 GB de memoria de video, y uno del orden de 70.000 millones, entre dos y cuatro placas de 80 GB —o una sola si se cuantiza. El relevamiento define el punto exacto según la carga real y el presupuesto disponible.

Para la mayoría de las tareas documentales, sí. En consultas sobre el acervo propio, la calidad depende más de la recuperación —qué fragmento se le entrega al modelo— que del tamaño del modelo. Cuando alguna tarea puntual necesita más capacidad, el ruteo permite resolverla con otro modelo sin exponer el resto del corpus.

Con tres controles combinados: la respuesta se construye sobre fragmentos recuperados y citados, el sistema declara cuando no encuentra sustento en lugar de completar, y un conjunto de pruebas propio mide exactitud y calidad de citas antes de promover cualquier cambio de modelo o de configuración.

Sí. En modo aislado no hay ninguna salida a la red pública: los modelos, los índices y las actualizaciones ingresan como paquetes firmados que se verifican antes de aplicarse. Es el modo previsto para entornos de infraestructura crítica.

Los permisos se heredan del directorio y de los sistemas de origen, y se aplican en el momento de recuperar, no después de generar la respuesta. La evaluación es por fragmento y no por documento, para que una sección reservada no quede accesible por figurar dentro de un archivo cuyo resumen sí es público.

¿Querés ver IA Soberana funcionando?

Coordinamos una demo con datos de ejemplo de tu sector y revisamos juntos las integraciones necesarias.