Artículo I — IA on-premise para despachos y consultorios en México

Inteligencia artificial que nunca sale de tu despacho.

SoberanIA instala un servidor dedicado con GPU en tu despacho o consultorio y corre 3 modos de consulta — LLM directo, VectorRAG y Vector+Graph-RAG — 100% en local: ningún documento ni pregunta sale jamás hacia la nube.

Verificado — 0 puertos públicos abiertos
3

Modos de consulta en una sola instalación

0%

De los datos o prompts sale hacia la nube

100%

Cifrado en tránsito y en reposo

En vivo

GPU dedicada operando en local

Tres modos, un mismo servidor local

No es un chatbot genérico conectado a una API. Es una instalación propia que combina tres formas de consultar tu información — cada una útil en un momento distinto.

I

Modo LLM directo

Sin llamadas a APIs externas

Un modelo de lenguaje open-weight, corriendo en tu propia GPU.

Chat directo con el modelo de lenguaje instalado en el servidor dedicado — sin pasar por OpenAI, Anthropic, Google ni ningún otro proveedor en la nube. Para redacción, resúmenes y borradores donde no se necesita anclar la respuesta a un documento específico.

  • Modelo open-weight, sin dependencia de un proveedor cerrado
  • Cero llamadas salientes a internet durante la inferencia
  • Uso general: redacción, resúmenes, primeras versiones de escritos
II

Modo VectorRAG

Respuesta con fuente citada

El modelo responde ancladas a tu propio corpus documental.

Búsqueda semántica vectorial sobre los expedientes, contratos o historiales clínicos de tu propio despacho o consultorio — el modelo no inventa desde memoria de entrenamiento, responde con base en tus documentos y cita cuál respalda cada afirmación.

  • Índice vectorial propio, nunca compartido entre clientes
  • Cada respuesta señala el documento fuente exacto
  • Ideal para consulta rápida sobre un caso o expediente puntual
III

Modo Vector+Graph-RAG

Conecta hechos entre documentos

Un grafo de relaciones, encima de la búsqueda semántica.

Además del vector, se construye un grafo de partes, fechas, precedentes o diagnósticos y su cronología — para preguntas que requieren cruzar hechos entre varios documentos a la vez, no solo recuperar el más parecido.

  • Modela relaciones entre partes, fechas y eventos de un caso
  • Responde preguntas que un solo documento no puede contestar
  • Se indexa junto con el corpus, sin intervención manual recurrente

Zero Trust de fábrica, no como añadido

El mismo estándar de infraestructura verificado en producción por el operador — aplicado ahora al hardware que corre tu IA, no solo a un sitio web.

§01

Hardware dedicado, sin multi-tenencia

El servidor con GPU es exclusivo — en tu instalación o en un nodo aislado del operador. Ningún otro cliente comparte el mismo hardware ni el mismo proceso de inferencia.

§02

Cero puertos públicos abiertos

El mismo estándar zero-trust verificado en el resto de la infraestructura del operador: acceso solo por red privada o túnel saliente, nunca un puerto entrante expuesto al router.

§03

Ningún prompt sale a IA en la nube

El modelo corre 100% local. No hay llamadas a OpenAI, Anthropic, Google ni ningún otro proveedor externo — ni tus documentos ni las preguntas que haces sobre ellos salen del servidor.

§04

Cifrado en tránsito y en reposo

Los documentos indexados y las comunicaciones con el servidor viajan y se almacenan cifrados — el mismo nivel exigido para información bajo secreto profesional.

§05

Aislamiento total por cliente

El índice vectorial y el grafo de relaciones de un despacho o consultorio nunca se mezclan ni se entrenan junto con los de otro cliente. Cada instalación es su propio silo.

§06

Trazabilidad de cada respuesta

Todo lo que responde VectorRAG o Graph-RAG queda ligado al documento que lo respalda — auditable, no una caja negra que 'confía en el modelo'.

De diagnóstico a operación diaria

Cuatro pasos, sin saltar directo a producción sin verificación — el mismo criterio de migración por fases que el resto de la infraestructura del operador.

01

Diagnóstico de datos y flujo

Qué documentos existen hoy, en qué formato, y qué preguntas necesita responder el equipo — antes de instalar nada.

02

Instalación en hardware dedicado

Servidor con GPU propia, en tu sitio o en un nodo aislado del operador — nunca en una nube pública compartida.

03

Carga e indexado del corpus

Vectorización de los documentos y construcción del grafo de relaciones — el índice queda listo para los 3 modos de consulta.

04

Piloto supervisado

El propio equipo valida respuestas reales antes de que el sistema entre a operación diaria — sin salto directo a producción sin verificación.

Casa de marcas

Grupo HG-JD

SoberanIA es una de las marcas del portafolio de Grupo HG-JD — corre sobre el mismo estándar de infraestructura auditable que el resto del grupo: infraestructura propia, cero puertos públicos abiertos y cada decisión de arquitectura documentada con su motivación.

El desarrollo técnico está a cargo de Neuralytics Consulting, la línea de desarrollo a medida del grupo. El modelo de lenguaje, el índice vectorial y el grafo de relaciones corren en hardware dedicado — sin dependencia de que un proveedor en la nube decida mañana cambiar sus términos, subir el precio o tener una fuga.

House of BrandsInfraestructura auditableGobierno simpleMéxico
Modelo
House of Brands — 7 marcas activas
Estándar
Infraestructura auditable en todo el portafolio
Portafolio completo

Tres formas de empezar

El costo depende del hardware requerido y el volumen del corpus — se cotiza según alcance real, no de catálogo.

Diagnóstico

Para saber qué tan viable es un despliegue local en tu despacho o consultorio.

  • Auditoría de volumen y tipo de documentos existentes
  • Requisitos reales de hardware para tu caso de uso
  • Recomendación concreta — con o sin nosotros como siguiente paso
Solicitar diagnóstico

Operación continua

Para mantener el sistema actualizado y creciendo junto con tu archivo.

  • Actualización de modelos y reindexado periódico del corpus
  • Soporte técnico directo, sin rotación de proveedor
  • Un solo punto de responsabilidad técnica sobre el sistema
Agendar conversación

Cotización en pesos mexicanos (MXN), con factura CFDI. El hardware (servidor + GPU) se cotiza aparte según el volumen y la sensibilidad de tu caso.

Preguntas frecuentes

Lo que casi siempre pregunta un despacho o consultorio antes de instalar IA sobre su propia información.

¿Mis documentos salen de mi despacho o consultorio en algún momento?

No. El modelo, el índice vectorial y el grafo de relaciones corren en el hardware dedicado instalado para ti — nunca se sube un documento a un servicio en la nube, ni siquiera para el procesamiento inicial.

¿Necesito internet para que funcione?

No para el modelo ni para consultar tu corpus — la inferencia es 100% local. Sí se usa una conexión de red privada o túnel saliente para soporte remoto y actualizaciones, con el mismo estándar zero-trust del resto de la infraestructura (cero puertos entrantes abiertos).

¿Cumple con el secreto profesional, NOM-024 o la LFPDPPP?

El diseño está pensado para ese estándar: datos cifrados en tránsito y reposo, aislamiento total por cliente y ningún dato saliendo hacia un tercero. La validación formal de cumplimiento normativo específico de tu sector se revisa caso por caso en el Diagnóstico inicial.

¿Qué pasa si falla el hardware o se va la luz?

El servidor dedicado se dimensiona con el mismo criterio de continuidad que el resto de la infraestructura que operamos — se revisa en el Diagnóstico según tu caso (respaldo eléctrico, redundancia de disco, plan de recuperación).

¿Qué modelos de lenguaje usa?

Modelos open-weight, sin dependencia de un proveedor cerrado ni de sus cambios de precio o de términos — se eligen y actualizan según el hardware disponible y el caso de uso, nunca una API de terceros.

¿Puedo empezar con pocos documentos y crecer después?

Sí — el índice vectorial y el grafo se actualizan de forma incremental. No se necesita cargar el archivo completo desde el día uno para empezar a usar el sistema.

¿Información que no puede salir de tu despacho?

Una primera llamada de 30 minutos basta para saber si un despliegue local tiene sentido para tu caso — sin costo, sin compromiso.

Cupo limitado de pilotos nuevos por trimestre