Infraestructura de IA que decide por ti: rápido y barato cuando puede, potente cuando lo necesita.
I2J Core es un motor de enrutamiento entre modelos de lenguaje pequeños (SLM) desplegados on-premise y modelos grandes vía API, para que las empresas paguen solo por la inteligencia que realmente necesitan en cada consulta.


Por qué construimos esto
Tres fricciones que enfrentan las empresas al adoptar IA generativa hoy
Costo impredecible
Cada consulta a un LLM en la nube cuesta dinero, incluso para tareas simples y repetitivas.
Soberanía del dato
Sectores regulados (banca, salud, gobierno) no pueden enviar información sensible a APIs externas sin control.
Depender 100% de un proveedor externo introduce riesgo operacional y tiempos de respuesta variables.
Latencia y dependencia
Cómo funciona I2J Core
I2J Core clasifica cada consulta entrante y la enruta automáticamente: las consultas frecuentes y de bajo riesgo van a un modelo pequeño (SLM) corriendo on-premise; las consultas complejas o de alto valor van a un modelo grande vía API, solo cuando el caso lo justifica. Todo se expone a través de una API construida en Python (Flask/Quart/Django), lista para integrarse en los sistemas existentes del cliente.


Consulta compleja
Casos ambiguos o de alto valor se enrutan a un modelo grande vía API, solo cuando realmente se necesita.
Caso Validado
Hoy, I2J Core opera en producción como canal de atención y venta por WhatsApp para Kahui, integrado con LLM y el sistema central de ventas.
Consulta simple
Preguntas frecuentes o de bajo riesgo se resuelven con un modelo pequeño (SLM) corriendo on-premise, con costo mínimo.
Tecnología y roadmap
El motor detrás de I2J Core, lo que ya está funcionando y hacia dónde va.
Stack técnico
Python (Flask/Django/Quart), modelos SLM locales vía Ollama, RAG con Chroma/pgvector, integración con APIs externas como fallback.
En producción
Router SLM/LLM funcionando, módulo de auditoría de contenido, canal WhatsApp para retail de mascotas.
Empaquetado como servicio autoinstalable para PYMEs, panel de monitoreo de costos, capa SLM en el canal WhatsApp.
