Consultora de inteligencia artificial · Santiago, Chile

Agentes de IA que puedes auditar.

Diseñamos, integramos y supervisamos sistemas de agentes en producción. Con trazabilidad completa, límites de acción explícitos y aprobación humana donde corresponde.

run_8f24c1 · 1.84 s traza de ejecución
solicitud
router.clasificar
mcp.erp.consultar
mcp.stock.buscar
política.evaluar
humano.aprobar
monto sobre el límite → revisión
whatsapp.responder
  • solicitud
  • ejecución automática
  • checkpoint humano

Producto propio

Agent Performance Cloud

No solo asesoramos: operamos nuestro propio producto. Agent Performance Cloud es la capa de control sobre una red de agentes y servidores MCP. La ve entera, mide lo que cuesta y dónde falla, y aplica los cambios con su resultado medido.

No es un tablero para mirar. Cada hallazgo termina en una acción que se previsualiza antes de aplicarse, se contrasta contra los sets de evaluación y se revierte sola si no cumple.

  • Teatro de ejecución

    Cuatro modos sobre el mismo motor: en vivo, repetición de lo que ya pasó, simulación de un cambio antes de aplicarlo y un recorrido narrado. Tres lentes: grafo, Sankey y línea de tiempo.

  • Galaxia navegable

    El sistema completo en tres dimensiones. La altura es costo, el color es riesgo y los ríos de luz son tráfico: se ve dónde está el problema antes de leer una sola tabla.

  • Copiloto en lenguaje natural

    Preguntar qué está pasando y por qué, sin saber leer un grafo. La respuesta mueve la cámara hasta el nodo y muestra la traza que la sustenta.

  • Riesgos agentic

    Permisos más amplios que el uso real, acciones sensibles sin aprobación humana, inyección de prompt vía contenido externo. Cada hallazgo con su radio de impacto.

  • Optimización con prueba

    Recomendaciones en costo, calidad, seguridad y estructura. Cada una se previsualiza, se mide contra los sets de evaluación y se revierte si no cumple lo prometido.

  • Una interfaz, tres profundidades

    Simple, pro y experto sobre el mismo modelo de datos. El mismo hallazgo contado en tres idiomas: explicación en palabras, métrica, o traza y diff.

Vista Galaxy 3D del producto: los agentes y herramientas del sistema dispuestos como una galaxia navegable, agrupados en clústeres ONBOARDING, CORE, SUPPORT y RESEARCH.
flow · galaxia 3DEl sistema como galaxia navegable: la altura es costo, el color es riesgo y los ríos de luz son tráfico en movimiento.
Vista de línea de tiempo del producto: carriles horizontales por agente y herramienta, con el ancho de cada barra proporcional a su latencia.
flow · línea de tiempoCarriles por profundidad del flujo. El ancho es la latencia p95 y la marca interior, la p50.
Panel Trust y Seguridad del producto: tres amenazas detectadas sobre el grafo de agentes, cada una con su nivel de severidad, su radio de impacto y la acción correctiva disponible.
trust · riesgos agenticPermisos por sobre el uso real, acciones sensibles sin aprobación e inyección de prompt. Cada hallazgo indica cuántos nodos caen si ese se compromete, y la acción que lo corrige.

Capturas del producto con datos de demostración.

Servicios

Del piloto que funciona al sistema que aguanta.

La mayoría de los proyectos de IA no falla en la demo; falla cuando entra en producción y nadie puede explicar qué hizo el agente, por qué, ni con qué datos.

Gobierno de agentes

Qué puede hacer un agente y qué no. Políticas de acción, límites por monto y tipo de operación, checkpoints de aprobación humana, registro auditable de cada decisión.

  • políticas
  • human-in-the-loop
  • auditoría
  • EU AI Act

Observabilidad

Instrumentación de extremo a extremo: trazas por ejecución, costo y latencia por herramienta, detección de respuestas fuera de dominio, alertas cuando el comportamiento se desvía.

  • trazas
  • evaluación continua
  • alertas
  • costo por run

Servidores MCP a medida

Conectar los sistemas actuales al modelo sin reescribirlos. ERP, bases de datos, endpoints OData y APIs internas expuestos como herramientas seguras, con permisos y validación por capa.

  • MCP
  • ERP / OData
  • APIs internas
  • permisos

Agentes conversacionales

Asistentes que atienden, cotizan, agendan y escalan a una persona cuando corresponde. En WhatsApp, en el sitio, o dentro de las herramientas que el equipo ya usa.

  • WhatsApp
  • web
  • Slack
  • voz

Confiabilidad y evaluación

Sets de evaluación propios del dominio, pruebas de regresión antes de cada cambio de modelo o prompt, agentes que saben abstenerse cuando no tienen información suficiente.

  • evals
  • regresión
  • abstención
  • alucinaciones

Diagnóstico e innovación

Dónde la IA rinde de verdad en la operación y dónde solo agrega riesgo. Con estimación de impacto, costo real por proceso y hoja de ruta priorizada.

  • discovery
  • casos de uso
  • ROI
  • hoja de ruta

Proceso

Cuatro etapas, sin sorpresas.

01

Diagnóstico

Dos semanas. Revisión de procesos, datos y sistemas. Salida: casos priorizados y estimación real de esfuerzo.

02

Piloto

Un caso acotado, en el ambiente del cliente, con métricas definidas antes de empezar. Si no cumple, no avanza.

03

Producción

Integración con los sistemas, políticas de gobierno activas, observabilidad desde el primer día.

04

Operación

Monitoreo, evaluación continua y ajustes cuando cambian los modelos, los datos o el negocio.

Contacto

Cuéntanos qué estás intentando resolver.

Respondemos con una evaluación honesta de si la IA es la herramienta correcta para el caso. A veces la respuesta es que no.

Escríbenos hola@nira.cl
Ubicación

Santiago, Chile — trabajo remoto con equipos en todo el país.