Desarrolladores
Para desarrolladores: extensible, abierta y sin bloqueo
Charla está construida para extenderse, integrarse y observarse, una plataforma agéntica abierta, sin silos de proveedor, que adaptas a tu stack en lugar de adaptar tu stack a ella.
Si vas a integrar una plataforma agéntica en tu producto, importan tres preguntas: a quién te ata, cómo la extiendes y cuánto puedes ver de lo que ocurre por dentro. Charla se diseñó con respuestas claras a las tres: un modelo de IA intercambiable, interoperabilidad mediante un estándar abierto y un flujo de eventos en tiempo real que sigues de principio a fin.
Charla es independiente del modelo
En Charla, el modelo de IA es una capa intercambiable, no el cimiento de la plataforma. Eso significa que no quedas atado a un único proveedor de modelo: la capa puede sustituirse sin reescribir la aplicación que la rodea. La generación actual funciona con Gemini, de Google, vía Vertex AI, pero esa elección es una decisión de ingeniería, no una atadura arquitectónica.
Para quien integra, la ventaja es práctica: tu lógica de negocio, tus integraciones y tu interfaz hablan con la plataforma, no con las particularidades de un proveedor de modelo concreto.
Interoperabilidad abierta vía MCP
Charla conecta asistentes con herramientas y sistemas externos mediante MCP (Model Context Protocol), un estándar abierto. Charla actúa como cliente MCP: consume las herramientas que tú expones, en lugar de exigirte programar contra una API propietaria y cerrada. Las herramientas se organizan por namespace según la conexión de origen, lo que mantiene claro de dónde viene cada capacidad y evita colisiones entre integraciones.
Apostar por un estándar abierto es una decisión deliberada: una plataforma agéntica debería ser abierta y observable, sin silos de proveedor. Al hablar MCP, Charla encaja en un ecosistema de herramientas que también puedes usar en otros lugares.
Skills personalizadas, sin tocar el código de la plataforma
Donde el MCP cubre la conexión con sistemas externos, las skills personalizadas cubren la extensión del comportamiento. Una skill empaqueta instrucciones y archivos de referencia en una capacidad que el asistente carga bajo demanda: cuando la tarea pide ese conocimiento, lo usa; cuando no lo pide, no carga peso extra.
- Extiendes un asistente sin ningún cambio en el código de la plataforma.
- La capacidad se carga bajo demanda, solo cuando la tarea lo justifica.
- Instrucciones y archivos de referencia viajan juntos, como una unidad versionable.
Respuestas en streaming, por un flujo de eventos estructurado
Las respuestas de Charla llegan en tiempo real, por un flujo de eventos estructurado, y no como un único bloque de texto al final. Cada tipo de evento tiene su propio significado, lo que permite construir interfaces que reaccionan mientras el agente trabaja: mostrar un indicador de estado, transmitir los tokens a medida que se generan, señalar una llamada a herramienta en curso o renderizar un artefacto en cuanto está listo.
- status: señales sobre lo que el agente está haciendo en ese momento.
- tokens: el texto de la respuesta, transmitido a medida que se genera.
- llamadas a herramienta: cuando el agente invoca una herramienta.
- artefactos: salidas estructuradas, como tablas y gráficos, listas para renderizar.
- evento final: el cierre limpio del ciclo de respuesta.
El flujo expone lo que tu interfaz necesita para reaccionar (estado, tokens, herramientas, artefactos), pero nunca el razonamiento interno bruto del modelo.Charla · notas para integradores
Herramientas nativas que activas y desactivas
Además de las herramientas externas que conectas, Charla incluye un conjunto de herramientas nativas que pueden activarse o desactivarse por asistente: expones solo lo que tiene sentido para cada caso de uso.
- Búsqueda en la web, para traer información actualizada del mundo.
- Hora actual, para respuestas conscientes del momento.
- Generación de imágenes y renderización de gráficos.
- Exportación de datos estructurados.
- Búsqueda en conocimiento y en tablas.
Despliegue portátil, sin bloqueo de nube
El stack de Charla funciona en contenedores detrás de un balanceador de carga y es portátil entre nubes o en entorno on-premise. El único componente específico de nube es el propio balanceador de carga: todo lo demás viaja contigo. No hay bloqueo a un único proveedor de infraestructura.
El coste se contabiliza por llamada, en un modelo transparente basado en créditos: ves lo que consume cada interacción, sin cargos opacos escondidos detrás de la plataforma.
En conjunto, estas decisiones apuntan en la misma dirección: una plataforma agéntica que adaptas a tu stack, integras mediante estándares abiertos y observas mientras trabaja, en lugar de una caja negra a la que tu producto tiene que someterse.