El ciclo de razonamiento
Cuando escribís un pedido, el asistente no responde de una: razona en rondas.
- Recibe tu mensaje junto con el contexto (conversación, recuerdos, habilidades).
- Decide si puede responder directamente o si necesita datos: en ese caso elige una o varias herramientas.
- Ejecuta las herramientas y recibe los resultados.
- Con esos resultados decide si ya puede responder o si necesita otra ronda.
- Arma la respuesta final.
El máximo es de 10 rondas por pedido (configurable). Esto le permite encadenar: buscar el cliente, con ese Id traer el saldo, con el saldo evaluar el límite.
Mientras trabaja, la interfaz te muestra qué herramienta está usando en cada momento.
Memoria persistente
Recuerda información entre conversaciones distintas, no solo dentro del chat en curso.
| Aspecto |
Detalle |
| Cómo se guarda |
Le pedís explícitamente ("recordá que…") o el asistente extrae datos relevantes de la conversación. |
| Alcance |
Personal por defecto. Un recuerdo marcado como global se comparte con toda la empresa. |
| Cómo se recupera |
Antes de cada respuesta busca los recuerdos más relevantes y los incorpora al contexto. |
| Olvido |
Los recuerdos pierden importancia con el desuso, según una vida media configurable (por defecto 60 días). |
| Configuración |
Solapa Memoria: activación, modo de extracción, modelo de embeddings, cantidad de recuerdos a inyectar, umbral de relevancia, presupuesto en caracteres y vida media. |
Límite conocido: la recuperación por significado necesita un proveedor que ofrezca embeddings. Si el proveedor configurado no los soporta, la memoria funciona igual pero recupera por coincidencia de palabras, con menos precisión.
Historial de conversaciones
Cada chat se guarda y aparece en el panel lateral, donde podés cargarlo, renombrarlo o borrarlo.
Además, el asistente puede buscar dentro de tus conversaciones anteriores: preguntale "¿qué me dijiste sobre el cliente X la semana pasada?" o "buscá en chats anteriores lo de la liquidación". Solo accede a tus propias conversaciones.
Habilidades
Una habilidad es un procedimiento que le enseñás una vez y queda disponible para siempre. Si le explicás cómo hacer algo en tu empresa —el circuito de aprobación de un descuento, cómo armar cierto informe— el asistente reconoce que le estás enseñando y ofrece guardarlo.
| Aspecto |
Detalle |
| Cómo se crean |
Enseñándole un procedimiento; el asistente lo propone y vos confirmás. |
| Cómo se usan |
Detecta que una habilidad aplica y carga su contenido antes de responder. |
| Gestión |
"¿Qué habilidades tenés?" las lista; también se pueden archivar (no se borran, son recuperables). |
| Activación |
Casilla Habilidades en la solapa Modelo. |
Base de conocimiento de la empresa
Documentos propios que el asistente puede consultar: circulares, políticas internas, manuales de procedimiento, contratos tipo.
| Aspecto |
Detalle |
| Formatos |
PDF, TXT, MD y CSV. |
| Cómo se cargan |
Solapa Conocimiento, con opción de listar y borrar. |
| Cómo se usan |
El asistente busca los fragmentos relevantes y responde citando el documento de origen. |
| Alcance |
Por empresa: los documentos son de la organización, no de un usuario. |
Diferencia con los manuales: la base de conocimiento son tus documentos. Los manuales son la documentación oficial de Plenario, que el asistente consulta con otra herramienta.
Servers MCP (herramientas externas)
MCP (Model Context Protocol) es un estándar para que un asistente use herramientas de sistemas externos. El Asistente IA funciona como cliente MCP y soporta dos transportes:
| Transporte |
Cuándo se usa |
| stdio |
Servers que corren como proceso local en la misma máquina. |
| HTTP |
Servers remotos o publicados en un IIS local, con headers propios (por ejemplo, un token de autorización). |
Las herramientas del server aparecen con el prefijo del server y se usan igual que las nativas. La conexión es perezosa: se establece la primera vez que hace falta. Si un server falla, los demás siguen funcionando.
Seguridad: todo lo que viene de un server MCP se trata como contenido de terceros. Las instrucciones que el server declara se insertan marcadas explícitamente como no autoritativas, y toda herramienta MCP pide confirmación antes de ejecutarse, sin importar qué haga.
Configuración en la solapa Herramientas: alta manual, búsqueda en el registro público, catálogo, importación desde Claude Desktop, edición JSON avanzada y botón de prueba de conexión.
Alertas proactivas
Al abrir el asistente, sin que preguntes nada, puede mostrarte tarjetas de aviso:
| Alerta |
Qué informa |
| Mora |
Clientes en mora que requieren atención. |
| Cuotas a vencer |
Cuotas próximas a vencer, con el plazo de aviso configurable. |
| Cheques rechazados |
Rechazos pendientes de recobro. |
| Clientes PEP |
Clientes marcados como Persona Expuesta Políticamente. |
Cada alerta tiene su propio permiso: si el usuario no lo tiene, esa alerta no se calcula ni se muestra.
Visión: imágenes y PDF
Podés adjuntar imágenes y PDF y pedirle que los lea. También acepta Excel y CSV para procesar extractos.
- Adjuntar: botón de clip, arrastrar y soltar sobre el chat, o pegar una imagen del portapapeles.
- Modelo aparte: en la solapa Visión se puede configurar un modelo distinto solo para imágenes y PDF, con su propio proveedor, endpoint y clave. Útil cuando el modelo principal no interpreta imágenes.
- Archivos grandes: un Excel o CSV extenso se lee por tramos, para no saturar el contexto.
Dictado por voz (transcripción)
Si el administrador lo habilita, se puede dictar la consulta: grabar con el micrófono (botón 🎙 del cuadro de escritura) o adjuntar un archivo de audio. El asistente lo transcribe con Whisper y deja el texto en el cuadro para que lo revises antes de enviar (no lo manda solo).
| Aspecto |
Detalle |
| Cómo se activa |
Solapa Visión y voz: casilla de habilitación + endpoint, modelo y clave del servicio de transcripción. Arranca desactivado. |
| Nube o local |
Puede usar un Whisper en la nube (Groq whisper-large-v3-turbo es gratis y muy bueno en español, u OpenAI) o un modelo local para que el audio no salga de la red. Se elige con el endpoint, sin cambiar nada más. |
| Formatos |
Grabación del micrófono, o audios .mp3, .wav, .ogg, .m4a, .webm. |
Respuesta en vivo, cancelación y control de gasto
| Función |
Detalle |
| Respuesta en vivo |
La respuesta se muestra a medida que se genera. Si el proveedor no lo soporta, el asistente lo detecta, cambia al modo tradicional y no reintenta en esa sesión. |
| Detener |
Mientras responde, el botón de enviar se convierte en ⏹ Detener y corta la respuesta en curso. |
| Medición de consumo |
Cada llamada registra tokens de entrada y salida y su costo estimado. El comando /metricas abre el panel de uso. |
| Tope mensual |
Se puede fijar un tope de gasto en dólares. Al alcanzarlo, el asistente avisa y deja de responder hasta el mes siguiente. |
| Indicador de contexto |
Un indicador muestra el porcentaje de la ventana de contexto en uso; cambia de color cuando se acerca al límite. |
Límites conocidos: la cancelación es cooperativa, así que una consulta pesada ya lanzada puede tardar en cortar. El tope de gasto se evalúa antes de cada pedido, no en el medio: un pedido que arranca justo debajo del tope puede superarlo.
Cómo se eligen las herramientas
Con más de cien herramientas disponibles, mandarlas todas en cada consulta sería caro y confundiría al modelo. Se combinan tres mecanismos:
- Selección por relevancia — se eligen las más pertinentes al pedido (14 por defecto). Puede funcionar por significado (si hay embeddings disponibles) o por coincidencia de palabras.
- Grupo fijo — un conjunto de herramientas básicas siempre está presente, aunque la selección no las elija: búsqueda de clientes, manuales, memoria, habilidades, sugerencias, continuación de listados y búsqueda de herramientas.
- Búsqueda a demanda — si nada encaja,
buscar_herramienta busca en el catálogo completo y habilita la que falte.
La selección considera además los últimos turnos de la conversación, no solo el mensaje actual: así una herramienta no desaparece a mitad de una tarea porque el mensaje siguiente no repitió la palabra clave.