Núcleo IA basado en agente
El asistente funciona como un agente con diálogos de permiso explícitos, una línea de tiempo de ejecución unificada y un logger estructurado del chat con filtrado y exportación.
Núcleo IA basado en agente con permisos explícitos, kit de herramientas de producción (Word / Excel / PowerPoint / PDF, terminal, sistema de archivos, búsqueda web), voz unificada con TTS en streaming, contextos RAG, múltiples conversaciones en paralelo y cualquier proveedor — OpenAI, Claude, YandexGPT o LLMs locales.
El asistente funciona como un agente con diálogos de permiso explícitos, una línea de tiempo de ejecución unificada y un logger estructurado del chat con filtrado y exportación.
Generar y editar documentos Word, Excel, PowerPoint y PDF, extraer imágenes, manejar un terminal y un sistema de archivos endurecidos con clasificación de rutas, resolución de symlinks y protección SSRF.
Brave, DuckDuckGo o Tavily como backend de búsqueda web — cambia el proveedor por workspace sin reinstruir al modelo.
Un único botón de micrófono más dos toggles. TTS en streaming por frases, detección automática de idioma (en/ru/de/fr/pt/es), reinicio automático del micrófono para diálogo manos libres.
Detén la ejecución cuando quieras — las herramientas largas se cierran ordenadamente. La línea de tiempo distingue «cancelled» de los errores, con un motivo en texto.
Los resultados de herramientas con imágenes — capturas del navegador, figuras extraídas de documentos — son visibles para el asistente en el siguiente turno.
Adjunta un contexto RAG — el Chat responde basado en tus documentos subidos, no solo en el conocimiento general del modelo.
Una conversación separada para cada tarea — revisión de código, traducción, lluvia de ideas — nada se mezcla.
Claude para código, GPT-4o para texto, un LLM local para datos confidenciales — cambia con un clic.
El system prompt fija el rol, la temperatura controla la creatividad, el tope de iteraciones limita los bucles de tools — cada conversación funciona como un asistente especializado.
Los tokens llegan según se generan — empieza a leer al instante en lugar de esperar 30 segundos a que termine.
Conecta LM Studio, Ollama, vLLM o llama.cpp a través del adaptador compatible con OpenAI — los datos nunca salen de tu equipo.
No necesitas abrir ChatGPT, Claude.ai u otros sitios — todos los proveedores funcionan en un único chat con un único modelo de permisos.