Herunterladen

KI-Chat

Agentenbasierter KI-Kern mit expliziten Berechtigungen, produktionsreifem Tool-Set (Word / Excel / PowerPoint / PDF, Terminal, Dateisystem, Web-Suche), einheitlicher Sprache mit Streaming-TTS, RAG-Kontexten, mehreren parallelen Gesprächen und beliebigem Anbieter — OpenAI, Claude, YandexGPT oder lokale LLMs.

Was Sie bekommen

1

Agentenbasierter KI-Kern

Der Assistent läuft als Agent mit expliziten Berechtigungs-Dialogen, einer einheitlichen Ausführungs-Timeline und einem strukturierten Chat-Logger mit Filter- und Export-Funktion.

2

Produktionsreifes Tool-Set

Word-, Excel-, PowerPoint- und PDF-Dokumente erstellen und bearbeiten, Bilder extrahieren, ein gehärtetes Terminal und Dateisystem mit Pfad-Klassifizierung, Symlink-Auflösung und SSRF-Schutz steuern.

3

Austauschbare Web-Suche

Brave, DuckDuckGo oder Tavily als Web-Such-Backend — den Anbieter pro Workspace umschalten, ohne das Modell neu zu instruieren.

4

Einheitliches Sprach-Erlebnis

Ein Mikrofon-Knopf plus zwei Schalter. Streaming-TTS satzweise, automatische Spracherkennung (en/ru/de/fr/pt/es), automatischer Mikro-Neustart für freihändige Dialoge.

5

Abbruch als gleichberechtigtes Ergebnis

Lauf jederzeit stoppen — lang laufende Tools werden sauber heruntergefahren. Die Timeline zeigt „cancelled" getrennt von Fehlern, mit einem Begründungs-String.

6

Vision-Unterstützung

Bildhaltige Tool-Ergebnisse — Browser-Screenshots, aus Dokumenten extrahierte Abbildungen — sieht der Assistent in der nächsten Runde.

7

KI-Assistent mit Ihren Daten

Binden Sie einen RAG-Kontext an — der Chat antwortet auf Basis hochgeladener Dokumente, nicht nur auf Grundlage des allgemeinen Modellwissens.

8

Mehrere Gespräche gleichzeitig

Ein separates Gespräch für jede Aufgabe — Code Review, Übersetzung, Brainstorming — nichts vermischt sich.

9

Modellwahl je nach Aufgabe

Claude für Code, GPT-4o für Texte, lokales LLM für vertrauliche Daten — Wechsel mit einem Klick.

10

Präzise Verhaltensanpassung

System-Prompt definiert die Rolle, Temperature steuert die Kreativität, Max Iterations begrenzt Tool-Schleifen — jedes Gespräch wird zum spezialisierten Assistenten.

11

Streaming der Antworten

Tokens erscheinen während der Generierung — Sie warten keine 30 Sekunden auf den Abschluss, sondern lesen sofort mit.

12

Lokale LLMs

Verbinden Sie LM Studio, Ollama, vLLM oder llama.cpp über den OpenAI-kompatiblen Adapter — Daten verlassen Ihren Computer nicht.

13

Einheitliche Oberfläche

Kein ChatGPT, Claude.ai oder andere Websites öffnen nötig — alle Anbieter laufen über einen Chat mit einem einheitlichen Berechtigungsmodell.