Zum Inhalt springen
biwak

Ratgeber

Vergleiche

Chat oder Agent: Was ändert sich, wenn die KI selbst Befehle ausführt?

Ein Chat liefert Text, ein Agent arbeitet in Ihrem Ordner: was Terminalbefehle bedeuten, an echten Befehlen erklärt, mit Schutz und Grenzen.

Verantwortlich:

Veröffentlicht

12 Min. Lesezeit

Zwei Arbeitsweisen: Antworten oder Handgriffe

Die meisten kennen KI als Chatfenster: Man tippt eine Frage, die Maschine antwortet. Für Erklärungen, Entwürfe und schnelle Recherchen ist das großartig. Aber alles, was aus der Antwort werden soll, erledigen Sie danach selbst: die Tabelle im richtigen Ordner, der geänderte Vertrag, die nachgerechnete Summe. Sie kopieren, speichern, benennen und prüfen.

  • Chat im Browser

    1. kontoauszug.pdfBitte alle Buchungen als Tabelle.
    2. Hier sind die 16 Buchungen:08-001;Dauerauftrag;-1250,0008-002;SEPA-Lastschrift;-186,40… 14 weitere Zeilen

    FrageAntwortSie machen weiter

  • Biwak im Arbeitsordner

    • Buchhaltung
    • kontoauszug.pdf
    • buchungen-2026-08.csvneu
    1. LesenOrdner und Dateien
    2. TunBefehl ausführen
    3. PrüfenProbe rechnen
    4. Nachbessernoder die Lücke melden
Links das Chatfenster: Die Datei geht hoch, die Antwort kommt als Text, der Rest liegt bei Ihnen. Rechts Biwak im Arbeitsordner: Der Agent liest, führt Befehle aus, prüft und bessert nach; was sich nicht klären lässt, meldet er. Schema, kein Bildschirmfoto.

Ein KI-Agent arbeitet anders. Er bekommt ein Ziel und einen Ort und wählt die Schritte selbst. Bei Biwak ist dieser Ort ein Arbeitsordner, den Sie festlegen. PDFs, Tabellen, Word-Dateien und frühere Fassungen darin öffnet der Agent selbst, und seine Ergebnisse landen als Dateien im selben Ordner. Wie Agenten grundsätzlich funktionieren und welche Büroaufgaben sich eignen, steht im Artikel Was ist ein KI-Agent?.

Was ein Terminalbefehl ist, ohne Fachsprache

Jeder Mac und jeder Windows-Rechner hat ein Textfenster, in dem man ihm Anweisungen schreiben kann: das Terminal, unter Windows die PowerShell. Statt zu klicken, tippt man einen kurzen Befehl, der Rechner führt ihn aus und antwortet mit Text. Softwareentwickler arbeiten seit Jahrzehnten so, weil ein Befehl genau ist, sich wiederholen lässt und sich mit anderen verketten lässt. Vier Beispiele aus dem Protokoll weiter unten:

Vier Befehle und was sie von Hand bedeuten
BefehlWas er tutVon Hand wäre das
lsZeigt, was im Ordner liegtDen Ordner im Finder oder Explorer öffnen und nachsehen
biwak text auszug.pdfGibt den Text einer PDF-, Word-, Excel- oder PowerPoint-Datei aus (Lesebefehl der App, hier abgekürzt)Die Datei öffnen, alles markieren, kopieren
awk …Rechnet eine Spalte zusammen oder findet Zeilen, die aus der Reihe fallenTaschenrechner oder eine Formel in Excel
Datei schreibenLegt eine neue Datei im Ordner anSpeichern unter, Namen tippen, Ordner wählen

Ein Chat kann Ihnen solche Befehle vorschlagen, eintippen müssten Sie sie selbst. Ein Agent führt sie aus, liest die Antwort des Rechners und entscheidet danach über den nächsten Schritt. Das ist der Schritt vom Rat zur Tat.

In der Softwareentwicklung ist diese Arbeitsweise schon verbreitet. Anthropic beschreibt Claude Code als Werkzeug, das Code liest, Dateien bearbeitet und Befehle ausführt; OpenAIs Codex CLI läuft laut OpenAI „locally on your computer“. Alltag ist das selbst dort noch nicht: In der Entwicklerumfrage von Stack Overflow 2025 nutzen 84 % der Befragten KI-Werkzeuge oder planen es, täglich mit KI-Agenten arbeiten aber nur 14,1 %. Biwak überträgt die Arbeitsweise vom Quellcode auf den Büroordner: Statt Programmdateien liegen darin Rechnungen, Verträge und Tabellen.

Derselbe Auftrag, zwei Wege: Wer macht die Handgriffe?

Nehmen wir eine alltägliche Aufgabe: Ein Kontoauszug liegt als PDF vor, die Buchungen sollen in eine Tabelle, und die Summe soll zum Kontostand passen. In ChatGPT übernimmt das die Datenanalyse. Für viele Analysen schreibt sie laut OpenAI Python-Code und führt ihn in einer Umgebung aus, die mit den Dateien arbeitet, die der Sitzung zur Verfügung gestellt wurden, also mit Ihrer hochgeladenen Kopie. Für Uploads nennt OpenAI Grenzen: 512 MB je Datei, bei Tabellen etwa 50 MB, bis zu 80 Dateien in drei Stunden, im kostenlosen Plan drei Uploads am Tag. Das Ergebnis bekommen Sie als Antwort im Chat, etwa als Tabelle oder Diagramm.

Derselbe Auftrag, zwei Wege

AuftragÜbertrage alle Buchungen aus kontoauszug.pdf in eine Tabelle und prüfe sie gegen den Kontostand.

6Handgriffe bei Ihnen
von 7 Schritten

  1. SieDen Kontoauszug im Ordner suchen und hochladen
  2. SieDen Auftrag eintippen
  3. ChatGPTLiest die hochgeladene Kopie und antwortet mit einer Tabelle
  4. SieDie Tabelle übernehmen, etwa kopieren und in Excel einfügen
  5. SieDie Datei in den richtigen Ordner legen und benennen
  6. SieDie Summe gegen den Kontostand prüfen oder darum bitten
  7. SieBei einer Abweichung: Fehler beschreiben, neue Fassung holen, wieder ablegen

2Handgriffe bei Ihnen
von 7 Schritten

  1. SieDen Auftrag eintippen. Der Arbeitsordner ist schon gewählt
  2. BiwakSichert den Ordner, bevor sich etwas ändert
  3. BiwakSieht nach, was im Ordner liegt
  4. BiwakLiest beide Seiten des Auszugs
  5. BiwakSchreibt buchungen-2026-08.csv in den Ordner
  6. BiwakRechnet die Probe und sucht bei einer Abweichung die Ursache
  7. SieDas Ergebnis prüfen, behalten oder mit einem Klick zurücksetzen
Schalten Sie zwischen beiden Wegen um. Im Chatfenster bleiben sechs von sieben Schritten bei Ihnen, im Arbeitsordner zwei: den Auftrag geben und das Ergebnis prüfen. Ein Schema nach den Schritten dieses Auftrags, kein Messwert.

Fairerweise: ChatGPT kann die Summe auch nachrechnen, wenn Sie darum bitten. Der Unterschied liegt nicht in der Klugheit des Modells, sondern im Ort der Arbeit. Im Chat arbeitet die KI mit einer Kopie in einer Umgebung beim Anbieter. Im Arbeitsordner arbeitet sie an Ort und Stelle, neben allen anderen Dateien, die sie vielleicht noch braucht: der Preisliste, der Tabelle vom Vormonat, dem Vertrag von letzter Woche.

Ein Protokoll, Zeile für Zeile übersetzt

Wie sieht das aus, wenn ein Agent arbeitet? Unten stehen die Befehle eines solchen Auftrags. Wir haben sie am 24. September 2026 auf einem MacBook Pro im Terminal ausgeführt, mit dem erfundenen Kontoauszug aus unserem Beispielpaket. Links steht, was der Rechner gesehen hat, rechts, was es bedeutet.

BuchhaltungProtokoll · 6 Schritte

  1. ls
    kontoauszug.pdf

    Sieht nach, was im Ordner liegt. Niemand musste die Datei hochladen.

  2. biwak text kontoauszug.pdf
    --- Seite 1 von 2 ---
    Alter Kontostand am 31.07.2026  14.850,32 EUR
    03.08.2026  Dauerauftrag  Beleg 08-001  -1.250,00
    …
    16 Buchungen | Summe Gutschriften: +7.953,80 EUR | Summe Belastungen: -6.124,75 EUR
    Neuer Kontostand am 31.08.2026  16.679,37 EUR

    Liest beide Seiten als Text, auf unserem Rechner in rund einer Zehntelsekunde. Der neue Kontostand unten ist die Probe für später.

  3. (schreibt buchungen-2026-08.csv)
    Buchungsdatum;Wertstellung;Belegnummer;Buchungsart;Empfaenger_Auftraggeber;Verwendungszweck;Betrag_EUR
    03.08.2026;03.08.2026;08-001;Dauerauftrag;Hausverwaltung Fichtenhof GmbH;Gewerbemiete August 2026 / Objekt Lindenweg 12;-1250,00
    … 15 weitere Zeilen

    Legt die Tabelle als neue Datei in den Ordner. Der Auszug bleibt, wie er war.

  4. awk -F';' 'NR>1{b=$7; gsub(/[+,]/,"",b); s+=b; n++} END{print n" Buchungen, neuer Stand "1485032+s" Cent"}' buchungen-2026-08.csv
    16 Buchungen, neuer Stand 1489437 Cent

    Erste Probe, in ganzen Cent: 14.894,37 € statt 16.679,37 €. Das passt nicht.

  5. awk -F';' 'NF!=7{print NR": "NF" Felder"}' buchungen-2026-08.csv
    8: 8 Felder

    Sucht die Zeile, die aus der Reihe fällt: Zeile 8 hat ein Feld zu viel. Ihr Verwendungszweck enthält selbst ein Semikolon.

  6. awk -F';' 'NR>1{b=$NF; gsub(/[+,]/,"",b); s+=b; n++} END{print n" Buchungen, neuer Stand "1485032+s" Cent"}' buchungen-2026-08.csv
    16 Buchungen, neuer Stand 1667937 Cent

    Rechnet mit der letzten Spalte neu: 16.679,37 €, auf den Cent der Stand aus dem Auszug. Die Tabelle war richtig, die erste Probe hatte falsch gezählt.

Befehle und Ausgaben sind echt: am 24. September 2026 im Terminal eines Macs ausgeführt, mit synthetischen Beispieldaten. Die Reihenfolge stellt einen Biwak-Lauf nach. Ein Sprachmodell war nicht beteiligt, die Tabelle in Schritt 3 stammt aus dem Beispielpaket. Den Lesebefehl der App kürzen wir als biwak text ab; der Agent ruft ihn über den Programmpfad der App auf, die Ausgabe ist dieselbe.

Der spannende Schritt ist der vierte. Die erste Probe ergab 14.894,37 € statt 16.679,37 €. Falsch war nicht die Tabelle, sondern die Probe: Ein Verwendungszweck enthält selbst ein Semikolon, also genau das Zeichen, das die Spalten trennt, und die Rechnung griff in Zeile 8 in die falsche Spalte. Geplant hatten wir diesen Fehler nicht, er ist beim Zusammenstellen des Protokolls passiert. Er zeigt gut, worauf es ankommt. Eine Chatantwort mit falscher Summe klingt genauso überzeugend wie eine mit richtiger. Ein Agent, der im Ordner nachrechnet, merkt die Lücke, weil die Zahl nicht zum Auszug passt.

Warum der Ordner mehr zählt als die Antwort

Im Chat bestimmen Sie, was das Modell zu sehen bekommt: das, was Sie einfügen, hochladen oder aus einem verbundenen Dienst wie Google Drive oder OneDrive anhängen. Was Sie vergessen, fehlt, und die Antwort klingt trotzdem flüssig. Im Arbeitsordner sieht der Agent selbst nach. Er findet die Preisliste neben der Bestellung und die Vorlage neben dem Entwurf. Der Ordner ist der Zusammenhang.

Menge

Viele Dateien in einem Zug

Statt fünfzig Uploads: Biwak weist den Agenten an, bei vielen Dateien eine Schleife zu schreiben, die über alle läuft und nur das Ergebnis ausgibt. Er liest PDF mit Textebene, Word, Excel, PowerPoint und OpenDocument. Gescannte Belege ohne Textebene liest er nicht.

Ablage

Das Ergebnis liegt, wo es hingehört

Tabellen als CSV, Seiten als HTML und Texte legt der Agent direkt in den Ordner. Jede neue oder geänderte Datei erscheint in der Antwort als Karte mit Vorschau.

Nachweis

Was passiert ist, lässt sich prüfen

Protokolliert wird auf Ihrem Rechner: die Aufträge, welche Dateien der Agent gelesen und geändert hat, die Sicherungspunkte. Gefällt Ihnen ein Ergebnis nicht, setzen Sie den Ordner zurück.

Wie das bei einer größeren Menge aussieht, zeigt die Vorführung auf unserer Startseite: Eine Klausel wird in 30 Verträgen ersetzt, 28 werden geändert, zwei waren schon aktuell, dazu entsteht eine Liste der Änderungen. Die Vorführung ist eine Nachstellung ohne Modellaufruf; sie zeigt den Ablauf, keine Messung.

Befehle auf dem eigenen Rechner: Was schützt Sie?

Wer Befehle ausführen darf, kann auch Schaden anrichten. Das ist der Preis echter Arbeit, und wir sagen es offen: Die Befehle des Agenten reichen so weit wie Ihr Benutzerkonto auf dem Rechner. Biwak arbeitet in dem Ordner, den Sie wählen, und legt die Ergebnisse dort ab, eine technische Sperre für den Rest des Rechners ist das aber nicht. Die AGB weisen in § 9 ausdrücklich darauf hin. Deshalb gibt es diese Leitplanken:

Was Biwak vor und während eines Auftrags tut
  • Vor jedem Auftrag sichert Biwak den ganzen Arbeitsordner. Ein Klick stellt den Stand von vorher wieder her, und auch das Zurücksetzen lässt sich zurücknehmen.
  • Klappt die Sicherung nicht, startet der Auftrag nicht.
  • In den Einstellungen lassen sich Terminalbefehle und Internetzugriff abschalten.
  • Der Sicherungspunkt deckt nur den Arbeitsordner und ersetzt keine Datensicherung. Fangen Sie deshalb mit einem eigenen Ordner voller Kopien an.
  1. Ihr Rechner

    • Arbeitsordner mit Ihren Dateien und Ergebnissen
    • Befehle laufen hier, mit den Programmen dieses Rechners
    • Gespräche und Protokoll liegen hier
    • Sicherungspunkt vor jedem Auftrag
  2. Auftrag, Gesprächskontext, benötigte Dateiinhalte Antwort und die nächsten Befehle
  3. Biwak-Gegenstelle

    • Frankfurt am Main
    • Konto und Kontingent
    • Speichert die Auftragsinhalte nicht
  4. Sprachmodell

    • Gerechnet wird in der EU
    • Vertragspartner PREM SA, Schweiz
    • Kein Training mit Ihren Inhalten
Die Hände arbeiten auf Ihrem Rechner, gedacht wird in der EU. Übertragen werden der Auftrag, der nötige Gesprächskontext und die Dateiinhalte, die der Agent für die Antwort braucht. Die Grafik zeigt die Desktop-App.

Ihre Dateien bleiben im Ordner auf Ihrem Rechner. Die Gespräche der App speichert Biwak ebenfalls auf Ihrem Rechner, außerhalb des Arbeitsordners; sie erreichen uns nicht, außer in einem Fehlerbericht, den Sie selbst senden. Die App meldet von sich aus nichts an uns: keine Telemetrie, keine Nutzungsstatistik. Für eine Antwort gehen Ihre Frage, der nötige Kontext und die verwendeten Dateiinhalte über die Biwak-Gegenstelle in Frankfurt am Main an das Sprachmodell. Gerechnet wird in der EU; bei Modellen über Prem AI ist Vertragspartner die PREM SA in der Schweiz. Biwak speichert diese Inhalte dabei nicht und verwendet sie nicht zum Training. Was der Modellanbieter zusagt und wo diese Zusage endet, steht in der Datenschutzerklärung, Abschnitt 14 und auf der Seite Sicherheit.

Was ChatGPT besser kann

  • Fragen, Entwürfe, Recherche: Dafür ist ein Chat gebaut, im Browser, am Desktop und auf dem Telefon. Die Biwak-Desktop-App sucht praktisch nicht im Netz; eine Websuche gibt es nur im Arbeitsbereich im Browser.
  • Arbeit im Team: ChatGPT Business und Enterprise bieten gemeinsame Projekte und eine Verwaltung für viele Plätze. Bei Biwak gilt ein Tarif für eine Person, einen gemeinsam bearbeiteten Arbeitsbereich sagen wir nicht zu.
  • Auch OpenAI hat Agenten: Codex CLI arbeitet für Entwickler auf dem eigenen Rechner. ChatGPT Work kann in Business und Enterprise freigegebene Dateien, Programme und Browsersitzungen auf dem Rechner nutzen; OpenAI betont dabei selbst, dass das Modell trotzdem nicht auf dem Gerät rechnet. Den früheren „ChatGPT agent“, der auf einem virtuellen Rechner bei OpenAI arbeitete, gibt es laut OpenAI nicht mehr.
  • Bilder: ChatGPT erzeugt Bilder, laut Preisübersicht auch in Business und Enterprise. Biwak erzeugt keine Bilder und liest gescannte Belege ohne Textebene nicht.

Die Frage ist also weniger „Chat oder Biwak?“ als „Welche Arbeit liegt an?“. Für Fragen, Entwürfe und Recherche reicht ein Chat. Sobald eine Aufgabe aus Dateien besteht, die gelesen, verändert, abgelegt und nachgerechnet werden müssen, lohnt sich der Arbeitsordner. Einen Vergleich der geschäftlichen ChatGPT-Pläne mit Biwak finden Sie unter Biwak oder ChatGPT.

Selbst ausprobieren: ein erster Auftrag mit Probe

  1. Herunterladen

    Biwak gibt es für macOS und Windows auf der Seite Download. Die App ist kostenlos, Modellaufträge laufen über ein Biwak-Konto.

  2. Konto anlegen

    Nach der E-Mail-Bestätigung gibt es einmalig 100 Test-Credits, ohne Zahlungsdaten. Konto anlegen.

  3. Einen Ordner mit Kopien anlegen

    Etwa drei PDF-Rechnungen oder einen Tabellenexport, und diesen Ordner in Biwak als Arbeitsordner wählen.

  4. Den Auftrag mit einer Probe schreiben

    Sagen Sie, woran sich das Ergebnis prüfen lässt: „Übertrage alle Rechnungen in eine Tabelle und prüfe, ob die Summe der Nettobeträge zu den Einzelrechnungen passt.“

  5. Ergebnis prüfen

    Die neue Datei erscheint als Karte mit Vorschau. Stimmt etwas nicht, setzen Sie den Ordner mit „Rückgängig machen“ zurück.

Weitere Ideen für den Anfang stehen im Artikel Ein guter erster Auftrag. Danach gibt es zwei Tarife: Basislager für 19 € und Seilschaft für 99 € im Monat, beide monatlich kündbar (Preise im Überblick). Lieber erst zusehen? In einer Vorführung von zwanzig Minuten arbeiten wir an einer echten Aufgabe aus Ihrem Alltag.

Wie dieser Vergleich entstand

Diesen Text hat Biwak geschrieben, also ein Anbieter in eigener Sache; einen unabhängigen Test ersetzt er nicht. Die Angaben zu ChatGPT, Codex und Claude Code stammen aus den Hilfe- und Dokumentationsseiten der Hersteller und wurden am 24. September 2026 am Wortlaut geprüft. Die Hilfeseiten von OpenAI lassen sich nicht automatisch abrufen; dort haben wir die Kopien im Internet Archive vom 2., 15., 17. und 18. September 2026 gelesen. Die Angaben zu Biwak stammen aus Datenschutzerklärung, AGB und dem Quelltext der App. Die Befehle im Protokoll sind am 24. September 2026 auf einem MacBook Pro mit M1 Pro gelaufen, mit erfundenen Beispieldaten und ohne Sprachmodell. Die Grafik zu den Handgriffen ist ein Schema. Einen Leistungsvergleich zwischen ChatGPT und Biwak haben wir nicht gemacht. Fehler melden Sie bitte an kontakt@biwak.ai.

Häufige Fragen

Führt Biwak Befehle aus, ohne vorher zu fragen?

Ja. Innerhalb eines Auftrags führt der Agent seine Befehle selbst aus, das ist der Sinn eines Agenten. Schutz bieten der Sicherungspunkt vor jedem Auftrag und die zwei Schalter in den Einstellungen, mit denen Sie Terminalbefehle und Internetzugriff abschalten. Ohne Terminalbefehle führt der Agent keine Befehle und Skripte mehr aus.

Muss ich das Terminal selbst bedienen können?

Nein. Sie schreiben den Auftrag in normalen Sätzen, so wie Sie ihn einer Kollegin geben würden. Die Befehle wählt der Agent. Hinterher sehen Sie die neuen und geänderten Dateien mit Vorschau und können den Ordner zurücksetzen.

Läuft die KI dann auf meinem Rechner?

Nein. Die Befehle laufen auf Ihrem Rechner, das Sprachmodell rechnet beim Anbieter. Gerechnet wird in der EU. Für neue Modellaufträge braucht Biwak deshalb eine Internetverbindung; Ihre Dateien und die Sicherungspunkte bleiben auf Ihrem Gerät.

Kann ChatGPT nicht auch Dateien auf meinem Rechner bearbeiten?

Teilweise. Codex CLI von OpenAI arbeitet für Entwickler auf dem eigenen Rechner, und ChatGPT Work kann in den Plänen Business und Enterprise freigegebene Dateien und Programme nutzen. Im Chat im Browser arbeitet ChatGPT mit hochgeladenen Kopien oder mit Dateien aus verbundenen Diensten wie Google Drive, OneDrive und SharePoint. Einen genaueren Vergleich der Geschäftspläne finden Sie unter Biwak oder ChatGPT.

Was kostet es, das auszuprobieren?

Die App ist kostenlos. Nach der E-Mail-Bestätigung gibt es einmalig 100 Test-Credits, ohne Zahlungsdaten. Danach kostet Basislager 19 € und Seilschaft 99 € im Monat, jeweils monatlich kündbar.

Quellen

  1. OpenAI: Data analysis with ChatGPT (Hilfeseite, gelesen als Kopie im Internet Archive vom 15. September 2026)
  2. OpenAI: File Uploads FAQ, Grenzen für Uploads (gelesen als Kopie im Internet Archive vom 18. September 2026)
  3. OpenAI: ChatGPT agent, Hinweis auf die Einstellung (gelesen als Kopie vom 2. September 2026)
  4. OpenAI: Introducing ChatGPT agent, 17. Juli 2025 (gelesen als Kopie im Internet Archive)
  5. OpenAI: ChatGPT Business und Enterprise, Pläne und Preise (gelesen als Kopie im Internet Archive vom 17. September 2026)
  6. OpenAI: ChatGPT Work local security, lokale Aufgaben und was übertragen wird (ohne Datum, geprüft am 24. September 2026)
  7. OpenAI: Codex CLI auf GitHub (geprüft am 24. September 2026)
  8. Anthropic: Claude Code overview (ohne Datum, geprüft am 24. September 2026)
  9. Stack Overflow: Developer Survey 2025, Abschnitt AI (Befragung Mai bis Juni 2025)
  10. Biwak: Datenschutzerklärung, Abschnitt 14 (Anfragen an ein Sprachmodell)
  11. Biwak: Allgemeine Geschäftsbedingungen, § 2 und § 9

Weiterlesen

Alle Artikel