1. Was ist TaskiAI
TaskiAI ist ein optionaler in Taski integrierter KI-Assistent, verfügbar in zwei unterschiedlichen Modi:
- Inline-Modus (
@TaskiAI): explizit aufrufbar in 1-zu-1-Chats mit anderen Personen (in Gruppen deaktiviert). Antworten sind für beide Chat-Teilnehmer sichtbar. Abgedeckt durch die Abschnitte 2-15 dieses Dokuments. - Dedizierter Chat-Modus: ein privater 1-zu-1-Chat zwischen dem Nutzer und dem Assistenten, erreichbar über die Chat-Liste (Eintrag "Taski AI"). Keine dritte Person ist beteiligt: Nachrichten und Antworten sind nur für den Nutzer sichtbar. Abgedeckt durch Abschnitt 16.
In beiden Modi wird der Dienst von Anthropic über die Modelle Claude Sonnet 5, Claude Opus 4.7 und Claude Haiku 4.5 (siehe Abschnitt 6) bereitgestellt sowie von OpenAI (gpt-image-2.5-flare) für die Generierung und Bearbeitung von Bildern, wenn der Nutzer dies ausdrücklich anfordert.
Viele der in diesem Dokument beschriebenen Nutzungslimits (Nachrichten, Bilder, Web-Suchen, Sprachanrufe) hängen vom Tarif des Kontos ab: Free (kostenlos) oder Taski Plus (kostenpflichtiges Abonnement). Wo zutreffend, nennt dieses Dokument beide Werte.
2. Ausnahme vom E2EE-Modell
Wichtig. TaskiAI ist die einzige Funktion, die — wenn aktiviert — eine Ausnahme vom Ende-zu-Ende-Verschlüsselungsmodell darstellt. Um die Frage des Nutzers zu beantworten, muss ein externer KI-Dienst den Kontext des Gesprächs lesen können. Der gesamte Rest der Aktivität des Nutzers in Taski (Nachrichten, Anrufe, Medien) bleibt Ende-zu-Ende-verschlüsselt und für uns sowie Dritte unlesbar.
3. Was mit Anthropic geteilt wird
Folgende Daten werden nur zum Zeitpunkt des expliziten Aufrufs von @TaskiAI an den KI-Anbieter übermittelt:
- Die letzten 20 Nachrichten des aktuellen Gesprächs, nur in Übertragung entschlüsselt. Befinden sich darunter Standorte, erhält das Modell auch die entsprechenden Koordinaten: beim Live-Standort nur den Ausgangspunkt und die Dauer aus der Startnachricht, niemals die nachfolgenden Aktualisierungen; bei der Funktion „Vertrauenswürdiger Kontakt“ die Standortanfragen und den Standort, den das Telefon der angefragten Person als Antwort gesendet hat (mit Genauigkeit, Zeitpunkt der Ermittlung und Akkustand).
- Maximal 3 aktuelle Fotos aus dem Kontext, auf 768px komprimiert und von Claude Haiku 4.5 als Text beschrieben. Die generierten Bildunterschriften werden für 14 Tage pro Gespräch gecacht, um teure Neuverarbeitungen zu vermeiden.
- Der Anzeigename des Nutzers zur korrekten Zuordnung der Anfrage.
- Die explizite Frage, die der Nutzer nach
@TaskiAIgeschrieben hat.
Die Long-Press-Aktionen „Erklären“ und „Vorschlagen“ senden die ausgewählte Nachricht und als Kontext dieselben letzten 20 Nachrichten, einschließlich Standorten.
4. Was wir NICHT tun
- ❌ Der Server archiviert niemals den Klartext der Nachrichten oder Fotos aus dem Kontext im Ruhezustand. Er sieht ihn nur in Übertragung, wie ein Proxy. (Ausgenommen sind die von der KI generierten Antworten sowie die von ihr generierten oder bearbeiteten Bilder, siehe Abschnitte 11 und 14.)
- ❌ Anthropic verwendet die Daten der Nutzer nicht zum Trainieren der eigenen Modelle (vertragliche Anthropic-Richtlinie).
- ❌ TaskiAI wird niemals automatisch aufgerufen: nur wenn der Nutzer
@TaskiAIschreibt oder die Aktionen „TaskiAI fragen" per Long-Press auf eine Nachricht verwendet. - ❌ Kein Foto wird gesendet, wenn in den letzten 20 Nachrichten keine vorhanden sind.
- ❌ In Gruppen ist TaskiAI deaktiviert by Design: Die Entscheidung, den Kontext zu teilen, muss einstimmig sein, und das Aufrechterhalten der bilateralen Zustimmung ist in einer Gruppe zu fragil.
5. Speicher pro Chat
TaskiAI kann sich an relevante Fakten erinnern, die im Gespräch aufgekommen sind (z. B. „Stefano hat Zöliakie"), um die nachfolgenden Antworten nützlicher zu gestalten.
- Scope pro Chat: Die Fakten eines Gesprächs sind niemals in anderen sichtbar. Der Speicher ist nach (Nutzer, Chat) isoliert.
- Lokaler Speicher + verschlüsselte Synchronisierung: Die Fakten werden auf dem Gerät des Nutzers gespeichert (SwiftData auf iOS, IndexedDB im Web, lokale Datei auf Android) und zwischen den Geräten des Nutzers über Cloudflare KV in Ende-zu-Ende-verschlüsselter AES-256-GCM-Form synchronisiert. Der Schlüssel leitet sich vom privaten Schlüssel des Nutzers über HKDF ab (salt = SHA256(convId), info = „taski-ai-memory:v1"). Der Server speichert nur verschlüsselte Daten, die er nicht lesen kann.
- Automatische Extraktion: Claude Haiku 4.5 extrahiert nach jeder Antwort Fakten aus dem Kontext. Cap: 50 Fakten / 2KB pro Chat mit deterministischer score-basierter Compaction.
- Explizite Befehle: „merke dir, dass..." fügt einen Fakt mit userStated-Flag hinzu (von Auto-Compaction ausgeschlossen). „vergiss..." entfernt einen Fakt.
- Vollständige Kontrolle: Der Speicher kann deaktiviert werden; einzelne Fakten lassen sich aus dem Chat-Profil → TaskiAI-Speicher anzeigen und löschen.
- Dauer der synchronisierten Kopie: Die verschlüsselte Kopie auf Cloudflare KV verfällt nach 90 Tagen ohne Aktualisierung.
6. Verwendete Modelle
- Claude Sonnet 5 (Anthropic): konversationelle Antworten, Inline-Befehle, Aktion „Erklären“, Übersetzung mit AI Rewrite, Entscheidung zur Aktivierung der Tools für Bildgenerierung und Bildbearbeitung.
- Claude Opus 4.7 (Anthropic): fortgeschrittenes Reasoning, nur auf ausdrückliche Anfrage des Nutzers verwendet (z. B. „denk genauer nach", „nutze ein leistungsfähigeres Modell") und innerhalb des dafür vorgesehenen Tageskontingents (siehe Abschnitt 13).
- Claude Haiku 4.5 (Anthropic): kurze oder einfache Antworten im dedizierten Chat, Schnellaktionen Übersetzen/Korrigieren/Vorschlagen, AI Rewrite (außer Übersetzung), Faktenextraktion für Speicher, Beschreibung von Kontext-Fotos, Double-Check der Moderation, Speicher-Extraktion nach Sprachanruf (siehe Abschnitt 16.5).
- gpt-image-2.5-flare (OpenAI, mit gpt-image-2 als Fallback): Generierung und Bearbeitung von Bildern auf ausdrückliche Anfrage des Nutzers (siehe Abschnitt 14).
- gpt-image-2.5-flare und gpt-image-1 (OpenAI): KI-Sticker (siehe Abschnitt 18).
- gpt-realtime-2.1 + gpt-4o-mini-transcribe (OpenAI Realtime API): Full-Duplex-Sprachanruf mit dem dedizierten Chatbot (siehe Abschnitt 16.5).
- Tavily: Web-Suche während des Sprachanrufs mit dem dedizierten Chatbot (siehe Abschnitt 16.5).
Das tatsächlich verwendete Modell kann sich im Laufe der Zeit ändern, um die Qualität zu verbessern oder Kosten zu reduzieren, stets innerhalb der oben aufgeführten Anbieter (Anthropic für Sprachmodelle, OpenAI für Bilder und Echtzeit-Sprache, Tavily für die Web-Suche per Sprache).
7. Opt-out
TaskiAI kann vollständig deaktiviert werden in:
- iOS: Einstellungen → Datenschutz → TaskiAI
- Android: Einstellungen → Datenschutz → TaskiAI
- Web/Desktop: Einstellungen → Datenschutz → TaskiAI
Sobald auch nur einer der Teilnehmer eines 1-zu-1-Chats das Opt-out aktiviert hat, werden die @TaskiAI-Erwähnungen in diesem Chat vom Server abgelehnt.
8. Obligatorische Vor-Aufruf-Disclosure
Beim ersten Aufruf von TaskiAI in einem Chat zeigt die App eine Disclosure-Bildschirmseite an, die erklärt, was geteilt werden wird (einschließlich der Aktualisierung der 20 Nachrichten und der 3 Fotos). Eine Bestätigung ist erforderlich, um fortzufahren. Die Bestätigung wird lokal gespeichert; wenn die Bedingungen für das Teilen aktualisiert werden (z. B. ändert sich die Anzahl der Nachrichten oder Fotos), wird die Disclosure erneut angezeigt.
9. UX: Skip Push der Nutzer-Nachricht
Beim Senden von @TaskiAI ... erhält der andere Teilnehmer keine Push-Benachrichtigung der Nachricht des Nutzers (um Spam zu vermeiden). Stattdessen wird nur die Push der KI-Antwort empfangen, mit dediziertem Avatar von TaskiAI. Dies reduziert das Rauschen im geteilten Chat.
10. Adressbuch-Kontext im Prompt
Damit TaskiAI die Teilnehmer korrekt referenzieren kann, werden die 20 Kontext-Nachrichten mit Namen aus dem Adressbuch des Geräts an das Modell übergeben (lokal auf dem Gerät des Nutzers vor dem Versand aufgelöst), anstatt mit numerischen userIds. Dies verbessert die Qualität der Antworten, bedeutet aber, dass Anthropic die Namen so sieht, wie sie im Adressbuch des Nutzers erscheinen.
11. Datenaufbewahrung
- Kontext-Nachrichten: nicht vom Taski-Server persistiert. Um Latenz und Kosten zu reduzieren, kann Anthropic sie vorübergehend für höchstens 1 Stunde zwischenspeichern (Prompt Caching), danach werden sie verworfen; sie werden nicht für das Training verwendet.
- Fotos: nicht persistiert. Nur die generierten Bildunterschriften (Text) werden für 14 Tage pro Chat in Cloudflare KV gecacht.
- KI-Antworten: normal in den Chat-Nachrichten persistiert (für beide Teilnehmer sichtbar, mit Etikett „✨ TaskiAI"). Sind nicht E2EE-verschlüsselt, da der Server sie generiert hat; sie sind durch TLS in Übertragung und Verschlüsselung im Ruhezustand geschützt.
- Speicher: auf dem Gerät des Nutzers (siehe Abschnitt 5). KV-Synchronisierung nur als Ciphertext, falls aktiv.
12. KI-Auftragsverarbeiter
KI-Daten werden von drei unterschiedlichen Auftragsverarbeitern verarbeitet, jeder für eine spezifische Aufgabe:
- Anthropic (Claude Sonnet 5 / Opus / Haiku 4.5): konversationelle Antworten, Speicher-Extraktion, Beschreibung von Kontext-Fotos, Double-Check der Moderation, Entscheidung zur Aktivierung des Bildgenerierungs-Tools.
- Privacy Policy: anthropic.com/legal/privacy
- Acceptable Use Policy: anthropic.com/legal/aup
- Commercial Terms: anthropic.com/legal/commercial-terms
- OpenAI: mehrere verschiedene Verwendungen.
- gpt-image-2.5-flare (Fallback gpt-image-2) — Bildgenerierung, wenn der Nutzer dies explizit anfordert. Erhält ausschließlich den Text-Prompt, den Claude erstellt hat (auf Englisch, max. 1000 Zeichen), nicht die ursprünglichen Chat-Nachrichten oder Fotos.
- gpt-image-2.5-flare (Fallback gpt-image-2) — Fotobearbeitung auf ausdrückliche Anfrage. Erhält das zu bearbeitende Foto und die Bearbeitungsanweisungen (siehe Abschnitt 14.1).
- gpt-image-2.5-flare / gpt-image-1 — KI-Sticker, einschließlich des Quellfotos im Modus „Foto → Sticker“ (siehe Abschnitt 18).
- gpt-realtime-2.1 + gpt-4o-mini-transcribe (Realtime API) — Full-Duplex-Sprachanruf mit dem dedizierten Chatbot. Erhält PCM16-Audio-Streaming, die für Turn-Detection generierten Transkripte, eventuell vom Nutzer während des Anrufs gesendete Fotos (max. 768px, JPEG) und ein initiales System-Prompt mit Nutzername, aktuellem Datum/Uhrzeit und dem lokalen Speicher des Chatbots. Wenn der Anruf aus dem dedizierten Chat gestartet wird, enthält das System-Prompt auch die letzten 5 Textnachrichten aus diesem Chat als passiven Referenzkontext (die KI kennt sie, erwähnt sie aber nur, wenn der Nutzer ausdrücklich darauf Bezug nimmt). Details in Abschnitt 16.5.
- Privacy Policy: openai.com/policies/privacy-policy
- Business Terms: openai.com/policies/business-terms
- Tavily: Web-Suche während des Sprachanrufs mit dem dedizierten Chatbot. Erhält nur die von der KI formulierte Suchanfrage (max. 400 Zeichen) und das aus der Sprache abgeleitete Land, ohne Kennungen des Nutzers.
- Privacy Policy: tavily.com/privacy
Auch die für Moderation und als Fallback eingesetzten Anbieter außerhalb von Anthropic/OpenAI (Cloudflare Workers AI: Llama Guard 3, Flux Schnell) werden nur in den in der Datenschutzerklärung und in der Richtlinie zur akzeptablen Nutzung beschriebenen Fällen tätig.
13. Einschränkungen und Verantwortlichkeit
- Probabilistisch: TaskiAI kann sich irren. Die Antworten ersetzen keine professionellen medizinischen, rechtlichen oder finanziellen Ratschläge.
- No persistent training: Anthropic erklärt, keine Modelle auf den über die API zur Erbringung des Dienstes übermittelten Daten zu trainieren. Bei Sicherheits- oder rechtlichen Anfragen können jedoch transiente Daten zur Identifizierung von Missbrauch analysiert werden.
- Keine Garantie: Der Dienst befindet sich in Beta und wird „as is" bereitgestellt.
Geschwindigkeitslimits (Inline-Modus)
@TaskiAI-Nachrichten: Free 5 pro Tag · Plus 30 pro Tag und Nutzer (server-seitiges Limit, rollierendes 24h-Fenster).- „TaskiAI fragen"-Aktionen per Long-Press (Erklären, Übersetzen, Korrigieren, Vorschlagen): Free 5 pro Tag · Plus 30 pro Tag und Nutzer.
- AI Rewrite (Umschreiben des Entwurfs, siehe Abschnitt 18): Free 5 pro Tag · Plus 30 pro Tag und Nutzer.
- Fortgeschrittenes Reasoning (Claude Opus): Free 1 pro Tag · Plus 5 pro Tag und Nutzer. Kontingent gemeinsam mit dem dedizierten Chat-Modus genutzt (Abschnitt 16.8).
14. Bildgenerierung
Wenn der Nutzer TaskiAI mit einer expliziten Anfrage zur Bildgenerierung aufruft (z. B. „@TaskiAI zeichne mir einen Sonnenuntergang"), kann Claude Sonnet 5 ein internes generate_image-Tool aufrufen, das das Bild über einen zweiten KI-Anbieter erzeugt.
Was mit OpenAI geteilt wird (Generierung)
- Ausschließlich der Text-Prompt, von Claude auf Englisch erstellt (max. 1000 Zeichen), angereichert mit relevanten Details aus dem Chat-Kontext (Motiv, Stil, Atmosphäre).
- Niemals an OpenAI übermittelt: ursprüngliche Chat-Nachrichten, Fotos, Nutzeridentitäten, conversationId, userId.
- Style + aspect ratio von Claude aus einem vordefinierten Set ausgewählt.
Wo das generierte Bild gespeichert wird
- Das Bild wird im Cloudflare-R2-Bucket unter dem Pfad
ai-generated/{conversationId}/{messageId}.jpgim Klartext gespeichert (nicht Ende-zu-Ende-verschlüsselt). - Den Teilnehmern über signed URL HMAC-SHA256 bereitgestellt, 7 Tage gültig und nicht erneuerbar.
- Für beide Teilnehmer des 1-zu-1-Chats sichtbar, genau wie bei KI-Textantworten (Abschnitt 11).
Aufbewahrung und Löschung
- 7 Tage ab Generierung, wie bei den anderen nicht Ende-zu-Ende-verschlüsselten Inhalten. Automatische Bereinigung über täglichen Cron um 2 Uhr UTC.
- Der Nutzer kann das Bild vor Ablauf manuell in der Galerie seines Geräts speichern, indem er das Bild im Chat antippt.
- Nach Ablauf auf R2 ist das Bild vom Server nicht mehr abrufbar, bleibt aber lokal auf Geräten sichtbar, die es gecacht haben.
Nutzungslimits
- Free: 2 Bilder pro Tag · Plus: 10 pro Tag und Nutzer (globales serverseitiges Cap, gemeinsam genutzt zwischen Inline-Modus und dediziertem Chat sowie zwischen Generierung und Bearbeitung — siehe 14.1 und 16.4). Der Zähler wird täglich um Mitternacht UTC zurückgesetzt.
- Wird das Limit erreicht, benachrichtigt eine lokal generierte Informationsblase den Nutzer. Es wird keine Anfrage an OpenAI gesendet.
Ausnahme vom E2EE-Modell
Generierte Bilder sind nicht Ende-zu-Ende-verschlüsselt, da der Server sie erzeugt. Sie sind dennoch durch TLS in Übertragung und Verschlüsselung im Ruhezustand geschützt (Cloudflare-R2-Server-seitige Verschlüsselung). Dies ist eine unvermeidliche Folge der KI-Funktionalität, analog zu Abschnitt 2 (Ausnahme vom E2EE-Modell).
14.1 Fotobearbeitung
Der Nutzer kann TaskiAI bitten, ein Foto zu bearbeiten (z. B. „@TaskiAI entferne den Hintergrund von diesem Foto“). In diesem Fall kann Claude das interne Tool edit_image aufrufen, das die Pixel des echten Fotos über OpenAI verändert.
- Welches Foto: Im Inline-Modus wird das neueste Foto im Chat-Kontext verwendet, das auch vom anderen Teilnehmer gesendet worden sein kann. Im dedizierten Chat wird das vom Nutzer angehängte Foto verwendet.
- Was OpenAI erhält: das Foto (auf dem Gerät entschlüsselt und im Klartext an den Taski-Server gesendet, während der Übertragung durch TLS geschützt, und von dort an OpenAI) sowie die Bearbeitungsanweisungen. OpenAI erhält keine Chat-Nachrichten, Nutzeridentitäten, conversationId oder userId.
- Ergebnis: Das bearbeitete Foto wird im Klartext (nicht Ende-zu-Ende-verschlüsselt) auf Cloudflare R2 gespeichert und im Chat wie die generierten Bilder angezeigt: Im Inline-Modus ist es für beide Teilnehmer 7 Tage lang sichtbar, im dedizierten Chat 24 Stunden lang.
- Kontingent: Jede Bearbeitung verbraucht eine Generierung aus dem Bildkontingent (Free 2 · Plus 10 pro Tag).
- Verantwortung: Der Nutzer muss berechtigt sein, das Foto zu bearbeiten, und das Bild und die Würde der abgebildeten Personen respektieren (siehe Richtlinie zur akzeptablen Nutzung).
15. Web-Suche
Wenn der Nutzer eine Frage stellt, die aktuelle oder zeitnahe Informationen erfordert (Wetter, Öffnungszeiten, aktuelle Preise, Tagesnachrichten, jüngste Ereignisse), kann Claude Sonnet 5 selbstständig entscheiden, ein von Anthropic bereitgestelltes Web-Suche-Tool aufzurufen, um Informationen aus dem öffentlichen Web abzurufen.
Was übermittelt wird
- Die vom Modell aus der Frage des Nutzers formulierte Suchanfrage, in der Regel auf Englisch zur Optimierung der Ergebnisqualität der Suchmaschine (z.B. „weather forecast May 5 2026"). Die Anfrage wird vom Modell generiert, nicht vom Nutzer geschrieben, und enthält nicht den genauen Standort des Nutzers: Nur das Land (IT) und die Zeitzone (Europe/Rome) werden dem Tool als Lokalisierungsparameter übergeben.
- Das Modell erhält bis zu 5 Ergebnisse pro Anfrage (Titel, URL, Vorschau-Snippet, Seiteninhalt).
- Die Ergebnisse werden als Eingabe im nächsten Claude-Turn einbezogen, um die endgültige Antwort zu erzeugen, die die konsultierten Quellen zitiert.
Anbieter und Lokalisierung
Die Web-Suche wird server-seitig von Anthropic über deren Tool web_search (Brave-Search-Engine) ausgeführt. Anfragen sind standardmäßig auf Italien lokalisiert (country: IT, timezone: Europe/Rome).
Limits und Caps
- Maximal 2 Suchen pro Frage-Turn (server-seitig dem Modell auferlegtes Limit).
- Free: nicht verfügbar (0 Suchen/Tag) · Plus: 15 Suchen pro Tag und Nutzer (server-seitiges Limit, rollendes 24h-Fenster). Bei Free-Konten wird das Tool dem Modell nie exponiert; bei Plus antwortet Claude nach Erreichen des Tageslimits aus seinem Trainingswissen, ohne suchen zu können, bis zum Reset.
- Der iOS-Client spiegelt das Limit für Pre-Empt-UX: Anfragen, die nach Web-Suche aussehen (Schlüsselwörter "suchen", "heute", "morgen", "Wetter", "wie viel kostet"), werden lokal blockiert, wenn das Limit erschöpft ist, um nutzlose Server-Aufrufe zu vermeiden.
Aufbewahrung und Datenschutz
- Suchanfragen und -ergebnisse folgen demselben Zero-Retention-Abkommen mit Anthropic wie Abschnitt 11: kein Training, keine Logs über das für die Antwort Notwendige hinaus.
- Taski loggt keine Suchanfragen, nur einen aggregierten Zähler zur Durchsetzung des Rate-Limits (KV-Schlüssel
ai-websearch:userIdmit 24h-TTL, enthält nur eine Zahl). - Zitate in der endgültigen Antwort (URLs und Titel der konsultierten Sites) sind sowohl für den Nutzer, der
@TaskiAIaufruft, als auch für den anderen Teilnehmer des 1-zu-1-Chats sichtbar (analog zum AI-Antworttext).
16. Dedizierter Chat mit TaskiAI (Chatbot)
Zusätzlich zum oben beschriebenen Inline-Aufruf @TaskiAI ist ein privater 1-zu-1-Chat mit dem Assistenten verfügbar, erreichbar über die Chat-Liste unter "Taski AI". Es handelt sich um ein Gespräch zwischen dem Nutzer und dem Modell, getrennt von jedem anderen Chat: keine dritte Person sieht oder empfängt es.
16.1 Was mit Anthropic geteilt wird
Folgende Daten werden nur während des aktiven Gesprächs an den KI-Anbieter übermittelt:
- Der Textverlauf des dedizierten Chats (Nachrichten des Nutzers und Antworten des Assistenten).
- Fotos und PDF-Dokumente, die der Nutzer im Chat ausdrücklich hochlädt (über die Anhänge-Schaltfläche). Die (verkleinerten) Fotos und die PDFs werden als Dateien an das Antwortmodell gesendet, das sie direkt liest.
- Der persistente Speicher des dedizierten Chats (siehe 16.3), als Kontext im System-Prompt enthalten.
- Der angezeigte Name des Nutzers sowie aktuelles Datum und Uhrzeit zur Personalisierung der Antworten.
Nachrichten aus den anderen Chats des Nutzers (1-zu-1 mit anderen Personen, Gruppen usw.) werden niemals an den Chatbot übermittelt. Der dedizierte Chat ist von der gesamten übrigen Aktivität in Taski isoliert.
16.2 Ausnahme vom E2EE-Modell
Wie im Inline-Modus (Abschnitt 2) ist auch der dedizierte Chat nicht Ende-zu-Ende-verschlüsselt: der Server muss die Inhalte an den KI-Anbieter weiterleiten können, um Antworten zu generieren. Die Nachrichten des dedizierten Chats (Fragen des Nutzers und Antworten der KI) werden bis zu 7 Tage im Klartext auf dem Server aufbewahrt, um dem Modell den Kontext des Gesprächs bereitzustellen; Anhänge werden nicht aufbewahrt. Der Chat ist durch TLS in der Übertragung und Verschlüsselung im Ruhezustand geschützt. Die gesamte übrige Taski-Aktivität (Chats mit anderen Personen, Anrufe, Medien) bleibt E2EE.
16.3 Lokaler persistenter Speicher
- Lokaler Speicher, Ende-zu-Ende-verschlüsselte Synchronisierung: Der Speicher des dedizierten Chats wird lokal auf dem Gerät des Nutzers gespeichert. Wo er zwischen den Geräten des Nutzers synchronisiert wird, geschieht dies ausschließlich in Ende-zu-Ende-verschlüsselter Form (AES-256, Schlüssel aus dem privaten Schlüssel des Nutzers abgeleitet): Der Server speichert nur verschlüsselte Daten, die er nicht lesen kann. Der dedizierte Chat und sein Speicher sind auf iPhone, Android, Web und Desktop verfügbar; Apple Watch hat keinen Zugriff darauf.
- Kapazität: eine begrenzte Anzahl von Fakten pro Chat, mit Deduplizierung und automatischer Speicherplatzverwaltung.
- Automatische Extraktion: Claude Haiku 4.5 extrahiert relevante Fakten nach jeder Antwort des Assistenten (bei Anhängen aus Latenzgründen übersprungen).
- Explizite Befehle: "merke dir, dass…" erzwingt eine Hinzufügung, "vergiss…" entfernt einen bestimmten Fakt.
- Volle Kontrolle: über den Bildschirm des dedizierten Chats kann der Nutzer "TaskiAI-Speicher" öffnen, die vollständige Liste einsehen, einzelne Fakten löschen oder alles löschen.
- Übertragung an den Server: Bei der Aufrufung wird der Speicher als Teil des Prompts an den Server gesendet (für die Antwort des KI-Modells erforderlich) und vom Taski-Server nicht im Klartext gespeichert (Anthropic kann ihn für max. 1 Stunde zwischenspeichern, siehe Abschnitt 11); eine etwaige geräteübergreifende Synchronisierung erfolgt nur in Ende-zu-Ende-verschlüsselter Form (siehe oben).
16.4 Bildgenerierung
Wenn der Nutzer ausdrücklich die Generierung eines Bildes anfordert (z. B. "zeichne mir…"), kann der Chatbot dasselbe in Abschnitt 14 beschriebene generate_image-Tool aufrufen, mit folgenden Unterschieden:
- Nutzungslimit: Free 2 Bilder pro Tag · Plus 10 pro Tag — derselbe gemeinsame Zähler wie im Inline-Modus (Abschnitt 14): kein zusätzliches Limit, sondern dasselbe Tages-Cap pro Nutzer, unabhängig davon, wo das Bild generiert wird.
- Speicherung: die Bilder werden im Cloudflare R2-Bucket unter
ai-chatbot/{userId}/{messageId}.jpgin Klartext gespeichert (nicht Ende-zu-Ende-verschlüsselt), mit einer TTL von 24 Stunden. - Lokaler Cache: nach der Generierung lädt die App das Bild herunter und behält eine lokale Kopie auf dem Gerät, die auch nach Ablauf in R2 erhalten bleibt. Der Nutzer kann das Bild im Foto-Album speichern, teilen oder per Long-Press kopieren.
- Was OpenAI erhält: identisch mit Abschnitt 14 — nur das von Claude erstellte Text-Prompt (max. 1000 Zeichen, auf Englisch), nicht der Chat-Verlauf oder andere Fotos. Für die Bearbeitung eines angehängten Fotos gilt Abschnitt 14.1.
16.5 Sprachanruf mit dem Chatbot
Vom Bildschirm des dedizierten Chats aus kann der Nutzer einen Full-Duplex-Sprachanruf mit TaskiAI starten, indem er auf das Telefon-Symbol in der Kopfzeile tippt. Das Gespräch läuft in Echtzeit über die OpenAI Realtime API; der Taski-Server fungiert als WebSocket-Proxy zwischen dem Gerät des Nutzers und OpenAI, ohne das Audio zu speichern.
Was während des Anrufs mit OpenAI geteilt wird
- Mikrofon-Audio im Format PCM16 mono 24 kHz, kontinuierlich für die Dauer des Anrufs gestreamt.
- Transkripte, die von
gpt-4o-mini-transcribe(Nutzer-Eingabe) und vom Modellgpt-realtime-2.1(KI-Antwort) erzeugt werden, um natürliche Unterbrechungen und Turn-Detection (Server VAD) zu ermöglichen. - Vom Nutzer während des Anrufs gesendete Fotos: über die Kamera-Schaltfläche in der App kann der Nutzer ein Foto aufnehmen oder eines aus der Galerie auswählen und es während des laufenden Anrufs an die KI senden. Das Foto wird auf max. 768px (längste Kante) skaliert, JPEG-komprimiert und mit niedrigem Detail als
input_imageüber den Realtime-Kanal an OpenAI übertragen. Die KI kann es sehen und per Stimme kommentieren. Der Client erlaubt jeweils ein Foto gleichzeitig (ein weiterer Versand wird blockiert, bis der Empfang des vorherigen bestätigt wurde); es gibt keine numerische Obergrenze pro Anruf. Kein Foto wird automatisch gesendet: jeder Versand erfordert eine explizite Aktion des Nutzers. - Initiales System-Prompt: enthält den Namen des Nutzers, aktuelles Datum/Uhrzeit, die während des Anrufs aktiven reduzierten Capabilities sowie den lokalen persistenten Speicher des Chatbots (Abschnitt 16.3) als Kontext.
- Letzte 5 Nachrichten aus dem Text-Chat (nur wenn der Anruf aus dem dedizierten Chat gestartet wird): um die Gesprächskontinuität zwischen Text- und Sprachmodus zu ermöglichen, sendet das Gerät beim Starten des Sprachanrufs durch Antippen des Telefonsymbols im Header des dedizierten Chats die letzten 5 Textnachrichten dieses Chats an den Server (Rolle + Text, max. 1900 Zeichen pro Nachricht). Der Server bettet sie in die Sitzungs-
instructionsals "RECENT TEXT CHAT CONTEXT (PASSIVE BACKGROUND REFERENCE ONLY)"-Block mit expliziten Regeln für das Modell ein: diese Themen nicht von sich aus aufgreifen, nicht in der Begrüßung zusammenfassen, warten bis der Nutzer zuerst spricht, sie nur verwenden, wenn der Nutzer ausdrücklich darauf Bezug nimmt. Wenn der Nutzer den Anruf von einem anderen Einstiegspunkt aus startet (iOS-Anrufliste, Widget, etc.) wird keine Kontextnachricht gesendet. Die 5 Nachrichten werden nicht zu Turns des Sprachgesprächs und fließen nicht in die an Claude Haiku 4.5 für die Speicherextraktion nach dem Anruf übergebenen Transkripte ein.
Stimme des Assistenten
Die KI spricht mit der OpenAI-Stimme "marin" (mehrsprachig auto-match). Die Auswahl ist serverseitig fest und vom Nutzer nicht konfigurierbar.
Reduzierte Capabilities während des Anrufs
Im Sprachmodus kann TaskiAI keine Bilder generieren und keine PDFs/Dokumente erstellen: dafür wird der Nutzer nach Beendigung des Anrufs an den Text-Chat verwiesen. Sie kann: während des Anrufs Fotos vom Nutzer empfangen (siehe oben) und sie per Stimme kommentieren; Memos anlegen und Nachrichten via dedizierte Tools planen; im Web suchen (siehe unten). Der persistente Speicher wird zwischen den beiden Modi geteilt.
Web-Suche während des Anrufs
Wenn aktuelle Informationen benötigt werden (Nachrichten, Wetter, Öffnungszeiten, Preise), kann die KI eine Web-Suche über Tavily durchführen und kündigt dies per Stimme an. An Tavily werden nur die von der KI formulierte Suchanfrage (max. 400 Zeichen) und das aus der Sprache abgeleitete Land gesendet, ohne Kennungen des Nutzers. Höchstens 3 Suchen pro Anruf. Taski speichert die Suchanfragen nicht.
Speicher-Extraktion nach dem Anruf
Am Ende des Anrufs werden die akkumulierten Transkripte (Cap 8000 Zeichen) einmalig an Claude Haiku 4.5 (Anthropic) gesendet, um eventuelle relevante Fakten zur Aufnahme in den lokalen persistenten Speicher des Nutzers (Abschnitt 16.3) zu extrahieren. Die Fakten werden auf dem Gerät über WebSocket angewendet. Die Transkripte werden vom Taski-Server nicht im Ruhezustand persistiert.
Datenaufbewahrung
- Audio: niemals persistiert — nur in Übertragung über den WebSocket-Proxy Taski → OpenAI.
- Während des Anrufs gesendete Fotos: niemals auf dem Taski-Server persistiert. Innerhalb der Realtime-Nachricht an OpenAI übertragen und anschließend verworfen. Auf dem Gerät des Nutzers verbleiben sie nur dann im lokalen Player-Cache, wenn er sie über die In-App-Kamera aufgenommen hat.
- Transkripte: im Speicher des Durable Objects während der Sitzung gehalten (Cap 8000 Zeichen, FIFO). Am Ende werden sie (a) an Claude Haiku 4.5 zur Speicher-Extraktion gesendet und (b) in einer einzigen TaskiAI-Nachricht aggregiert im Format
*Du:* ... *TaskiAI:* ...in den dedizierten Chat eingefügt und dem Nutzer als normale Nachricht angezeigt. Wie die anderen Nachrichten des dedizierten Chats verbleibt diese Nachricht bis zu 7 Tage auf dem Server (siehe 16.9). - OpenAI kann Audio und Transkripte gemäß seiner eigenen Richtlinie vorübergehend speichern. OpenAI erklärt, dass keine Modelle auf API-Daten zu Service-Zwecken trainiert werden.
- Bubble „Anruf beendet": am Ende der Sitzung wird eine Systemnachricht (Dauer, Ergebnis) im Chat eingefügt, analog zu Sprachanrufen zwischen Nutzern. Normal im lokalen Verlauf des dedizierten Chats persistiert.
Nutzungslimit
- Free: 2 Minuten / 24 Stunden · Plus: 30 Minuten / 24 Stunden pro Nutzer (getrennt von den Limits für Nachrichten/Bilder/Dokumente). Der Zähler wird in Cloudflare KV (
ai-voice-mins:{userId}, TTL 24h) persistiert und automatisch zurückgesetzt. - Um einen Anruf zu starten, sind mindestens 30 Sekunden verbleibendes Kontingent erforderlich.
- Wenn das Kontingent erschöpft ist, erzwingt der Server das Schließen der Sitzung und der Nutzer sieht eine Informations-Bubble.
Ausnahme vom E2EE-Modell
Das Audio des Anrufs ist nicht Ende-zu-Ende-verschlüsselt: es muss von OpenAI verarbeitet werden können, um die Antwort zu generieren. Es ist durch TLS in Übertragung geschützt (sowohl Client → Taski als auch Taski → OpenAI) und wird nicht im Ruhezustand persistiert. Alle anderen Taski-Anrufe (1-zu-1 und Gruppe) bleiben Ende-zu-Ende-verschlüsselt über SRTP/AES-GCM.
Verfügbarkeit
Der Sprachanruf mit dem Chatbot ist auf iPhone und Android verfügbar, ausschließlich im dedizierten Chat. Web, Desktop und Apple Watch haben keinen Zugriff auf diese Funktion.
16.6 Generierte Dokumente (PDF)
Wenn der Nutzer es ausdrücklich anfordert, kann der Chatbot ein PDF-Dokument erzeugen (z. B. Rezept, Liste, Zusammenfassung). Das PDF wird lokal auf dem Gerät von der App aus dem vom Modell zurückgegebenen Text generiert und im Ordner Documents/AIChatPDFs/ zwischengespeichert. Es wird niemals an OpenAI oder andere Anbieter gesendet: die Generierung erfolgt vollständig clientseitig. Tippen auf die Bubble → Quick-Look-Vorschau mit System-Schaltflächen zum Teilen und Speichern.
16.7 Vom Nutzer hochgeladene Fotos und Dokumente
- Fotos: verkleinert und als Bild an das Antwortmodell von Anthropic gesendet. Fotos werden lokal auf dem Gerät zwischengespeichert für die spätere Anzeige. Bittet der Nutzer darum, sie zu bearbeiten, wird das Foto auch an OpenAI gesendet (Abschnitt 14.1).
- PDF-Dokumente: als Datei an das Antwortmodell von Anthropic gesendet, das ihren Inhalt liest.
- Weder vom Nutzer hochgeladene Fotos noch Dokumente werden vom Taski-Server im Ruhezustand gespeichert (im Verlauf bleibt nur die vom Nutzer geschriebene Bildunterschrift oder die Angabe des Anhangtyps).
16.8 Geschwindigkeitslimits
- Nachrichten: Free 3 pro Tag · Plus 15 pro Tag und Nutzer (server- und clientseitiges Rate-Limit, rollierendes 24h-Fenster). Bei Erreichen warnt ein Banner den Nutzer und blockiert das Senden vorübergehend.
- Hochgeladene Dokumente: 5 Dokumente pro Tag und Nutzer.
- Generierte Bilder: Free 2 pro Tag · Plus 10 pro Tag — derselbe gemeinsame Zähler wie im Inline-Modus (siehe 16.4).
- Sprachanruf: Free 2 Minuten · Plus 30 Minuten, alle 24 Stunden, pro Nutzer (siehe 16.5). Server-seitiges Cap, persistiert in Cloudflare KV.
- Fortgeschrittenes Reasoning (Claude Opus): Free 1 pro Tag · Plus 5 pro Tag und Nutzer — Kontingent gemeinsam mit dem Inline-Modus genutzt (Abschnitt 13).
Diese Limits sind unabhängig voneinander und werden serverseitig durchgesetzt; die App hält nur eine lokale Kopie vor, um den Nutzer vorab zu warnen.
16.9 Datenaufbewahrung
- Verlauf des dedizierten Chats: auf dem Gerät des Nutzers (lokale Datenbank der App) bis zum Logout, zur Kontolöschung oder zum manuellen Leeren des Chats. Auf dem Server verbleiben die Nachrichten (Text der Fragen und Antworten, ohne Anhänge) bis zu 7 Tage im Klartext und werden danach automatisch gelöscht; bei Löschung des Kontos werden sie sofort gelöscht.
- Speicher: lokale Datei, mit einer etwaigen E2EE-verschlüsselten synchronisierten Kopie, die nach 90 Tagen ohne Aktualisierung verfällt (siehe 16.3 und 5).
- Generierte Bilder (R2): 24 Stunden, danach automatische Bereinigung über täglichen Cron-Job.
- Generierte PDFs: lokaler App-Cache bis zum Logout oder zur manuellen Löschung.
- Sprachanruf-Audio: niemals persistiert (siehe 16.5).
- Vorübergehende Übertragung: Anthropic und OpenAI können Daten gemäß ihren jeweiligen Richtlinien vorübergehend speichern (siehe Abschnitt 12). Anthropic und OpenAI erklären, keine Modelle auf API-Daten zu trainieren.
16.10 Plattformverfügbarkeit
Der dedizierte Chat (Nachrichten, Anhänge und Speicher) ist auf iPhone, Android, Web und Desktop verfügbar. Der Sprachanruf mit dem Chatbot ist nur auf iPhone und Android verfügbar. Apple Watch hat keinen Zugriff auf den dedizierten Chatbot.
16.11 Opt-out
Der globale TaskiAI-Opt-out aus Abschnitt 7 (Einstellungen → Datenschutz → TaskiAI) deaktiviert sowohl den Inline-Modus als auch den dedizierten Chat (Text und Sprache). Alternativ reicht es, den dedizierten Chat nie zu öffnen oder den Sprachanruf nie zu starten: es wird keine Anfrage an die KI-Anbieter gesendet, bis der Nutzer ausdrücklich interagiert.
17. Per Stimme geplante Nachrichten
Während eines Sprachanrufs mit TaskiAI kann der Nutzer den Assistenten bitten, eine zukünftige Nachricht an einen seiner Kontakte zu planen: z.B. "schick Marco morgen um 10 die Nachricht: hallo wie geht's". Aus Transparenzgründen wird der vollständige Ablauf Schritt für Schritt beschrieben.
17.1 Was im Klartext über OpenAI läuft
- Die Stimme des Nutzers wird in Echtzeit von der OpenAI Realtime API auf den OpenAI-Servern im Klartext transkribiert, mit vertraglich Zero-Retention (siehe Abschnitt 12).
- Die KI extrahiert die drei erforderlichen Parameter: Empfängername, Nachrichtentext, zukünftiges Datum/Uhrzeit.
- In diesem Schritt läuft der Nachrichtentext im Klartext durch OpenAI — dies ist unvermeidlich, weil die KI ihn benötigt, um zu verstehen, was zu schreiben ist und ihn korrekt zu strukturieren.
17.2 Was auf dem Gerät passiert
- Das Gerät des Nutzers erhält die extrahierten Parameter.
- Es identifiziert den entsprechenden Taski-Kontakt im lokalen Adressbuch (textueller Abgleich, ohne Berücksichtigung von Groß-/Kleinschreibung, gegen Kontakte mit denen bereits ein 1-1 Chat existiert).
- Es bereitet die Nachricht im Klartext lokal vor.
17.3 E2EE-Verschlüsselung vor dem Senden an den Taski-Server
- Vor dem Senden an den Server wird die Nachricht mit AES-256-GCM und einem gemeinsamen symmetrischen Schlüssel via X25519 end-to-end verschlüsselt, genau wie eine normale Nachricht.
- Der Taski-Server erhält nur die verschlüsselte Version, gespeichert in der Tabelle
scheduled_messages. - Zur geplanten Zeit liefert ein Server-Cronjob die verschlüsselte Nachricht über WebSocket oder Push an den Empfänger.
- Der Empfänger entschlüsselt die Nachricht auf seinem eigenen Gerät: der Taski-Server hat nie Zugriff auf den Klartext.
17.4 Zusammenfassung zur Vertraulichkeit
OpenAI sieht den Nachrichtentext vorübergehend (weil die Stimme des Nutzers transkribiert und verarbeitet wird, um die Parameter zu extrahieren), aber die endgültige Nachricht erreicht den Empfänger E2EE wie jede andere Taski-Nachricht. Der Taski-Server sieht den Klartext nie. Der KI-Anbieter (OpenAI) sieht ihn nur während der Übertragung für die strikt notwendige Verarbeitungszeit, unter einem Zero-Retention-Vertrag (siehe Abschnitt 12).
17.5 Nutzungsbeschränkungen (MVP)
- Funktioniert nur mit Kontakten, mit denen der Nutzer bereits einen 1-1 Chat offen hat.
- Namensabgleich ist textuell (ohne Groß-/Kleinschreibung, enthält): wenn der Nutzer mehrere Kontakte mit demselben Namen hat, fragt die KI nach genauerer Angabe.
- Nur Text: Fotos, Sprachnachrichten, Videos und Dokumente können derzeit nicht per Stimme geplant werden.
- Datum/Uhrzeit muss in der Zukunft liegen. Die KI berechnet relative Datumsangaben ("morgen um 10", "heute Abend um 8") in der lokalen Zeitzone des Geräts.
17.6 100% E2EE-Alternative ohne KI-Anbieter
Ein Nutzer, der den Nachrichtentext auch nicht vorübergehend über OpenAI laufen lassen möchte, kann jederzeit Nachrichten manuell planen über die Chat-Oberfläche, mit dem Uhren-Symbol in der Eingabeleiste. Die manuelle Planung ist 100% E2EE end-to-end und beinhaltet keinen KI-Anbieter: die Nachricht wird auf dem Gerät verschlüsselt, bevor sie es verlässt, wie jede andere Taski-Nachricht.
17.7 Opt-out
Der globale TaskiAI-Opt-out, beschrieben in Abschnitt 7, deaktiviert auch die Möglichkeit, Nachrichten per Stimme zu planen (der Sprachanruf mit TaskiAI ist nicht mehr verfügbar). Die manuelle Planung aus der Chat-Oberfläche bleibt stets verfügbar und wird vom KI-Opt-out nicht beeinflusst.
18. KI-Sticker und Umschreiben von Nachrichten
18.1 KI-Sticker
- Der Nutzer kann Sticker aus einem Text oder aus einem Foto erstellen. Die Sticker werden von OpenAI generiert (gpt-image-2.5-flare oder gpt-image-1, je nach Stil).
- Im Modus „Foto → Sticker“ wird das Quellfoto im Klartext an den Taski-Server gesendet (durch TLS geschützt) und von dort an OpenAI; der Server speichert es nicht. Der resultierende Sticker wird anschließend wie andere Medien Ende-zu-Ende-verschlüsselt im Chat gesendet.
- Nur für Sticker aus Text wird, falls OpenAI nicht verfügbar ist, ein Fallback verwendet: Claude Haiku 4.5 (Anthropic) bereitet den Prompt vor und Flux Schnell (Cloudflare Workers AI) generiert das Bild. Fotos werden niemals an die Fallback-Anbieter gesendet.
- Limits: Free 1 Sticker · Plus 5 Sticker alle 24 Stunden pro Nutzer. Schlägt die Generierung fehl, wird das Kontingent zurückerstattet.
18.2 AI Rewrite (Umschreiben des Entwurfs)
- Vor dem Senden einer Nachricht kann der Nutzer darum bitten, den Entwurf umzuschreiben: korrigieren, verbessern, förmlicher, lockerer, kürzer oder witziger formulieren oder übersetzen.
- An Anthropic werden nur der Text des Entwurfs (max. 2000 Zeichen) und der gewählte Ton gesendet: Claude Sonnet 5 für die Übersetzung, Claude Haiku 4.5 für die anderen Töne. Der umgeschriebene Entwurf kehrt auf das Gerät zurück; die Nachricht wird, falls gesendet, anschließend wie jede andere Ende-zu-Ende-verschlüsselt übertragen.
- Der Taski-Server speichert weder den ursprünglichen noch den umgeschriebenen Text.
- Limits: Free 5 · Plus 30 Umschreibungen pro Tag und Nutzer.
19. Kontakt
Fragen zu TaskiAI: [email protected]