Google hat Gemini 3.5 Flash veröffentlicht — ein günstiges, schnelles Modell, das pro Million Tokens nur einen Bruchteil dessen kostet, was die Top-Modelle aufrufen. Ab heute in Cortexion verfügbar.
Wofür Gemini 3.5 Flash gemacht ist
Flash-Modelle sind keine Top-Tier-Reasoning-Engines — sie sind die Arbeitspferde für Aufgaben mit viel Volumen und überschaubarer Komplexität. Konkret:
- Klassifikation: 50.000 eingehende Support-Tickets pro Monat in Kategorien einsortieren
- Extraktion: aus 200 PDF-Rechnungen die Beträge, IBANs und Lieferantennamen ziehen — der klassische Buchhaltungs-Workflow
- Echtzeit-Antworten: Chatbot-Erstantwort, der unter einer Sekunde reagieren muss
- Stimmungsanalyse: Bewertungen, Umfrageergebnisse, Social-Media-Mentions
Was es konkret an Performance bringt
Flash 3.5 ist gegenüber 3.0 deutlich schneller geworden (typische Antwortzeit unter 600 ms bei kurzem Prompt) und unterstützt jetzt Vision-Inputs in Standard-Auflösung — also Belege, Screenshots und Diagramme, die du klassifizieren oder verschlagworten willst.
Wo es in Cortexion eingebaut ist
Modell-ID: gemini-3-5-flash. Sofort verfügbar in:
- KI-Chat (für schnelle Antworten oder Massen-Fragen)
- KI-Schritten in Automatisierungen (z. B. „Lead klassifizieren" vor dem CRM-Eintrag)
- Batch-Verarbeitung (besonders attraktiv: 1.000 Belege parallel)
- Pay-as-you-go-Add-on (deutlich günstiger als Top-Modelle)
Wann du wechseln solltest
Wenn deine Automatisierung heute mit Claude Sonnet oder GPT läuft, aber eigentlich nur klassifiziert oder extrahiert: Flash 3.5 senkt deine Kosten um Faktor 8 bis 15 — bei vergleichbarer Qualität für diese Tasks. Cortexion macht den Wechsel zum Klick in der Automatisierungs-Konfiguration.
Du willst sehen, was Flash 3.5 für deine konkrete Buchhaltung, deinen Support oder dein Marketing leisten kann? Buche eine kostenlose Demo.