Gemini durchsucht Video-Rohmaterial jetzt für 66% weniger
Google hat Geminis Video-KI überarbeitet: bis zu 88% weniger Tokens, 66% niedrigere Kosten. Was das für dein Rohmaterial-Chaos bedeutet.
Du sitzt vor drei Stunden Rohmaterial. Irgendwo ist der eine Take. Der mit dem perfekten Licht, dem einen Satz, der sitzt. Du scrollst. Du scrollst weiter. Nach zwanzig Minuten hast du ihn immer noch nicht.
Das kenn ich. Bei praktisch jedem größeren Dreh. Google hat am 1. September 2026 etwas verändert, das genau dieses Problem trifft: Gemini kann Video jetzt so durchsuchen, dass es für dich als Solo-Creator tatsächlich bezahlbar wird.
Was Google konkret verändert hat
Bisher hat Gemini Video statisch verarbeitet. Ein Frame pro Sekunde, egal was drin passiert. Bei einer neunzigminütigen Aufnahme kostet das ein Vermögen an Tokens, unabhängig davon, ob die Kamera auf einem leeren Raum steht oder mitten in der wichtigsten Szene.
Die neue "Agentic Video Understanding" scannt stattdessen dynamisch. Sie erkennt selbst, wo sie genauer hinschauen muss und wo nicht. Das Ergebnis laut Google: bis zu 88 Prozent weniger Tokens, bis zu 66 Prozent niedrigere Kosten. Und in Tests sogar bis zu 7 Prozent bessere Genauigkeit gegenüber der alten Methode.
Verfügbar ist das Feature in Gemini 3.7 Flash, 3.6 Flash und 3.5 Flash-Lite. Über die Gemini API in AI Studio, ohne Zusatzgebühr. Als Preview, aber live und nutzbar.
Warum mich das als Videograf sofort interessiert
Ich hab in zehn Jahren Videoproduktion einen Ordner voller Rohmaterial angesammelt, der jede Festplatte sprengt. Interviews, B-Roll, ausrangierte Takes, Kunden-Calls die aufgezeichnet wurden "nur für den Fall". Bisher gab's dafür genau zwei Optionen: manuelles Taggen oder gar nicht durchsuchbar machen. Beides frisst Zeit, die ich nicht habe.
Lange Aufnahmen waren dabei immer das größte Problem. Ein zweistündiges Webinar. Eine Stunde Rohmaterial von einem Kunden-Dreh, aus der genau ein Zitat gebraucht wird. Genau da wird die neue Methode interessant, weil Google explizit sagt: der Effekt ist am stärksten bei Long-Form-Content. Von zehnminütigen How-to-Videos bis zu neunzigminütigen Vorträgen und mehrstündigen Aufnahmen.
Das ist kein Nischen-Feature für Konzerne mit eigener KI-Abteilung. Das ist genau der Content-Typ, den Selbstständige im DACH-Raum jede Woche produzieren.
Was du damit tatsächlich machen kannst
Ein paar Beispiele, die ich in den nächsten Wochen selbst durchtesten will:
- Rohmaterial durchsuchen nach Stichwort, ohne jede Minute manuell anzuschauen
- Lange Kunden-Calls oder Webinare automatisch in Kapitel zerlegen
- Konkurrenz-Videos analysieren, ohne sie komplett durchzuschauen
- Transkripte mit Kontext generieren, die verstehen was im Bild passiert, nicht nur was gesagt wird
- Highlight-Momente aus mehrstündigen Livestreams automatisch markieren
- Ausschuss-Material vorsortieren, bevor überhaupt ein Mensch draufschaut
Für jemanden, der Content alleine produziert, ist das kein nice-to-have. Das ist Zeit, die du sonst nirgendwo herbekommst. Und Zeit ist bei Solo-Produktion die einzige Ressource, die wirklich knapp ist.
Wo es noch hakt
Früh testende Entwickler berichten von Trade-offs. Die dynamische Analyse ist nicht bei jedem Video-Typ gleich zuverlässig. Besonders bei sehr schnellen Schnitten oder bei Szenen mit wenig visueller Veränderung kann die KI Details überspringen, die für den alten 1-FPS-Ansatz selbstverständlich gewesen wären.
Ich würd's aktuell nicht für die finale Schnittentscheidung einsetzen. Dafür ist mir das Risiko übersehener Details zu hoch. Für Recherche, Vorsortierung und Suche in Rohmaterial ist es trotzdem schon jetzt ein handfestes Upgrade gegenüber "gar nichts durchsuchbar".
Wie du direkt loslegst
Du brauchst keinen Agentur-Zugang und keine Warteliste dafür. Das Feature läuft über die Gemini API in Google AI Studio, aktuell als Preview, ohne zusätzliche Kosten gegenüber dem normalen Modell-Preis. Wenn du schon mit der Gemini API arbeitest oder ein Skript zur Footage-Analyse hast, ist die Umstellung meist eine einzige Konfigurationszeile.
Wenn du noch nie mit der API gearbeitet hast: das ist ein guter Moment für den ersten Versuch. Ein langes Rohmaterial hochladen, nach einem Stichwort fragen, schauen was zurückkommt. Mehr Einstieg braucht es nicht.
Mein Fazit
Rohmaterial-Suche war jahrelang das Feature, das jeder Creator wollte und niemand sich leisten konnte. Google hat hier kein neues Modell gebaut. Sondern die Kostenrechnung für ein bestehendes Problem umgedreht. Für Solo-Creator, die alleine produzieren und keine Zeit für manuelles Taggen haben, ist das der praktisch relevanteste KI-Move der letzten Wochen.
Du musst nicht sofort deinen ganzen Workflow umbauen. Aber wenn du regelmäßig lange Aufnahmen hast, aus denen du kurze Ausschnitte brauchst, probier es diese Woche einmal aus.
Willst du sehen, wie ich das in meinem eigenen Setup nutze? In der ContentWerk Community teile ich den genauen Workflow, sobald ich ihn selbst durchgetestet hab.
---