Skip to main content
Googles effizientestes multimodales Modell mit 1M-Kontext.

Langer Kontext

Über 99 % über 1M Tokens.

Audio/Video

1 Frame/s Video, 16 kHz Audio.

Kontext-Caching

Riesige Datensätze.

Multimodale Echtzeit

Sprachassistenten.