Gemini
Multimodalny asystent Google, wbudowany w Gmail, Docs i inne usługi Workspace, z modelami głosowymi Gemini Live.
- Twórca
- Model cenowy
- freemium
- Grupa
- Czaty i asystenci
- Strona
- gemini.google.com
Katalog jest orientacyjny i nie jest rankingiem. Dane potwierdź na stronie producenta - oferta narzędzi AI zmienia się szybko.
Rodzina modeli Google o mocnych stronach w zadaniach multimodalnych, czyli w analizie obrazu, dźwięku i wideo. Dostępna w przeglądarce, w aplikacjach, w pakiecie Workspace i przez API.
Gemini Live
Rozmowę głosową z Gemini Google przenosi do własnych aplikacji. Od września 2026 roku funkcje Gmail Live, Docs Live i Keep Live trafiają stopniowo do subskrybentów planów Google AI Plus, Pro i Ultra. Pozwalają głosowo wyszukiwać informacje w poczcie, szkicować dokumenty i porządkować notatki. Wersja dla firm korzystających z Workspace jest zapowiedziana.
Deweloperzy mają do dyspozycji modele Gemini 3.8 Live i Gemini 3.8 Live Extended Thinking do budowy agentów głosowych. Działają przez Gemini Live API i Google AI Studio, prowadzą rozmowę w 97 językach i mogą wywoływać narzędzia bez przerywania wypowiedzi.
Do czego się nadaje
- Praca z dokumentami i pocztą w ekosystemie Google.
- Analiza obrazu i nagrań.
- Agenci głosowi obsługujący klientów.
O czym pamiętać
Modele działają tylko w chmurze Google, nie ma otwartych wag. Dostęp asystenta do poczty i dokumentów warto ograniczać do tego, co faktycznie potrzebne.
Czytaj więcej: Gemini 3.8 Live dla agentów głosowych, Gemini Live w Gmail, Docs i Keep.