Gemini Spark: globalna ekspansja i automatyczna nawigacja w Chrome

  • Usługa Gemini Spark dostępna jest w ponad 160 krajach dla abonentów Google AI Pro i Ultra.
  • Agent może teraz automatycznie poruszać się po przeglądarce Chrome, korzystając z zapisanych danych logowania, ale tylko w Stanach Zjednoczonych.
  • Lipcowa aktualizacja „Gemini Drop” obejmuje tryb głosowy na macOS, nowe modele Flash i więcej integracji.
  • Narzędzie to nie jest jeszcze dostępne w Europejskim Obszarze Gospodarczym, Wielkiej Brytanii, Szwajcarii i Nigerii.

Agent AI Gemini Spark

Google wykonał kolejny krok w rozwoju sztucznej inteligencji, wprowadzając Gemini Spark – osobistego agenta, który działa w tle i dociera do większej liczby użytkowników na całym świecie. Firma ogłosiła rozszerzenie usługi na ponad 160 krajów dla abonentów planów Google AI Pro i Google AI Ultra, choć ze znacznymi wykluczeniami geograficznymi w Europie.

Co więcej, najważniejszą nowością ostatnich tygodni jest integracja Spark z automatyczną nawigacją Chrome – funkcją, która pozwala agentowi korzystać z zapisanych kont i haseł do wykonywania złożonych zadań, takich jak rezerwacja lotów czy wyszukiwanie apartamentów. Na razie jednak jest ona dostępna tylko w Stanach Zjednoczonych i wymaga wyraźnej autoryzacji użytkownika w przypadku wrażliwych działań, takich jak płatności.

Globalna ekspansja Gemini Spark: dostępna w ponad 160 krajach

Globalna ekspansja Gemini Spark

Firma potwierdziła na swoim oficjalnym blogu, że od 30 lipca 2026 roku subskrybenci Google AI Pro będą mieli dostęp do Gemini Spark w ponad 160 krajach. Narzędzie działa w oparciu o infrastrukturę chmurową Google i może wykonywać zadania nawet po wyłączeniu komputera lub zablokowaniu telefonu. Jednak drobny druk ujawnia, że ​​Spark pozostaje niedostępny w Europejskim Obszarze Gospodarczym, Wielkiej Brytanii, Szwajcarii i Nigerii, prawdopodobnie z powodu regulacji, takich jak RODO i europejska ustawa o sztucznej inteligencji.

Wyjaśnienie ekosystemu Google
Powiązany artykuł:
Wyjaśnienie ekosystemu Google: usługi, Android, chmura i sztuczna inteligencja

Aby korzystać z Spark, oprócz odpowiedniej subskrypcji, musisz mieć włączoną funkcję „Zapisz aktywność” oraz osobiste konto Google (nie konto służbowe ani szkolne). Firma ostrzega użytkowników, aby zachowali ostrożność w przypadku wszelkich poufnych informacji wprowadzanych do zaplanowanych zadań.

Płatne plany dzielą się na Google AI Pro i Google AI Ultra. Chociaż Spark był początkowo dostępny tylko w wersji Ultra, rozszerzenie do wersji Pro zdemokratyzowało dostęp w regionach takich jak Ameryka Łacińska, gdzie zaczął być już wdrażany. Google podkreśliło takie zastosowania, jak automatyczne planowanie podróży, zarządzanie subskrypcjami i tworzenie spersonalizowanych odpowiedzi dla klientów.

Automatyczna nawigacja w Chrome: agent, który działa za Ciebie

Przeglądanie Gemini Spark Chrome

Jedną z najczęściej omawianych funkcji jest automatyczna nawigacja Chrome, która pozwala Sparkowi poruszać się po sieci za pomocą zapisanych danych logowania . Za zgodą użytkownika agent może logować się do witryn, wypełniać formularze i przechodzić przez wieloetapowe procesy. Na przykład może sprawdzić dostępne loty i rozpocząć rezerwację, wyszukać apartamenty i umówić się na oglądanie.

Google twierdzi, że system został zaprojektowany tak, aby wytrzymać ataki typu command injection, czyli technikę polegającą na ukrywaniu złośliwych instrukcji na stronach internetowych. Co więcej, w przypadku wrażliwych działań, takich jak płatności, Spark zwraca kontrolę użytkownikowi , pozwalając mu podjąć ostateczną decyzję. Pasek u góry przeglądarki Chrome wskazuje, kiedy agent jest aktywny, co zwiększa transparentność.

Funkcja ta była początkowo dostępna tylko w Stanach Zjednoczonych, ale Google obiecało rozszerzyć ją w przyszłości na inne regiony. Integracja z Chrome stanowi znaczący krok w kierunku pełnej autonomii asystenta , podobnie jak Google przeprojektowuje wyszukiwanie oparte na sztucznej inteligencji, aby uczynić je bardziej konwersacyjnym. Wywołało to jednak również debatę na temat bezpieczeństwa i centralizacji danych, zwłaszcza w społeczności kryptowalut, która postrzega to jako argument za zdecentralizowaną tożsamością.

Co nowego w lipcowym „Gemini Drop”: tryb głosowy w systemie macOS i nowe modele

Lipcowy spadek Gemini

31 lipca Google opublikowało comiesięczne podsumowanie aktualizacji, znane jako „Gemini Drop”, zawierające siedem aktualizacji. Najbardziej godny uwagi dla użytkowników komputerów stacjonarnych jest tryb głosowy w systemie macOS , który umożliwia dyktowanie tekstu, przekształcanie wybranych treści lub generowanie obrazów bezpośrednio z dowolnego aktywnego okna, bez konieczności otwierania aplikacji Gemini. Funkcja ta jest obecnie dostępna tylko w języku angielskim.

Dodatkowo wprowadzono na rynek dwa nowe modele z rodziny Flash: Gemini 3.6 Flash i Gemini 3.5 Flash-Lite , które według Google oferują ulepszone wnioskowanie i większą szybkość. Modele te są przeznaczone do zastosowań, w których opóźnienie ma kluczowe znaczenie. Dodano również możliwość tworzenia własnego awatara, który będzie wyświetlany na obrazach generowanych przez sztuczną inteligencję, a także nowe integracje z Dropbox, Zillow Rentals i Viator.

Kolejną ważną nowością jest to, że Gemini Spark może teraz reagować na wydarzenia w czasie rzeczywistym , takie jak najnowsze wiadomości czy wyniki sportowe, i powiadamiać o nich użytkownika. Ta funkcja uzupełnia dotychczasową możliwość pracy z plikami lokalnymi w systemie macOS, choć ta ostatnia jest wciąż w fazie beta i wymaga subskrypcji Google AI Ultra w Stanach Zjednoczonych.

Przykłady zastosowań i obsługa Gemini Spark

Przykłady zastosowań Gemini Spark

Gemini Spark to nie typowy asystent konwersacyjny. To agent, który autonomicznie wykonuje zadania zgodnie z predefiniowanymi instrukcjami , bez konieczności interwencji użytkownika. Na przykład, może oczyścić skrzynkę odbiorczą, podsumowując wiadomości e-mail, wypisać Cię z list mailingowych lub generować raporty z plików lokalnych.

Praktyczne przykłady udostępniane przez Google obejmują: organizowanie podróży na podstawie e-maili z potwierdzeniem , planowanie weekendu poprzez wyszukiwanie lokalnych wydarzeń, zarządzanie aktywnościami sportowymi poprzez sprawdzanie pogody, koordynowanie wydarzeń poprzez zbieranie informacji o ograniczeniach dietetycznych, audyt miesięcznych subskrypcji oraz pisanie spersonalizowanych odpowiedzi dla klientów. Google może również analizować styl pisania użytkownika w celu stworzenia przewodnika wielokrotnego użytku.

Integracja z Google Workspace jest natywna, co oznacza, że ​​Spark może odczytywać i edytować dokumenty, arkusze kalkulacyjne i kalendarze bez dodatkowej konfiguracji . Ponadto rozszerzono łączność z aplikacjami innych firm, takimi jak Canva, Instacart, OpenTable, Dropbox i Zillow, co pozwala Sparkowi rozszerzyć swoje możliwości na jeszcze więcej usług.

Aby aktywować Spark, użytkownik definiuje instrukcje raz, a agent wykonuje je wielokrotnie. Użytkownik zachowuje kontrolę , decydując, do których aplikacji uzyskać dostęp i autoryzując istotne działania. Narzędzie jest dostępne w aplikacji mobilnej Gemini, wersji webowej oraz natywnej aplikacji na macOS.

Dzięki tym wszystkim nowym funkcjom Google wzmacnia swoje zaangażowanie w agentów AI działających w tle, mimo że fragmentacja geograficzna nadal stanowi przeszkodę dla użytkowników w Europie. Rozszerzenie na ponad 160 krajów i automatyczna nawigacja w Chrome to punkt zwrotny w sposobie, w jaki wchodzimy w interakcję ze sztuczną inteligencją, ale brak tych funkcji w UE i Wielkiej Brytanii uniemożliwia milionom użytkowników ich wypróbowanie.

Podsumowanie Gemini Spark


Dodaj jako preferowane źródło w Google