Do czego służy Obiektyw Google (Google Lens) i dlaczego to przydatne narzędzie?

Do czego służy Obiektyw Google (Google Lens) i dlaczego to przydatne narzędzie?
Spis treści

    Niech pierwszy rzuci kamieniem ten, kto nie tłumaczył lub nie szukał konkretnego modelu urządzenia za pomocą Google Lens. Niezależnie od tego, czy pokażemy mu znaki kanji, czy najnowszą stylizację włoskiego artysty – obiektyw do firmy z wielkim G znajdzie dla nas wszystko, co może. Zaawansowana technologia rozpoznawania obrazu, wspierana oczywiście przez sztuczną inteligencję, zaprojektowana została, by przekształcić smartfon w narzędzie do poznawania rzeczywistości. Co jednak jeszcze potrafi Google Lens? Czego spodziewać się po dumie firmy z Mountain View?

    Najważniejsze informacje

    • Google Lens potrafi tłumaczyć teksty w ponad 100 językach (np. menu, etykiety, dokumenty) w czasie rzeczywistym i pozwala łatwo zapisywać informacje, eliminując konieczność ręcznego przepisywania.
    • Narzędzie wykorzystuje sztuczną inteligencję, uczenie maszynowe, głębokie uczenie, „computer vision” oraz Splotowe Sieci Neuronowe wspierane przez TensorFlow, aby skutecznie rozpoznawać i interpretować obrazy.
    • Nie ma co martwić się o prywatność – użytkownik ma kontrolę nad historią wyszukiwań, może ją przeglądać, usuwać oraz ustawić automatyczne usuwanie aktywności

    Główne Funkcje Google Lens w praktyce – jak korzystać z narzędzia? 

    Największą siłą Obiektywu Google jest jego wszechstronność. To narzędzie pełni rolę tłumacza, przewodnika, osobistego stylisty, a nawet asystenta wspierającego osoby z niepełnosprawnościami. Wykorzystując zaawansowaną technologię optycznego rozpoznawania znaków (OCR), Obiektyw potrafi tłumaczyć tekst z menu restauracyjnego, znaków drogowych, etykiet produktów czy dokumentów – wszystko na ponad 100 języków. Co najważniejsze, robi to w czasie rzeczywistym, nakładając przetłumaczony tekst bezpośrednio na oryginalny obraz widoczny na ekranie telefonu. Aplikacja ponadto eliminuje konieczność żmudnego przepisywania informacji. Wystarczy skierować aparat na wizytówkę, aby zapisać numer telefonu w kontaktach, na plakat, by dodać wydarzenie do kalendarza, lub na odręczne notatki, by skopiować ich treść i wkleić do dowolnej aplikacji. 

    To jednak nie wszystko – zobaczyłeś na kimś idealną kurtkę, w kawiarni zauważyłeś designerskie krzesło, a w internecie natknąłeś się na zdjęcie gadżetu bez nazwy? Wystarczy skierować na nie aparat lub użyć zrzutu ekranu, a Obiektyw w kilka sekund znajdzie identyczne lub wizualnie podobne produkty dostępne online. Po rozpoznaniu przedmiotu, aplikacja prezentuje listę linków do sklepów internetowych, umożliwiając błyskawiczne porównanie cen, przeczytanie recenzji i sprawdzenie dostępności.

    Obiektyw więc radykalnie skraca ścieżkę zakupową – tradycyjny lejek sprzedażowy, który zaczynał się od inspiracji wizualnej, wymagał od konsumenta przekształcenia jej na zapytanie tekstowe, a następnie żmudnego przeszukiwania i porównywania wyników. Schemat widzę –> szukam słowami –> porównuję –> kupuję stał się passé. Obiektyw Google, dzięki natychmiastowej identyfikacji i połączeniu z potężną bazą danych, zawierającą informacje o miliardach produktów, skraca ten proces do zaledwie trzech kroków: „widzę –> skanuję –> kupuję”. Każdy obiekt w świecie fizycznym i cyfrowym staje się potencjalnym, „klikalnym” linkiem prowadzącym bezpośrednio do zakupu. 

    Aplikacja Google Lens – technologia w praktyce

    Za pozornie prostą czynnością skierowania aparatu na obiekt i otrzymania odpowiedzi kryje się dość interesujący ekosystem zaawansowanych technologii. Aby zrozumieć działanie Obiektywu, należy najpierw zapoznać się z kilkoma:

    • Sztuczna inteligencja (AI) – jeszcze 5 lat temu trzeba byłoby omówić, czym dokładnie jest. Dziś jednak, ląduje ona na ustach wielu ludzi nawet niezwiązanych z technologią. To szeroka dziedzina informatyki, której celem jest tworzenie maszyn zdolnych do wykonywania zadań pozornie wymagających ludzkiej inteligencji.
    • Uczenie maszynowe (ML) – poddziedzina AI, która polega na tworzeniu algorytmów potrafiących uczyć się na podstawie danych, bez bycia jawnie zaprogramowanymi do każdego zadania.
    • Głębokie uczenie (Deep Learning) – specyficzny rodzaj uczenia maszynowego wykorzystujący wielowarstwowe sieci neuronowe do analizy ogromnych ilości danych i rozpoznawania w nich skomplikowanych wzorców.
    • Computer Vision – dziedzina AI koncentrująca się na umożliwieniu maszynom „widzenia”, interpretowania i rozumienia informacji wizualnych ze świata, takich jak obrazy i filmy wideo. Obiektyw Google jest jednym z czołowych przykładów praktycznego zastosowania wizji komputerowej.

    Dla maszyny obraz to po prostu siatka pikseli, z których każdy reprezentowany jest przez liczby określające jego kolor i jasność. Wyzwaniem jest nauczenie maszyny, jak interpretować te oznaczenia, aby rozpoznać obiekty. Tu z pomocą przychodzą Splotowe Sieci Neuronowe (Convolutional Neural Networks, CNN). Są to specjalizowane algorytmy głębokiego uczenia, których architektura jest inspirowana działaniem kory wzrokowej w ludzkim mózgu. Proces polega na  „pokazywaniu” im milionów, a nawet miliardów, obrazów z odpowiednimi etykietami (np. zdjęcia podpisane „pies”, „samochód”, „drzewo”). Sieć stopniowo uczy się rozpoznawać wzorce – od najprostszych, jak krawędzie, kształty i tekstury w pierwszych warstwach, po coraz bardziej złożone cechy, jak oczy, koła czy liście, aż w końcu potrafi zidentyfikować cały obiekt. Silnikiem, który umożliwia budowanie, trenowanie i wdrażanie tych skomplikowanych modeli na masową skalę, jest TensorFlow. To stworzona przez Google i udostępniona jako open–source platforma do uczenia maszynowego. TensorFlow jest fundamentem technologicznym nie tylko Obiektywu, ale także wielu innych usług giganta.

    Biblioteka wiedzy – Obiektyw Google i Knowledge Graph

    Samo rozpoznanie obiektu na zdjęciu to dopiero połowa sukcesu. Aby dostarczyć użytkownikowi wartościową informację, system musi zrozumieć, czym dokładnie on jest, gdzie się znajduje i co się z nim wiąże. Tu z pomocą przychodzi Google Knowledge Graph. To nic innego, jak gigantyczna, semantyczna baza danych, która przechowuje miliardy faktów na temat ludzi, miejsc, rzeczy i, co najważniejsze, relacji między nimi. Działa jak cyfrowa encyklopedia połączonych ze sobą pojęć, która pozwala Google przechodzić od dopasowywania słów kluczowych do rozumienia znaczenia. Właśnie dzięki połączeniu systemu percepcyjnego i kognitywnego, obiektyw może działać tak sprawnie. W praktyce działa to więc tak, iż kiedy Lens skanuje okładkę książki (percepcja), natychmiast odwołuje się do Grafu Wiedzy, aby pobrać informacje o autorze, recenzje i linki do księgarni (kognicja).

    Ewolucja wyszukiwania wizualnego – z Androida na iOS

    Obiektyw Google nie zagościł na naszych smartfonach oczywiście z dnia na dzień. Zanim świat poznał jego możliwości, światło dzienne ujrzał prekursor – Google Goggles. Uruchomiona w 2010 roku aplikacja oferowała podobną funkcjonalność – pozwalała użytkownikom robić zdjęcia obiektów, aby uzyskać o nich informacje. Goggles potrafiło rozpoznawać kody kreskowe, dzieła sztuki, punkty orientacyjne i tłumaczyć tekst. Było to jednak narzędzie swojej epoki – działało wolniej i było znacznie mniej precyzyjne niż jego następca, co wynikało z ograniczeń ówczesnych technologii uczenia maszynowego i mocy obliczeniowej.

    W 2017 roku Obiektyw Google został po raz pierwszy zaprezentowany na konferencji Google I/O, a jesienią tego samego roku zadebiutował jako ekskluzywna funkcja w smartfonach Google Pixel 2. Po szerokiej ekspansji Lens został udostępniony jako samodzielna aplikacja w sklepie Google Play dla urządzeń z Androidem. Jednocześnie zintegrowano go z Asystentem Google i Google Photos, co pozwoliło na analizę zdjęć już zapisanych w galerii. W późniejszych miesiącach funkcja trafiła również na urządzenia z systemem iOS poprzez aplikację mobilną Google dostępną w App Store.

    Na początku 2024 roku gigant z Mountain View zaprezentował funkcję, która stanowi kolejny duży krok w ewolucji wyszukiwania wizualnego – „Circle to Search”. To metoda interakcji pozwalająca wyszukać dowolny element widoczny na ekranie telefonu – tekst, obrazek czy fragment filmu – poprzez prosty gest zakreślenia go palcem, podświetlenia lub dotknięcia. Co najważniejsze, wszystko to odbywa się bez konieczności opuszczania aktualnie używanej aplikacji.

    Jak korzystać z Google Lens na urządzeniach mobilnych i dbać o prywatność?

    Czyli Google widzi, co, gdzie, kiedy i jak wyszukujemy? W dobie rosnącej świadomości na temat prywatności danych, narzędzia tak potężne jak Obiektyw budzą naturalne pytania o bezpieczeństwo i kontrolę. Google podchodzi do tych kwestii z dużą uwagą, wdrażając mechanizmy mające na celu zapewnienie użytkownikom przejrzystości i panowania nad swoimi informacjami.

    Kiedy użytkownik wykonuje wyszukiwanie za pomocą Obiektywu, obraz jest wysyłany do analizy na serwery Google. Cała komunikacja jest jednak szyfrowana w tranzycie, co chroni dane przed przechwyceniem. Zgodnie z ogólną polityką prywatności Google, zebrane dane są wykorzystywane do świadczenia i ulepszania usług. W przypadku Obiektywu oznacza to, że (jeśli użytkownik wyrazi na to zgodę) zanonimizowane dane z wyszukiwań wizualnych pomagają w trenowaniu i doskonaleniu modeli rozpoznawania obrazu, co w efekcie prowadzi do szybszych i dokładniejszych wyników dla wszystkich. Google jednoznacznie deklaruje, że nie sprzedaje danych osobowych użytkowników stronom trzecim.

    Jak zarządzać aktywnością?

    Przy Obiektywie Google, jak i w przypadku innych usług tej firmy, mamy możliwość zarządzania danymi, które przekazujemy do Krzemowej Doliny. Aby sprawdzić i zmienić ustawienia historii wyszukiwania należy:

    1. Przejść do sekcji “Zarządzaj kontem Google”.
    1. Z menu wybrać kafelek “Dane i prywatność”
    1. Po zjechaniu na dół strony należy kliknąć przycisk “Moja aktywność”.
    1. Następnie, wymagane jest przejście do sekcji “Aktywność w internecie i aplikacjach”.
    1. Na koniec należy dopasować ustawienia pod swoje preferencje. Istnieje także możliwość usunięcia historii z konkretnej usługi, takiej jak Google Chrome czy Lens klikając jej ikonę.

    Na stronie „Moja aktywność” użytkownik ma pełny wgląd w swoją zapisaną historię. Może tam przeglądać poszczególne zapytania, a także usuwać pojedyncze wpisy lub cały rekord. Dodatkowo, istnieje możliwość skonfigurowania automatycznego usuwania aktywności starszej niż 3, 18 lub 36 miesięcy, co pozwala na zachowanie prywatności bez konieczności regularnego, ręcznego czyszczenia historii.

    Patrząc w przyszłość

    Obiektyw Google przeszedł długą drogę – dziś już na stałe wbił się jednak do świadomości konsumentów, którzy to korzystają z niego przy wielu okazjach. Zastępuje niejako aplikację tłumacza, wyszukuje ładne sukienki, rozpoznaje obrazy – wszystko, czego potrzebowaliśmy od tego narzędzia prawdopodobnie już w nim jest. Można co prawda spodziewać się głębszej integracji z technologiami AR czy generatywnej sztucznej inteligencji (Gemini potrafi już bowiem rozpoznawać przedmioty po skierowaniu obiektywu na dany obiekt). Jest szansa, że Google Lens jeszcze bardziej zatrze granicę między światem fizycznym a cyfrową przestrzenią. Niewykluczone, że już w najbliższych latach narzędzie to stanie się kluczem do w pełni interaktywnej, rozszerzonej rzeczywistości.

    Najczęściej zadawane pytania (FAQ)

    Co to jest Obiektyw Google (Google Lens) i do czego służy?

    Obiektyw Google to zaawansowane narzędzie do rozpoznawania obrazu, które zamienia aparat w smartfonie w inteligentną wyszukiwarkę wizualną. Służy do natychmiastowego uzyskiwania informacji o otaczającym świecie.

    Jakie są najważniejsze funkcje Obiektywu Google?

    Do kluczowych funkcji należą:

    • Tłumaczenie tekstów: Tłumaczy napisy, menu czy etykiety w czasie rzeczywistym na ponad 100 języków.
    • Wyszukiwanie wizualne: Identyfikuje produkty (ubrania, meble, gadżety) i pokazuje, gdzie można je kupić online.
    • Kopiowanie tekstu: Umożliwia skopiowanie tekstu z obrazu, notatek odręcznych czy plakatu i wklejenie go do dowolnej aplikacji.
    • Identyfikacja obiektów: Rozpoznaje rośliny, zwierzęta, dzieła sztuki czy punkty orientacyjne, dostarczając na ich temat szczegółowych informacji.
    • Zapisywanie informacji: Pozwala szybko dodać dane z wizytówki do kontaktów lub wydarzenie z plakatu do kalendarza.

    Jak technologia Obiektywu Google „rozumie” to, co widzi?

    Działanie aplikacji opiera się na połączeniu kilku zaawansowanych technologii:

    • Sztuczna inteligencja (AI) i uczenie maszynowe (ML): Algorytmy uczą się rozpoznawać obiekty na podstawie analizy miliardów obrazów.
    • Splotowe Sieci Neuronowe (CNN): Specjalistyczne algorytmy inspirowane ludzkim mózgiem, które identyfikują wzorce w obrazach – od krawędzi po całe obiekty.
    • Google Knowledge Graph: Gigantyczna baza danych, która łączy rozpoznany obiekt z konkretnymi informacjami, takimi jak recenzje, linki do sklepów czy dane historyczne.

    Czy korzystanie z Obiektywu Google jest bezpieczne dla mojej prywatności?

    Tak, Google wdrożyło mechanizmy ochrony prywatności. Obrazy wysyłane na serwery są szyfrowane. Użytkownik ma pełną kontrolę nad swoją historią wyszukiwania w panelu „Moja aktywność” na koncie Google – może ją przeglądać, usuwać pojedyncze zapytania lub skonfigurować automatyczne usuwanie danych po określonym czasie (3, 18 lub 36 miesięcy).

    Jak Obiektyw Google zmienia proces robienia zakupów?

    Narzędzie skraca tradycyjną ścieżkę zakupową. Zamiast schematu „widzę → szukam słowami → porównuję → kupuję”, Obiektyw wprowadza model „widzę → skanuję → kupuję”. Dzięki temu każdy obiekt w świecie fizycznym lub cyfrowym może stać się linkiem prowadzącym bezpośrednio do sklepu.

    Czy Obiektyw Google jest dostępny na iPhonie?

    Tak. Początkowo funkcja była dostępna tylko na smartfonach Google Pixel, ale z czasem została udostępniona jako samodzielna aplikacja na urządzenia z systemem Android oraz zintegrowana z aplikacją Google na urządzeniach z systemem iOS (iPhone, iPad).

    Czym jest nowa funkcja „Zakreśl, by wyszukać” (Circle to Search)?

    To najnowsza ewolucja wyszukiwania wizualnego. Pozwala wyszukać dowolny element widoczny na ekranie telefonu (obraz, tekst, fragment filmu) poprzez prosty gest zakreślenia go palcem, bez konieczności opuszczania aktualnie używanej aplikacji.

    Ocena artykułu: 4.8

    Ilość ocen: 4

    #TeamPIKSEO we współpracy z różnymi działami naszej agencji tworzy treści z szeroko rozumianego marketingu sieciowego. Zależy nam na odczarowywaniu trudnych pojęć i przedstawianiu ich w przystępny dla każdego sposób.

    W naszych artykułach prezentujemy zarówno aktualne informacje ze świata SEO i SEM, jak również przydatne poradniki czy nowinki ze świata AI.

    Najnowsze wpisy

    Zapytaj o ofertę już teraz

    Pomożemy Ci zbudować pozytywny wizerunek marki, zwiększyć zaangażowanie odbiorców oraz wzmocnić Twoją pozycję w sieci – skontaktuj się z nami!