W tym tygodniu poznaliśmy odpowiedzi na następujące pytania. Nie zadawajcie ich modelom, zrobiliśmy to za Was, by oszczędzić Wasz czas.
1. Gdzie leży granica rozwoju robotów?
W danych, a nie w sprzęcie. Granicę pokazał startup Mecka, który płaci ludziom za nagrywanie codziennych czynności, żeby uczyć na nich roboty, i zbiera na to setki milionów dolarów. Mecka AI płaci więc ludziom za nagrywanie, jak parzą kawę czy naprawiają samochód. Na rozwój tego pomysłu właśnie pozyskali 60 mln dol. Mecka przygotowują dane do trenowania modeli językowych wyspecjalizowane w robotyce.
Bez danych z prawdziwego świata roboty nie wyjdą poza pokazy.
2. Kto prowadzi w wyścigu najmocniejszych modeli?
Prowadzenie zmienia się co kilka tygodni. Gemini 4 Argon (następca modelu Gemini 3.1 Pro) wyprzedził w kilku testach GPT-6 Astra i Claude’a Opus 5.5, a do tego kosztuje mniej. Coraz ważniejsza jest więc cena i dostępność, a nie tylko wynik w testach. Problem w tym, że jest to model dostępny tylko dla testerów. Statystyki pokazuje Arena: https://arena.ai/leaderboard/chat/text. Ale wciąż w części zestawień (np. https://livebench.ai/) nie ma Gemini 4 Argon. Do tej pory w modelach ogólnego przeznaczenia królował Claude’a Opus 5.5. Trudno więc dziś jednoznacznie powiedzieć kto jest aktualnym zwycięzcą wyścigu, niemniej oba modele z całą pewnością należą do najmocniejszych na rynku.
3. Czy AI zabierze ludziom pracę?
Według raportu McKinsey nie w sensie ogólnej liczby miejsc pracy: w USA do 2035 r. powstanie ich więcej, niż zniknie. Ok. 11 mln osób w USA będzie jednak musiało całkowicie zmienić zawód, a najbardziej ucierpią najsłabiej zarabiający. Problemem będzie więc konieczność zmiany zawodu, a nie brak pracy.
4. Czy strony internetowe wpuszczą agentów AI?
Na razie nie w pełni. Amazon zablokował agenta Mety, a inne serwisy stawiają warunki albo żądają opłat. Odpowiedzią ma być wspólny standard identyfikacji agentów, np. Personal Agent Protocol, ale są już konkurencyjne pomysły, m.in. Visy. O tym, kto kontroluje zakupy przez AI, zdecyduje dopiero walka o standardy. No bo co z tego, że będziemy mieli agenta na swoim komputerze i zlecimy mu polowanie na okazyjny lot do Azji i natychmiastowy zakup, skoro strony linii lotniczych nie pozwolą na wejście agentów na ich strony.
5. Czy agenci AI staną się codziennymi współpracownikami?
Tak, i dzieje się to szybciej, niż się wydawało. W ciągu kilku dni Google pokazał agenta z własnym kontem e-mail w firmie, OpenAI agentów Dots działających całą dobę, a Microsoft przebudował Windows tak, by bezpiecznie obsługiwał agentów. Na razie korzystają z nich głównie firmy i płacący klienci, a w Europie część funkcji jest niedostępna.
6. Czy Europa wygrywa walkę z USA i Chinami w obszarze LLM-ów?
Nie. Mistral Large 4 w rankingu Artificial Analysis to najlepszy model spoza USA i Chin, ale z wynikiem 38 pkt przegrywa w niezależnych testach z pięcioma chińskimi modelami otwartymi i z czołówką z USA. Jest za pięcioma chińskimi modelami otwartymi (MiMo, GLM, Kimi i inne), a w programowaniu za GPT-6 Astra i Claude’em. Ale to najlepszy europejski model. Ponadto nowe usługi AI, takie jak agenci Dots od OpenAI, trafiają do Europejczyków z opóźnieniem albo wcale. Europa wygrywa natomiast w ustalaniu zasad: to unijny AI Act zmusił OpenAI do znakowania tekstów z ChatGPT. Europa pisze więc reguły dla technologii, które tworzą inni. Pytanie, czy nie przereguluje rynku – pozostaje otwarte.
7. Czy da się wiarygodnie odróżnić treści stworzone przez AI od tych stworzonych przez człowieka?
Tylko częściowo. OpenAI, Anthropic i Google oznaczają już teksty, obrazy, wideo i dźwięk niewidocznymi znakami wodnymi, a Google udostępnił wszystkim detektor SynthID. Każda firma stosuje jednak własną metodę, znak łatwo osłabić przeredagowaniem albo kompresją, a publicznie da się dziś sprawdzić tylko obrazy, wideo i dźwięk, nie teksty. Brak znaku nie dowodzi więc, że autorem był człowiek.
Czytaj też:
7 najważniejszych cytatów tygodnia o AI (26.09 – 2.10) Czytaj też:
Organ stojący na straży polskiego AI ma 6 osób. „Nie boimy się zalewu spraw”




