Wiadomości ze świata AI – wrzesień 2025
Poniżej przedstawiamy zestawienie najważniejszych wydarzeń września 2025 – od przełomów w modelach językowych, przez strategiczne fuzje korporacyjne, po odkrycia naukowe i wydarzenia związane z Polską.
Anthropic wypuścił Claude Sonnet 4.5
Anthropic ogłosił 28 września 2025 roku premierę Claude Sonnet 4.5, określając go jako najlepszy model kodujący na świecie. Model wyróżnia się zdolnością do budowania złożonych agentów AI oraz obsługi komputera, osiągając wynik 72,5% w benchmarku SWE-bench. Sonnet 4.5 oferuje hybrydowe możliwości rozumowania, pozwalając na przełączanie między szybkimi odpowiedziami a rozszerzonym trybem “myślenia”, z funkcją Focus umożliwiającą pracę nad zadaniami do 30 godzin bez przerwy. Cena pozostała na poziomie poprzednika: 3 USD za milion tokenów wejściowych i 15 USD za milion tokenów wyjściowych.
OpenAI i NVIDIA ogłosiły strategiczne partnerstwo o wartości 10 gigawatów mocy obliczeniowej
OpenAI i NVIDIA ogłosiły 21 września monumentalne partnerstwo strategiczne, w ramach którego NVIDIA dostarczy co najmniej 10 gigawatów mocy obliczeniowej AI do centrów danych OpenAI. To największa jak dotąd inwestycja infrastrukturalna w dziedzinie AI, która ma fundamentalnie wzmocnić możliwości rozwoju przyszłych modeli OpenAI. Współpraca przewiduje wykorzystanie najnowszych systemów GPU H100 i przyszłych generacji procesorów NVIDIA, co może przyspieszyć rozwój bardziej zaawansowanych modeli językowych i multimodalnych.
OpenAI wypuścił Sora 2 z synchronizowanym dźwiękiem i ulepszoną fizyką
OpenAI ogłosił 30 września premierę Sora 2, drugiej generacji swojego modelu generowania wideo. Najważniejsze nowości to synchronizowany dźwięk z dialogami i efektami dźwiękowymi, ulepszone modelowanie fizyki świata rzeczywistego oraz lepsza spójność między wieloma ujęciami. Model oferuje bardziej realistyczne i kontrolowalne klipy, z planami udostępnienia przez aplikację, web oraz przyszłe API. Sora 2 stanowi znaczący krok w kierunku tworzenia profesjonalnych treści wideo przy pomocy AI.
Meta Llama otrzymała federalne zatwierdzenie dla wszystkich agencji rządowych USA U.S. General Services Administration zatwierdziła 22 września modele Meta Llama AI do użytku we wszystkich federalnych agencjach USA w ramach inicjatywy OneGov. W przeciwieństwie do tradycyjnych negocjacji zakupowych, Llama jest dostępna dla agencji za darmo przy zachowaniu pełnej kontroli nad danymi. To historyczny moment dla open-source AI w sektorze publicznym, wspierający strategię administracji Trumpa dotyczącą przyspieszenia federalnego wykorzystania AI zgodnie z America’s AI Action Plan.
DeepSeek wypuścił eksperymentalny model V3.2-Exp z 50% redukcją kosztów Chiński startup DeepSeek wypuścił 29 września eksperymentalną wersję modelu DeepSeek-V3.2-Exp, określając go jako “pośredni krok w kierunku następnej generacji”. Model wprowadza DeepSeek Sparse Attention, która zmniejsza koszty obliczeniowe o ponad 50% i poprawia wydajność w przetwarzaniu długich sekwencji tekstu. DeepSeek jednocześnie obniżył ceny API o “50%+” dla wszystkich użytkowników, wywierając presję na konkurentów takich jak OpenAI i Alibaba.
Suno wypuścił v5 – najbardziej zaawansowany model generowania muzyki Suno ogłosił 23-25 września premierę v5, swojego “najbardziej zaawansowanego i najpotężniejszego modelu muzycznego”. Model oferuje studyjną jakość dźwięku, bardziej naturalne wokale i nową architekturę kompozycyjną. Suno v5 stanowi podstawę dla nowego produktu Suno Studio i jest dostępny dla użytkowników Pro i Premier. Mimo technicznych ulepszeń, krytycy zwracają uwagę na “bezosobową perfekcję” generowanych wokali AI, podczas gdy firma zmaga się z pozwami sądowymi od wielkich wytwórni muzycznych.
Alibaba Cloud ogłosił Qwen3 z bilionem parametrów i Wan 2.5 Alibaba Cloud zaprezentował 24 września na konferencji Apsara 2025 swoją pełną strategię innowacji AI, w tym modele Qwen3 z rodziną przekraczającą bilion parametrów (Qwen-3-Max). Eddie Wu, CEO Alibaba Cloud, zapowiedział, że Qwen będzie “systemem operacyjnym ery AI”, z kontynuacją polityki open-source. Dodatkowo ogłoszono Wan 2.5, model generowania wideo z ulepszoną spójnością między ujęciami i animacją postaci. Alibaba potwierdził plan inwestycyjny 380 miliardów RMB w AI i infrastrukturę chmurową przez kolejne trzy lata.
ByteDance wprowadził Seedream 4.0 z jakością 4K i edycją obrazów ByteDance, firma stojąca za TikTokiem, wypuścił we wrześniu Seedream 4.0, zaawansowany model AI do tworzenia i edycji obrazów. Model łączy generowanie obrazów wysokiej jakości z naturalną edycją językiem naturalnym, oferując rozdzielczość do 4K. Seedream 4.0 obsługuje edycję opartą na promptach, przetwarzanie wsadowe i zadania wymagające wiedzy specjalistycznej. ByteDance pozycjonuje model jako bezpośredniego konkurenta Google Nano Banana od DeepMind, z dwujęzycznym wsparciem zwiększającym globalny zasięg.
xAI wypuścił Grok 4 Fast – 64x tańszy od OpenAI o3 xAI Elona Muska wprowadził we wrześniu Grok 4 Fast, wersję zoptymalizowaną dla klientów korporacyjnych. Według niezależnych analiz, Grok 4 Fast oferuje wydajność porównywalną z Grok 4, używając o 40% mniej tokenów “myślących” i oferując okno kontekstu do 2 milionów tokenów. Co najważniejsze, model jest do 64 razy tańszy niż wczesne modele frontierowe jak OpenAI o3, czyniąc ofertę xAI bardziej dostępną i potencjalnie przyspieszając adopcję w sektorze enterprise.
DeepSeek-V3.1 z hybrydowym trybem Think/Non-Think wprowadzony w sierpniu z wrześniowymi zmianami cenowymi DeepSeek wypuścił 20 sierpnia DeepSeek-V3.1, określając go jako “pierwszy krok w kierunku ery agentów”. Model oferuje hybrydowy tryb inference z opcjami Think i Non-Think, szybsze myślenie niż DeepSeek-R1-0528 oraz wzmocnione umiejętności agentowe po dodatkowym treningu. Nowe ceny weszły w życie 5 września 2025, kończąc zniżki off-peak. Model obsługuje 128K tokenów kontekstu i format API Anthropic, z open-source’owymi wagami dostępnymi na Hugging Face.
Google Research zaprezentował system AI do tworzenia empirycznego oprogramowania naukowego Google Research ogłosił 9 września nowy system AI zbudowany na Gemini, który pomaga naukowcom pisać empiryczne oprogramowanie na poziomie eksperckim. System działa jako silnik optymalizujący kod: proponuje nowatorskie koncepcje metodologiczne i architektoniczne, implementuje je jako wykonywalny kod i empirycznie waliduje ich wydajność. Przeszukuje i iteruje przez tysiące wariantów kodu używając przeszukiwania drzewa, osiągając ekspertowską wydajność w sześciu benchmarkach obejmujących genomikę, zdrowie publiczne, analizę geoprzestrzenną, neuronaukę, prognozowanie szeregów czasowych i analizę numeryczną.
MIT wypuścił SCIGEN – narzędzie AI do projektowania przełomowych materiałów Naukowcy z MIT ogłosili 21 września SCIGEN, nowe narzędzie wykorzystujące uczenie maszynowe do przewidywania, które materiały będą miały określone elementy w pożądanym wzorze geometrycznym. SCIGEN implementuje reguły projektowe, których modele AI muszą przestrzegać podczas generowania nowych materiałów, potencjalnie przyspieszając poszukiwania materiałów do komputerów kwantowych, w tym nieuchwytnych cieczy spinowych kwantowych. Narzędzie może przewidywać materiały w konkretnych układach sieciowych (trójkątnych, Kagome), dając eksperymentatorom setki lub tysiące nowych kandydatów do badań.
Periodic Labs założone przez współtwórcę ChatGPT w celu przyspieszenia odkryć naukowych Czołowi naukowcy AI opuścili OpenAI, Google i Meta, aby dołączyć do Periodic Labs, nowej firmy założonej przez współtwórcę ChatGPT 30 września. Celem Periodic Labs jest zbudowanie technologii sztucznej inteligencji, która może przyspieszyć nowe odkrycia naukowe w obszarach takich jak fizyka i chemia. To znaczący ruch kadrowy w branży AI, wskazujący na rosnące zainteresowanie zastosowaniem AI w fundamentalnych badaniach naukowych, a nie tylko w aplikacjach komercyjnych.
Rzeszów AI Summit 2025 – pierwsza międzynarodowa konferencja AI w Polsce Uniwersytet Rzeszowski zorganizował 23 września Rzeszów AI Summit 2025 pod hasłem “Sztuczna Inteligencja Nowej Generacji dla Prawa, Nauki, Innowacji i Społeczeństwa”. Wydarzenie zgromadziło prawie 500 uczestników z całego świata, łącząc specjalistów z prawa, medycyny, humanistyki, edukacji, informatyki i inżynierii. Program obejmował referaty i panele dyskusyjne w języku polskim i angielskim, poruszając tematy odpowiedzialności i regulacji AI, praw autorskich, AI w nauce i edukacji, zastosowań w ochronie zdrowia oraz najnowszych osiągnięć w modelach neuronowych.
OpenAI wprowadził kontrole rodzicielskie dla ChatGPT OpenAI ogłosił we wrześniu dodanie kontroli rodzicielskich do ChatGPT w wersji webowej, reagując na przypadki związane z samobójstwem nastolatków. Nowe funkcje umożliwiają rodzicom monitorowanie i ograniczanie dostępu dzieci do chatbota AI. To ważny krok w kierunku bezpieczniejszego wykorzystania AI przez młodszych użytkowników, pokazujący rosnącą świadomość społecznej odpowiedzialności firm AI.
ChatGPT otrzymał ulepszony tryb Advanced Voice Mode OpenAI wprowadził 24 września ulepszenia Advanced Voice Mode dla ChatGPT. Początkowe reakcje były mieszane – wielu użytkowników czuło, że rozmowa z nowym systemem przypomina interakcję z inną osobą niż ich znany GPT. 25 września starsze modele jak 4o i 4.1 zostały przejściowo przeniesione na GPT-5, co wywołało frustrację wśród użytkowników, którzy stworzyli więź z poprzednimi wersjami. 26 września wprowadzono Pulse dla użytkowników Pro – wirtualnego asystenta integrującego się z Gmail i Google Calendar.
Gemini wchodzi na platformy Google TV, Chrome i Play Games Google rozpoczęło we wrześniu szeroką integrację Gemini ze swoimi głównymi produktami konsumenckimi. Model trafił na Google TV (debiut na telewizorach TCL QM9K), zastępując częściowo Asystenta Google i umożliwiając kontekstowe rozmowy, rekomendacje filmowe i pomoc edukacyjną. Gemini zintegrowano również z przeglądarką Chrome i Google Play Games. To pierwsza tak kompleksowa próba uczynienia AI realnym towarzyszem w codziennych aktywnościach użytkowników, z planami stopniowego rozszerzenia na inne urządzenia.
Gemini 2.5 Deep Think osiągnął złoty wynik w finale ICPC World Finals Ulepszona wersja modelu Gemini znana jako Gemini 2.5 Deep Think osiągnęła złotostandardowe wyniki w finale ICPC World Finals, najbardziej prestiżowych międzynarodowych zawodach programistycznych. To przełomowe osiągnięcie pokazuje, że modele AI osiągają poziom ekspercki w złożonych zadaniach algoritmicznych i programistycznych, konkurując z najlepszymi programistami na świecie.
OpenAI model otrzymał perfekcyjny wynik 12/12 w ocenie ICPC OpenAI wskazało we wrześniu, że jeden z jego modeli rozumowania i kodowania otrzymał bezbłędny wynik (12/12) podczas ocen ICPC. To kolejny dowód na to, że modele AI osiągają coraz wyższą precyzję w rozwiązywaniu zaawansowanych problemów programistycznych, potencjalnie zmieniając sposób, w jaki podchodzimy do edukacji informatycznej i rozwoju oprogramowania.
NIST CAISI opublikował krytyczną ocenę modeli DeepSeek Narodowy Instytut Standardów i Technologii (NIST) przez swój program CAISI opublikował 29 września szczegółową ocenę modeli AI DeepSeek, stwierdzając istotne braki i ryzyka. Modele DeepSeek okazały się pozostawać w tyle za modelami amerykańskimi pod względem wydajności, kosztów, bezpieczeństwa i adopcji. To ważny raport dla organizacji rozważających wdrożenie chińskich modeli AI w środowiskach wrażliwych.
Regulacje EU AI Act dla modeli GPAI weszły w życie z wytycznymi wrześniowymi Od 2 sierpnia 2025 obowiązują w UE specyficzne zobowiązania dla modeli AI ogólnego przeznaczenia (GPAI), wymagające większej przejrzystości, bezpieczeństwa i zarządzania ryzykiem. We wrześniu Komisja Europejska opublikowała zaktualizowane wytyczne i dobrowolny Code of Practice, oferując pragmatyczne pomoce implementacyjne. Modele z mocą obliczeniową treningu powyżej 10^25 FLOPs są uznawane za systemowe; dostawcy muszą informować AI Office w ciągu dwóch tygodni. Wszystkie GPAI wymagają obowiązkowej dokumentacji, polityki praw autorskich i publicznego podsumowania danych treningowych.
Samsung i SK dołączyły do inicjatywy Stargate OpenAI Samsung i SK ogłosiły we wrześniu/początku października dołączenie do inicjatywy Stargate OpenAI w celu rozwoju globalnej infrastruktury AI. To strategiczny ruch koreańskich gigantów technologicznych, pokazujący rosnącą globalną konkurencję w budowie infrastruktury AI i rozszerzanie się koalicji OpenAI poza partnerów amerykańskich.
Google konkuruje z OpenAI i Anthropic oferując Gemini dla rządu za 0,47 USD rocznie Google wprowadził “Gemini for Government” w ramach intensywnej konkurencji o federalne kontrakty. Po darmowej ofercie Meta Llama, Google zaoferował swoje modele agencjom federalnym za zaledwie 0,47 USD rocznie za agencję, znacznie poniżej ofert OpenAI i Anthropic (1 USD za agencję rocznie). Microsoft również zawarł umowę z GSA oferując M365, Azure Cloud Services i Dynamics 365 w obniżonych cenach na okres do 36 miesięcy.
ChatGPT-5, Gemini 2.5 Flash i DeepSeek-V3.1 porównane w badaniu stomatologicznym Badanie opublikowane 27 września porównało trzy czołowe modele LLM (ChatGPT-5, Gemini 2.5 Flash i DeepSeek-V3.1) pod względem dokładności, zrozumiałości i czytelności odpowiedzi na pytania pacjentów dotyczące leczenia endodontycznego. Badanie wykazało doskonałą zgodność między oceniającymi (ICC: 0.908-0.995) i przyczynia się do zrozumienia, jak różne modele AI radzą sobie z medyczną komunikacją pacjent-dostawca.
Rosja ogłosiła szczepionkę przeciwnowotworową mRNA EnteroMix gotową do zastosowania klinicznego Rosyjska Federalna Agencja Medyczna i Biologiczna (FMBA) ogłosiła we wrześniu, że szczepionka przeciwnowotworowa oparta na mRNA, EnteroMix, pomyślnie zakończyła ponad trzy lata testów przedklinicznych i jest gotowa do zastosowania klinicznego. Szczepionka wykazała znaczną supresję nowotworów, obiecujący profil bezpieczeństwa i potencjał do indywidualizowanego leczenia. Mimo zachęcających wyników, przed globalną adopcją konieczne są solidne badania peer-reviewed, wieloośrodkowe badania kliniczne i długoterminowe oceny.
Azumo opublikował rankingiem Top 10 LLM na lato/wrzesień 2025 Azumo wydało 15 września kompleksowy przewodnik Top 10 LLM, analizując najlepsze modele językowe pod względem wydajności, cen i praktycznych zastosowań. Claude 4 Opus prowadzi w kodowaniu (72,5% SWE-bench), Gemini 2.5 Pro dominuje w rozumowaniu (86,4 GPQA), a Mistral Medium 3 oferuje 90% wydajności premium za 0,40 USD za milion tokenów (8x taniej). Llama 4 Scout przetwarza 10 milionów tokenów, a Grok 3 oferuje integrację z danymi na żywo.
Dyskusja Reddit podsumowała kluczowe wydarzenia AI z września 2025 Popularne podsumowanie na r/singularity wymienia kluczowe wydarzenia września: Bytedance Seedream 4.0, Gemini 2.5 Deep Think ze złotym wynikiem ICPC, OpenAI model z perfekcyjnym wynikiem 12/12 w ICPC, Suno v5, Alibaba Qwen-3-Max, Wan 2.5, Anthropic Sonnet 4.5, OpenAI Sora 2, DeepSeek-V3.2-Exp oraz strategiczne partnerstwo OpenAI-NVIDIA zapewniające co najmniej gigawaty mocy AI.
Publikacja naukowa o AI w edukacji wyższej – analiza bibliometryczna 2006-2024 Opublikowana 4 września analiza bibliometryczna bada integrację sztucznej inteligencji w zrozumieniu czytania ze studentami uniwersyteckimi, analizując 39 dokumentów z lat 2006-2024. Wyniki wskazują na znaczący wzrost publikacji, z USA i Chinami wiodącymi w produkcji naukowej. Badanie podkreśla transformacyjny potencjał AI w edukacji i potrzebę dalszej eksploracji zastosowań AI w różnych dyscyplinach.
Konferencja FEBS-IUBMB-ENABLE o AI w medycynie odbyła się w Singapurze Trzecia międzynarodowa konferencja doktorantów i postdoktorantów w dziedzinie biologii molekularnej odbyła się 4-6 grudnia 2024 (z wpływem na dyskusje września 2025) w Singapurze pod hasłem “Sztuczna Inteligencja – Przekształcanie Badań Biomedycznych i Zdrowotnych”. Konferencja zgromadziła ponad 260 uczestników z całego świata, z sesjami o AI w chorobach metabolicznych, neurologii, zdrowiu psychicznym, chorobach oddechowych i infekcyjnych oraz chorobach skóry.
Berkeley Lab wykorzystuje AI i automatyzację do przyspieszenia nauki Berkeley Lab ogłosił 3 września, jak wykorzystuje AI i automatyzację do przyspieszania nauki i odkryć. AI pomaga dostrajać instrumenty w locie, czyniąc je bardziej stabilnymi, wydajnymi i produktywnymi. Berkeley Lab Laser Accelerator wykorzystuje uczenie maszynowe do optymalizacji w czasie rzeczywistym, demonstrując praktyczne zastosowania AI w zaawansowanych badaniach naukowych.
Badanie nad AI w protetyce stomatologicznej – przegląd literatury 2017-2025 Opublikowany 27 lipca przegląd literatury oceniał potencjał AI w poprawie wydajności i dokładności protetyki dentystycznej i szczękowo-twarzowej poprzez analizę 54 publikacji z lat 2017-2025. Badanie wykazało, że AI umożliwia automatyzację rutynowych procedur i toruje drogę do przełomów w dokładności diagnostycznej, planowaniu leczenia i wytwarzaniu protez stałych i ruchomych, ostatecznie podnosząc jakość opieki.
Publikacja o marker-less pose-estimation w badaniach naukowych Systematyczny przegląd opublikowany 21 sierpnia oceniał, jak techniki oszacowania pozy bez markerów są obecnie stosowane w modelach gryzoni (szczury i myszy). Analiza wykazała przyspieszenie trendu publikacji w ostatnich latach, z ponad połową badań opublikowanych po 2021 roku. Pomimo znaczącego postępu w technologiach marker-less pose-estimation, ich powszechne zastosowanie w badaniach naukowych wciąż napotyka wyzwania.
Publikacja o wykorzystaniu AI w generatywnej muzyce – ideologie osadzone w systemach Praca opublikowana 11 sierpnia analizuje cztery systemy generatywnej AI do tworzenia muzyki dostępne publicznie w połowie 2025 roku (AIVA, Stable Audio, Suno i Udio), śledząc, jak są one retoryzowane przez ich twórców i odbierane przez użytkowników. Badanie mapuje wspólną ideologię między producentami i konsumentami jako indywidualistyczną, globalistyczną, techno-liberalną i etycznie unikającą odpowiedzialności.
