Premiery, aktualizacje i porównania modeli AI
NVIDIA udostępniło Cosmos 3 — pierwszy otwarty model łączący generację wideo, rozumowanie fizyczne i akcje w jednej architekturze MoT.
OpenAI uruchomiła program Rosalind Biodefense, oferując bezpłatny dostęp do GPT-Rosalind instytucjom rządowym i deweloperom w celu przygotowania na pandemie.
Claude Opus 4.8 jako pierwszy model ukończył wszystkie testy Super-Agent, oferując 84% skuteczności w Online-Mind2Web i tryb szybki 3x tańszy.
Nowy model Anthropic częściej sygnalizuje niepewność i jest 4x mniej skłonny do przemilczania wad w kodzie. Wprowadza kontrolę wysiłku i dynamiczne przepływy.
Opus 4.8 został wydany 41 dni po poprzedniej wersji. Nowy model lepiej radzi sobie z niepewnymi danymi i wprowadza Dynamic Workflows.
Nowy model MAI-Image-2.5 zajmuje trzecie miejsce na Arena's text-to-image leaderboard, wprowadzając usprawnienia w renderowaniu tekstu i wizualizacjach.
AI Overview Google'a twierdzi, że w słowie Google są dwa P, a nazwisko prezydenta USA to t-r-p-u-m. Problem wynika z architektury transformerów.
Znany programista po sześciu miesiącach testów twierdzi, że modele językowe jedynie naśladują kod statystycznie, generując subtelne błędy trudne do wykrycia.
NVIDIA przedstawiła modele Nemotron-Labs Diffusion z równoległym generowaniem tokenów, osiągające do 6,4× wyższą szybkość przy zachowaniu jakości.
Qwen3.7-Max osiągnął 10-krotne przyspieszenie kodu, przewyższając konkurencyjne modele w 35-godzinnym autonomicznym eksperymencie optymalizacji.
Chiński Deepseek przekształca promocję w stałą strategię cenową. Model V4 Pro kosztuje 0,87$ za milion tokenów wyjściowych wobec 30$ u GPT-5.5.
Nowy model Google potrafi przekształcać zdjęcia i filmy w realistyczne deepfake'i. Test pokazał, że jakość jest na tyle wysoka, że oszukała męża dziennikarki.