Premiery, aktualizacje i porównania modeli AI
GPT-5.5 Instant w ChatGPT otrzymał aktualizację poprawiającą zrozumienie celów użytkowników i jakość odpowiedzi w lokalnych zapytaniach biznesowych.
Gemini 3.5 Flash otrzymał wbudowaną funkcję computer use, umożliwiając tworzenie agentów AI zdolnych do interakcji z różnymi platformami i aplikacjami.
Test programistyczny pokazał zbliżoną skuteczność GLM-5.2 i Opus 4.7, ale dramatyczna różnica w cenie może wywrócić rynek AI do góry nogami.
OpenAI zaprezentowało GPT-5.5-Cyber, który osiąga 85,6% w benchmarku CyberGym, przewyższając konkurencyjny Mythos 5. Nowy model automatyzuje proces od wykrycia luk do łatek.
Zespół Apertus AI wydał kolekcję 16 małych modeli językowych jako demonstrację zaawansowanych technik optymalizacji w ramach projektu suwerennej AI.
CEO OpenAI twierdzi, że badacze zbyt pewnie oceniali ograniczenia LLM. Model OpenAI obalił już matematyczne przypuszczenie nierozwiązane przez lata.
Przetestowaliśmy nową Siri AI z iOS 27. Asystent wykorzystuje Google Gemini, analizuje dane użytkownika i oferuje spersonalizowane odpowiedzi.
Subquadratic opracował model SubQ wykorzystujący rzadką uwagę, która pozwala przetwarzać 12 razy więcej tekstu przy znacznie niższych kosztach energetycznych.
Allen Institute for AI opublikował MolmoMotion — model prognozujący trajektorie ruchu 3D obiektów sterowany językiem naturalnym, wraz z największym zbiorem danych 1,16M filmów.
Administracja Trumpa dała Anthropic 90 minut na wyłączenie dostępu do modeli Mythos 5 i Fable 5 po wykryciu sposobu omijania zabezpieczeń.
Twórca BitTorrenta analizuje drastyczne pogorszenie jakości rozmów z Claude. Nowe wersje są niepotrzebnie konfrontacyjne i trudne w obsłudze.
Model Rio-3.5-Open-397B okazał się 60% Nex i 40% Qwen. Po usunięciu komunikatu systemowego identyfikuje się jako Nex w 79% przypadków.