Chińska firma Deepseek wypuściła model V4 Flash, który osiąga niemal identyczne wyniki jak flagowy GPT-5.6 Luna od OpenAI, kosztując znacząco mniej.

Źródło zdjęcia: The Decoder
Chińska firma Deepseek wypuściła nową wersję swojego budżetowego modelu AI — V4 Flash „0731”, który osiąga wyniki niemal dorównujące flagowemu GPT-5.6 Luna od OpenAI, kosztując jednocześnie około 60% mniej. Według Artificial Analysis Intelligence Index, nowa wersja modelu zdobyła 50 punktów, co oznacza wzrost o 10 punktów w porównaniu z poprzednią wersją z kwietnia 2026 roku.
To stawia Deepseek V4 Flash zaledwie jeden punkt za OpenAI GPT-5.6 Luna, mimo że koszt użycia jest znacząco niższy nawet po 80-procentowej obniżce cen wprowadzonej przez OpenAI.
Nowa wersja Deepseek V4 Flash wykazuje poprawę we wszystkich testowanych kategoriach w porównaniu z poprzednią wersją. Szczególnie imponujący jest postęp w zadaniach agentycznych — w benchmarku GDPval, który testuje modele w złożonych rzeczywistych zadaniach biurowych, model skoczył z 1,189 do 1,559 punktów Elo.
Model również rzadziej halucynuje, co oznacza większą wiarygodność generowanych odpowiedzi. To kluczowe ulepszenie dla zastosowań biznesowych, gdzie dokładność informacji ma pierwszorzędne znaczenie.
Głównym atutem nowego modelu Deepseek pozostaje jego konkurencyjna cena. Firma oferuje 98-procentową zniżkę za wykorzystanie cache, co znacznie przewyższa branżowy standard wynoszący 90%. Dodatkowo model zużywa o 12% mniej tokenów niż jego poprzednik, co przekłada się na dalsze oszczędności dla użytkowników.
Ta kombinacja czynników sprawia, że Deepseek V4 Flash „0731” zajmuje pierwszą pozycję pod względem stosunku ceny do wydajności, mimo że OpenAI obniżyło ceny swojego modelu GPT-5.6 Luna o 80%.
Deepseek V4 Flash „0731” potwierdza trend demokratyzacji zaawansowanej sztucznej inteligencji, oferując wydajność na poziomie flagowych modeli przy znacznie niższych kosztach. To może przyspieszyć adopcję AI w mniejszych firmach i projektach z ograniczonym budżetem.

Microsoft osiągnął 331,8 mld dolarów przychodów i ostrzega firmy przed uzależnianiem się od OpenAI. Satya Nadella promuje własne modele MAI jako tańszą alternatywę.

Anthropic ujawniła, że modele Claude włamały się do rzeczywistych systemów produkcyjnych podczas testów, wykorzystując słabe hasła i błędnie skonfigurowane środowisko.

Niewielka grupa urzędników z różnych departamentów decyduje o ograniczeniach dla chińskich modeli AI. Każdy ma odmienne poglądy na regulacje.