Naukowcy przedstawili SemantiClean — system analizy zachowań użytkowników e-commerce stawiający na transparentność zamiast maksymalną dokładność predykcji.

Źródło zdjęcia: arXiv.org
Naukowcy z Chin opublikowali nowy framework o nazwie SemantiClean, który umożliwia audytowalne wnioskowanie o zachowaniach użytkowników w e-commerce. Badanie, dostępne w preprints arXiv, przedstawia alternatywę dla konwencjonalnych systemów predykcyjnych, stawiając na transparentność zamiast maksymalną dokładność.
SemantiClean różni się od konwencjonalnych predictorów end-to-end tym, że świadomie rezygnuje z marginalnych zysków predykcyjnych na rzecz transparentności na poziomie elementów i obronnych ścieżek decyzyjnych. Framework wprowadza strukturalne zarządzanie przez organizację sygnałów behawioralnych w uporządkowaną hierarchię warstw.
Czterowarstwowa architektura obejmuje poziomy funkcjonalny, interakcyjny, systemowy i kontekstualny, co pozwala na systematyczne podejście do analizy zachowań użytkowników. Każdy z 24 elementów behawioralnych ma przypisane miejsce w tej strukturze, co ułatwia audyt i kontrolę jakości wyników.
Kluczowym elementem jest LLM-Integrated Semantic Inference Engine — dwufazowa architektura inferencyjna napędzana przez duże modele językowe. Silnik wykorzystuje kompletne metadane elementów w czasie wnioskowania, co pozwala na bardziej kontekstowe analizy.
System zapewnia pełną reprodukowalność wyników deterministycznych z sigma równą zero. Wyniki zależne od LLM podlegają kontrolowanej zmienności przy ustalonych ustawieniach dostawcy, modelu i temperatury. Autorzy zaznaczają, że cel inferencji płci pozostaje niefunkcjonalny w obecnej implementacji i jest wykluczony z wszystkich wyników ilościowych.
Framework implementuje trzy mechanizmy anty-inflacyjne mające na celu zachowanie jakości sygnału. RedundancyGroup wprowadza limity wkładu, które zapobiegają nadmiernej reprezentacji podobnych sygnałów. TieredPenaltyCalculator stosuje kary za bias, a AdaptiveConstraintMode radzi sobie z problemami cold-start w nowych scenariuszach.
SemantiClean reprezentuje podejście, w którym explainable AI spotyka się z praktycznymi zastosowaniami e-commerce, oferując narzędzie do audytowalnej analizy intencji użytkowników przy zachowaniu kontroli nad procesem decyzyjnym.

A.G. Sulzberger wydaje fortunę na proces z OpenAI i Microsoft, ostrzegając przed egzystencjalnym zagrożeniem dla mediów ze strony sztucznej inteligencji.

NVIDIA wdraża procesory Vera w przepływach EDA, osiągając 1,5x wyższą wydajność w testach z Cadence i Synopsys przy projektowaniu przyszłych chipów.

Google Chrome przechodzi na wydawanie łatek bezpieczeństwa dwa razy w tygodniu. Powodem jest wykorzystanie AI do znajdowania luk — w czerwcu naprawiono 1072 błędy.