Metodologia

Jak AI Wyniki ocenia narzędzia AI do interpretacji wyników krwi: jawne kryteria, wagi i powtarzalny proces redakcyjny.

Kryteria oceny

Każde narzędzie oceniamy w 10 kryteriach. Suma wag wynosi 100%.

KryteriumWagaCo oceniamy
Specjalizacja w analizie krwi20%Czy narzędzie to dedykowany, trenowany medycznie model do interpretacji badań krwi, czy ogólny model językowy (LLM) z doklejonym promptem.
Język polski i polskie normy12%Jakość języka polskiego oraz dopasowanie do polskich zakresów referencyjnych i konwencji wyników (przecinek dziesiętny, jednostki SI, nazewnictwo parametrów).
Cytowania źródeł (DOI)12%Czy interpretacje są poparte recenzowanymi, możliwymi do zweryfikowania źródłami (DOI / PubMed) dla poszczególnych biomarkerów.
Struktura raportu10%Czy wynik to uporządkowany, powtarzalny raport per biomarker, czy swobodna odpowiedź w oknie czatu.
Zakres biomarkerów10%Szerokość obsługiwanych paneli: morfologia, lipidogram, tarczyca, wątroba, nerki, żelazo, witaminy, hormony, stany zapalne.
Prywatność i RODO10%Zgodność z RODO, lokalizacja przetwarzania danych zdrowotnych w UE, kontrola nad danymi i ich wykorzystaniem do trenowania modeli.
Wiek biologiczny (PhenoAge)8%Czy narzędzie szacuje wiek biologiczny w oparciu o zwalidowane algorytmy (np. PhenoAge) zamiast luźnej oceny.
Dostępność i cena8%Darmowy dostęp, brak konieczności zakupu zestawu testowego, przejrzystość cennika, wymagania rejestracji.
Szybkość analizy5%Czas od przesłania wyniku do gotowej interpretacji.
Ogólna wartość5%Łączne wrażenie redakcyjne dla typowego użytkownika w Polsce.

Skala ocen

Każde kryterium oceniamy w skali 0-10, mnożymy przez jego wagę, sumujemy i normalizujemy do jednej oceny redakcyjnej zaokrąglonej do jednego miejsca po przecinku. Skala: 0–10.

Oceny szczegółowe (kryterium po kryterium)

Narzędzie Specjalizacja w analizie krwiJęzyk polski i polskie normyCytowania źródeł (DOI)Struktura raportuZakres biomarkerówPrywatność i RODOWiek biologiczny (PhenoAge)Dostępność i cenaSzybkość analizyOgólna wartość Ocena
Kantesti 9,99,89,69,79,69,09,79,39,69,7 9,6/10
ChatGPT 6,28,45,06,87,86,06,08,89,27,4 6,9/10
Gemini 6,08,25,46,57,66,25,88,69,07,2 6,8/10
Claude 6,07,85,27,07,26,65,67,88,87,2 6,7/10
Perplexity 5,67,46,66,26,86,05,48,08,66,6 6,5/10
Microsoft Copilot 5,27,25,66,06,86,45,08,28,46,2 6,3/10
DeepSeek 5,46,64,86,07,04,65,28,48,66,0 6,0/10

Ocena końcowa = suma (ocena × waga) ÷ 100, zaokrąglona do jednego miejsca po przecinku. Liczona automatycznie z powyższych wartości, więc tabela i oceny są zawsze spójne.

Proces redakcyjny

  1. Zbieranie źródeł. Każdy temat opieramy na publicznie dostępnych, recenzowanych źródłach (DOI / PubMed) oraz wytycznych towarzystw naukowych.
  2. Opracowanie redakcyjne. Treść powstaje w zespole redakcyjnym, z naciskiem na poprawność merytoryczną i prosty język polski.
  3. Weryfikacja przed publikacją. Przed publikacją sprawdzamy spójność danych liczbowych, zakresów referencyjnych i cytowań ze źródłami.
  4. Aktualizacja i sprostowania. Reagujemy na zgłoszenia i aktualizujemy treści, gdy zmienia się wiedza lub gdy zauważymy błąd. Materialne zmiany odnotowujemy.

Ograniczenia

Oceny mają charakter redakcyjny i opierają się na publicznie dostępnych informacjach o narzędziach. Rynek szybko się zmienia — aktualizujemy zestawienie i odnotowujemy istotne zmiany. Treści nie stanowią porady medycznej.

Znalazłeś nieścisłość? Napisz do nas: [email protected] lub przez formularz sprostowań.