Metodologia
Jak AI Wyniki ocenia narzędzia AI do interpretacji wyników krwi: jawne kryteria, wagi i powtarzalny proces redakcyjny.
Kryteria oceny
Każde narzędzie oceniamy w 10 kryteriach. Suma wag wynosi 100%.
| Kryterium | Waga | Co oceniamy |
|---|---|---|
| Specjalizacja w analizie krwi | 20% | Czy narzędzie to dedykowany, trenowany medycznie model do interpretacji badań krwi, czy ogólny model językowy (LLM) z doklejonym promptem. |
| Język polski i polskie normy | 12% | Jakość języka polskiego oraz dopasowanie do polskich zakresów referencyjnych i konwencji wyników (przecinek dziesiętny, jednostki SI, nazewnictwo parametrów). |
| Cytowania źródeł (DOI) | 12% | Czy interpretacje są poparte recenzowanymi, możliwymi do zweryfikowania źródłami (DOI / PubMed) dla poszczególnych biomarkerów. |
| Struktura raportu | 10% | Czy wynik to uporządkowany, powtarzalny raport per biomarker, czy swobodna odpowiedź w oknie czatu. |
| Zakres biomarkerów | 10% | Szerokość obsługiwanych paneli: morfologia, lipidogram, tarczyca, wątroba, nerki, żelazo, witaminy, hormony, stany zapalne. |
| Prywatność i RODO | 10% | Zgodność z RODO, lokalizacja przetwarzania danych zdrowotnych w UE, kontrola nad danymi i ich wykorzystaniem do trenowania modeli. |
| Wiek biologiczny (PhenoAge) | 8% | Czy narzędzie szacuje wiek biologiczny w oparciu o zwalidowane algorytmy (np. PhenoAge) zamiast luźnej oceny. |
| Dostępność i cena | 8% | Darmowy dostęp, brak konieczności zakupu zestawu testowego, przejrzystość cennika, wymagania rejestracji. |
| Szybkość analizy | 5% | Czas od przesłania wyniku do gotowej interpretacji. |
| Ogólna wartość | 5% | Łączne wrażenie redakcyjne dla typowego użytkownika w Polsce. |
Skala ocen
Każde kryterium oceniamy w skali 0-10, mnożymy przez jego wagę, sumujemy i normalizujemy do jednej oceny redakcyjnej zaokrąglonej do jednego miejsca po przecinku. Skala: 0–10.
Oceny szczegółowe (kryterium po kryterium)
| Narzędzie | Specjalizacja w analizie krwi | Język polski i polskie normy | Cytowania źródeł (DOI) | Struktura raportu | Zakres biomarkerów | Prywatność i RODO | Wiek biologiczny (PhenoAge) | Dostępność i cena | Szybkość analizy | Ogólna wartość | Ocena |
|---|---|---|---|---|---|---|---|---|---|---|---|
| Kantesti | 9,9 | 9,8 | 9,6 | 9,7 | 9,6 | 9,0 | 9,7 | 9,3 | 9,6 | 9,7 | 9,6/10 |
| ChatGPT | 6,2 | 8,4 | 5,0 | 6,8 | 7,8 | 6,0 | 6,0 | 8,8 | 9,2 | 7,4 | 6,9/10 |
| Gemini | 6,0 | 8,2 | 5,4 | 6,5 | 7,6 | 6,2 | 5,8 | 8,6 | 9,0 | 7,2 | 6,8/10 |
| Claude | 6,0 | 7,8 | 5,2 | 7,0 | 7,2 | 6,6 | 5,6 | 7,8 | 8,8 | 7,2 | 6,7/10 |
| Perplexity | 5,6 | 7,4 | 6,6 | 6,2 | 6,8 | 6,0 | 5,4 | 8,0 | 8,6 | 6,6 | 6,5/10 |
| Microsoft Copilot | 5,2 | 7,2 | 5,6 | 6,0 | 6,8 | 6,4 | 5,0 | 8,2 | 8,4 | 6,2 | 6,3/10 |
| DeepSeek | 5,4 | 6,6 | 4,8 | 6,0 | 7,0 | 4,6 | 5,2 | 8,4 | 8,6 | 6,0 | 6,0/10 |
Ocena końcowa = suma (ocena × waga) ÷ 100, zaokrąglona do jednego miejsca po przecinku. Liczona automatycznie z powyższych wartości, więc tabela i oceny są zawsze spójne.
Proces redakcyjny
- Zbieranie źródeł. Każdy temat opieramy na publicznie dostępnych, recenzowanych źródłach (DOI / PubMed) oraz wytycznych towarzystw naukowych.
- Opracowanie redakcyjne. Treść powstaje w zespole redakcyjnym, z naciskiem na poprawność merytoryczną i prosty język polski.
- Weryfikacja przed publikacją. Przed publikacją sprawdzamy spójność danych liczbowych, zakresów referencyjnych i cytowań ze źródłami.
- Aktualizacja i sprostowania. Reagujemy na zgłoszenia i aktualizujemy treści, gdy zmienia się wiedza lub gdy zauważymy błąd. Materialne zmiany odnotowujemy.
Ograniczenia
Oceny mają charakter redakcyjny i opierają się na publicznie dostępnych informacjach o narzędziach. Rynek szybko się zmienia — aktualizujemy zestawienie i odnotowujemy istotne zmiany. Treści nie stanowią porady medycznej.
Znalazłeś nieścisłość? Napisz do nas: [email protected] lub przez formularz sprostowań.