Zrozumienie twierdzeń i dowodów w porównaniu
Gdy wiele modeli odpowie na to samo polecenie, RadAIChat analizuje odpowiedzi i tworzy porównanie. Porównanie jest generowane przez AI i wymaga sprawdzenia z oryginalnymi odpowiedziami i obrazami.
Czytanie podsumowania porównania
Podsumowanie pokazuje liczbę przeanalizowanych modeli i twierdzeń. Twierdzenia są grupowane jako:
- Zgodne: porównywane odpowiedzi potwierdzają twierdzenie.
- Rozbieżne: odpowiedzi są sprzeczne w kwestii twierdzenia.
- Unikalne: twierdzenie występuje tylko w części odpowiedzi.
Użyj dostępnych widoków, aby uporządkować twierdzenia według ustaleń, zgodności lub modeli. Poszczególne twierdzenia mogą też wskazywać kategorię, ciężkość, pewność, modele popierające, sceptyczne i takie, które nie wspomniały o danej kwestii.
„Nie wspomniano” nie musi oznaczać niezgody. Oznacza, że porównanie nie znalazło tego twierdzenia w odpowiedzi modelu.
Sprawdzanie dowodów
Wybierz twierdzenie w panelu porównania. RadAIChat przejdzie do powiązanej odpowiedzi modelu i wyróżni tekst źródłowy związany z twierdzeniem. Sprawdź w ten sposób, jak powstało porównanie, zamiast polegać wyłącznie na podsumowaniu twierdzenia.
Wyróżnienie dowodów odzwierciedla tekst modelu, a nie niezależne potwierdzenie na podstawie obrazów źródłowych.
Jeśli porównanie się nie powiedzie
Wybierz Ponów próbę w panelu porównania. Poczekaj na zakończenie odpowiedzi modeli przed ponowieniem i przejrzyj poszczególne panele nawet bez dostępnego porównania.
Ogólny przebieg pracy opisano w Porównywanie odpowiedzi modeli.