Kopilot · ölçülen sonuçlar

gerçek muayene kayıtlarında: ne söylendi → kim söyledi → hangi tanı → hangi alan

Kendi kayıtlarımızda ne çıktı dört gerçek muayene kaydı

Nereye geldik . koşum · altı katman, hepsi ölçülü

Muayene konuşmasından hastane sisteminin form alanlarına: ne söylendi → kim söyledi → hangi bulgu → hangi tanı → hangi kural → hangi alan. Aşağıdaki sayıların hepsi TEK bir koşumdan geliyor ve hiçbiri tahmin değil; hangi koşum olduğu sayfanın altında yazıyor.

Hata iki ayda yarıdan aza indi

Gerçek muayene kayıtlarında %20.5 → %8.8. Eşikler sayılar çıkmadan önce yazıldı.

Kazanç hazır modelden değil, bizim katmandan

Aynı ses, aynı puanlayıcı: stok pyannote'ta konuşmacı karışımı %14.5, ürünün hattında %2.7; küme sayısı sekiz kayıtta da doğru. Whisper'ın iki kat büyüğünde fark 0.0001 çıktı, o yüzden turbo kaldı.

Karar veren katmanların hiçbiri dil modeli değil

Tanıyı açık bir istatistik sıralıyor, kuralları modelsiz bir motor çalıştırıyor. Dil modeli yalnız metni anlıyor — ve yedi ucun yedisinde de bir kapı var.

Açık kalanlar da sayıyla biliniyor

Gerçek kayıtlarda düşen tek kapı klinik hata: 9 kaçan / 168 öğe, yani eşiğin 0.4 puan üstünde. Dokuzun içinde iki bulgu gerçekten yanlış duyulmuş ("nefes darlığı" → "nefes dallığı"), kalanı miktar. Üçüncü kişiyi ürünün hattı hâlâ ayıramıyor — iki küme açıyor — ve bunun ölçülmüş bir cevabı var: aday ayrıştırıcı üç küme açıp %81.2 → %98.3 yapıyor. Tanı grafı hastalık başına dört bulgu; kural içeriği henüz gerçek mevzuat değil.

Proje altı katman bir katmana tıklayın — ölçümüyle birlikte açılır