BenchVibe AI Ecosystem

VIP 👤

🏠 Home

Benchmark

📊 Tutti i benchmark 🦖 Dinosauro v1 🦖 Dinosauro v2 ✅ App To-Do List 🎨 Pagine libere creative 🎯 FSACB - Ultimate Showcase 🌍 Benchmark traduzione

Modelli

🏆 Top 10 modelli 🆓 Modelli gratuiti 📋 Tutti i modelli ⚙️ Kilo Code

Risorse

💬 Libreria di prompt 📖 Glossario IA 🔗 Link utili

📖

Benchmarks et Évaluation

TruthfulQA

Benchmark conçu pour mesurer la tendance des LLM à générer des réponses vraies plutôt que de répéter des faux renseignements fréquemment trouvés dans les données d'entraînement, évaluant la capacité à distinguer vérité de fausseté.

← Indietro