root / tags / gemini-2-5-pro
#Gemini 2.5 Pro
2 Fiches
Qualität & Sicherheit · Automatisch geprüfte Übersetzung Anthropic - Messung politischer Verzerrung bei Claude - Ausgewogenheit 94-95% - Paired-Prompts-Methode - Open-Source-Evaluierung - Character Training - Vergleich von 6 Modellen - Neutralitäts-System-Prompt - GitHub
#politische Verzerrung#Ausgewogenheit#KI-Neutralität
Anthropic
Transformation & Adoption · Automatisch geprüfte Übersetzung AI-Benchmarking jenseits von Standardtests - KI-Modelle für spezifische Anwendungsfälle befragen - Jagged Frontier - OpenAI GDPval - Vibes vs. echte Messungen - GuacaDrone-Beispiel - Ethan Mollick - One Useful Thing
#AI-Benchmarking#MMLU-Pro#ARC-AGI
Ethan Mollick