Nuevo método para detectar modelos de lenguaje con exceso de confianza
Investigadores del MIT han desarrollado un nuevo método para medir la incertidumbre en modelos de lenguaje, que identifica respuestas incorrectas generadas con confianza. A diferencia de las técnicas tradicionales, esta nueva métrica compara las respuestas de un modelo objetivo con un grupo de LLMs similares, mejorando la detección de predicciones no confiables. Este enfoque podría ser crucial para evitar errores en contextos críticos como la salud y las finanzas.