EQ-Bench Cómo evaluar la inteligencia emocional y la creatividad en grandes modelos lingüísticos
A medida que las capacidades de los grandes modelos lingüísticos (LLM) evolucionan con rapidez, las pruebas de referencia tradicionales, como MMLU, muestran sus limitaciones a la hora de distinguir los mejores modelos. Basarse únicamente en cuestionarios de conocimientos o pruebas estandarizadas dificulta la medición completa de las capacidades matizadas de los modelos que son cruciales en las interacciones del mundo real, como...
























![[转载]QwQ-32B 的工具调用能力及 Agentic RAG 应用](https://aisharenet.com/wp-content/uploads/2025/03/b04be76812d1a15.jpg)





























































