Социальные тесты разоблачили слабость ИИ в переговорах

Тесты LLM оценивают логику и математику, но не учат ИИ вести переговоры или читать эмоции. А что, если поставить нейросеть в сложный диалог? 💬 Новые бенчмарки — не сухие метрики, а социальный тест: как ИИ адаптируется, договаривается и строит стратегии в реальных ситуациях? 🤖 #ИИвдействии

💬 Экспертное мнение:
Исследования, выходящие за рамки традиционных тестов, открывают интересную перспективу: понимание социальных нюансов и умение вести диалог могут стать важным критерием для будущих моделей, что делает их более естественными в реальных взаимодействиях, где логика и эмпатия идут рука об руку.

🔗 Читать в источнике

#IT #News #Tech
❓ Как языковые модели будут вести переговоры в сложных социальных ситуациях? #ЭкспертноеМнение