/ Бенчмарки
Настройки API почти втрое улучшили результат GPT-5.6 Sol
1 неделю назад
VoiceEQ проверяет, действительно ли голосовой ИИ звучит как человек
3 недели назад
Perplexity открыла бенчмарк WANDR для исследовательских ИИ-агентов
3 недели назад
Аудит OpenAI выявил серьёзные недостатки в SWE-Bench Pro
1 месяц назад
OpenAI представила GeneBench-Pro для тестирования ИИ в биологии
1 месяц назад