Привет, Хабр! Сегодня мы выясним, какая из нейросетей лучше справляется с программированием. На тесте у нас GPT-5.1, Grok от xAI, DeepSeek, обновлённая Алиса от Яндекса и GigaChat от Сбера. Мы ставили перед моделями задачу: найти самую длинную подстроку-палиндром в строке. Все модели получили один и тот же запрос и предоставили свои решения на Python.
GPT-5.1 применил динамическое программирование и выдал готовый код за считанные секунды, продемонстрировав отличную оптимизацию и документацию. Grok выбрал метод расширения вокруг центра, продемонстрировав лаконичное и понятное решение. DeepSeek использовал схожий подход, но с меньшим количеством комментариев.
Алиса, хоть и немного затянула с ответом, также представила рабочий код. GigaChat удивил тем, что предоставил не только код, но и пояснения к нему. Все модели успешно справились с задачей, но GPT-5.1, безусловно, показал наилучший результат, подчеркивая свою универсальность и надежность. В целом, нейросети 2025 года продемонстрировали впечатляющие результаты в программировании.