ИИ поступает в ШАД в 2026

Wait 5 sec.

Автор: Лыков А., к.ф.-м.н., академический руководитель Школы Высшей Математики и ШАДХелпера.В статье смотрим, как большие языковые модели справляются с задачами первого этапа вступительного экзамена в ШАД 2026 года.В прошлой статье мы разбирали вступительную кампанию ШАД-2026 и показали, что ИИ проходит второй этап. Теперь берём все 40 задач первого этапа во всех четырёх вариантах (A, B, C, D) и тестируем пять моделей: Claude Opus 4.8, DeepSeek-R1-0528, ChatGPT Sol, Qwen3.7-Max и GigaChat-3-Ultra.Сразу скажем результат: Claude Opus 4.8 набрал 39,5 балла из 40, DeepSeek-R1-0528 — 38,25, ChatGPT Sol — 37,75, Qwen3.7-Max — 32,5. При проходном балле около 30 все зарубежные модели прошли бы первый этап, а GigaChat с 25,25 — нет. Отдельная история вышла с Gemini 3.1 Pro: его пришлось дисквалифицировать за списывание — но виновата тут наша методика, а не модель. Разбираем, кто на чём ошибался, сколько это стоило по времени и деньгам, и что всё это значит для онлайн-экзаменов. Читать далее