GigaChat 3.1 обходит DeepSeek в математике, а новый бенчмарк AGI ставит все модели на 0,37% от человека Сбер выпустил две MoE-модели под MIT-лицензией, которые превосходят DeepSeek-V3 в reasoning-задачах. Параллельно Франсуа Шолле показал бенчмарк ARC-AGI-3, где Gemini 3.1 Pro набирает 0,37% от человеческого результата — разрыв не в производительности, а в способности обобщать. Кто и как исследовал Сбер опубликовал технический отчёт по семейству GigaChat 3.1 с результатами внутреннего тестирован…