Внутрішній бенчмарк з українського права · 6 серпня 2026
Та сама модель отримала вищу оцінку юридичної якості в PRISM
На тому самому наборі з 40 завдань з українського права GPT 5.6 Solo MAX набрала 154/160 у PRISM4 проти 147/160 в автономному режимі; обидві конфігурації DeepSeek також покращили результат.
Головне порівняння
GPT 5.6 Solo MAX · У PRISM4
154/160 · 96,3%
3,85/4 · 36/40 ідеальних відповідей
GPT 5.6 Solo MAX · автономний режим
147/160 · 91,9%
3,68/4 · 29/40 ідеальних відповідей
Якість 40 відповідей
У PRISM4
36/40
Автономно
29/40
+7 балів
+7 ідеальних відповідей
Результат PRISM на тому самому наборі з 40 тестів. Модель сама по собі — ще не повний продукт.
Внутрішній бенчмарк з українського права, 6 серпня 2026 року. Сорок тестів; максимум 160 балів.
Базовий режим проти режиму оркестрації
Оркестрація покращує результати різних базових моделей
DeepSeek V4 Pro MAX
+5 · +3,1 в.п.
База 144/160 · 90,0% → оркестрація 149/160 · 93,1%
DeepSeek V4 Flash MAX
+9 · +5,6 в.п.
База 127/160 · 79,4% → оркестрація 136/160 · 85,0%
90,0%
144/160
База
93,1%
149/160
Оркестрація
79,4%
127/160
База
85,0%
136/160
Оркестрація
Методика
Один набір тестів. Два режими роботи.
Сорок завдань з українського права оцінювали за чотирибальною шкалою. Кожну базову модель порівнювали з її конфігурацією під оркестрацією PRISM4; максимум — 160 балів за запуск.
01 · Тести
40
02 · Балів за відповідь
4
03 · Максимум
160
04 · Дата запуску
6 серпня 2026
Повна таблиця результатів
GPT 5.6 Solo MAX
- Автономно
- 147/16091,9%
- У PRISM4
- 154/16096,3%
- Приріст
- +7+4,4 в.п.
DeepSeek V4 Pro MAX
- Автономно
- 144/16090,0%
- У PRISM4
- 149/16093,1%
- Приріст
- +5+3,1 в.п.
DeepSeek V4 Flash MAX
- Автономно
- 127/16079,4%
- У PRISM4
- 136/16085,0%
- Приріст
- +9+5,6 в.п.
Кожна протестована конфігурація показала вищий результат з оркестрацією PRISM4.
