Phi-4 Multimodal Instruct Small
MicrosoftДемонстрирует уровень Intelligence Index ниже среднего, но предлагает выгодное соотношение цены и качества по сравнению с другими моделями с открытыми весами (open weights), не обладающими способностью к рассуждению (reasoning) и имеющими сопоставимый размер. Модель поддерживает ввод текста, изображений и речи, генерирует текстовый вывод и имеет контекстное окно объемом 128 тысяч токенов, с базой знаний, актуальной по июнь 2024 года.
Обзор
Демонстрирует уровень Intelligence Index ниже среднего, но предлагает выгодное соотношение цены и качества по сравнению с другими моделями с открытыми весами (open weights), не обладающими способностью к рассуждению (reasoning) и имеющими сопоставимый размер. Модель поддерживает ввод текста, изображений и речи, генерирует текстовый вывод и имеет контекстное окно объемом 128 тысяч токенов, с базой знаний, актуальной по июнь 2024 года.
Бенчмарки
| Бенчмарк | Значение |
|---|---|
| GPQA Diamond наука, экспертный уровень | 31.5% |
| HLE Humanity's Last Exam | 4.4% |
| MMLU-Pro знания, 12K вопросов | 48.5% |
| SciCode научный код | 11% |
| MATH-500 математика | 69.3% |
| LiveCodeBench генерация кода | 13.1% |
| HumanEval генерация кода | 72.9% |
Производительность и цена
Сравнение
| Модель | Index | Код | Контекст | Цена $/1M | Скорость |
|---|---|---|---|---|---|
| MI Phi-4 Multimodal Instruct | 4.5 | 13 | 128k | 0 | 16 |
| NV NVIDIA Nemotron Nano 12B v2 VL | 4.6 | 35 | 128k | 0.3 | 221 |
| AL Qwen3.5 0.8B | 4.4 | — | 262k | 0.02 | 29 |
| AN Claude 3 Sonnet | 4.7 | 17 | 200k | 6 | — |