Gemini 2.0 Flash Thinking Experimental Small
GoogleGemini 2.0 Flash Thinking Experimental (янв. 2025) демонстрирует уровень интеллекта выше среднего и является хорошо сбалансированным по цене решением при сравнении с другими моделями аналогичного ценового сегмента. Модель поддерживает ввод текста, изображений, аудио и видео, а также генерирует выходные данные в виде текста, изображений и аудио, обладает контекстным окном объемом 1 млн токенов и знаниями, актуальными по август 2024 года.
Обзор
Gemini 2.0 Flash Thinking Experimental (янв. 2025) демонстрирует уровень интеллекта выше среднего и является хорошо сбалансированным по цене решением при сравнении с другими моделями аналогичного ценового сегмента. Модель поддерживает ввод текста, изображений, аудио и видео, а также генерирует выходные данные в виде текста, изображений и аудио, обладает контекстным окном объемом 1 млн токенов и знаниями, актуальными по август 2024 года.
Бенчмарки
| Бенчмарк | Значение |
|---|---|
| GPQA Diamond наука, экспертный уровень | 70.1% |
| HLE Humanity's Last Exam | 7.1% |
| MMLU-Pro знания, 12K вопросов | 79.8% |
| SciCode научный код | 32.9% |
| MATH-500 математика | 94.4% |
| LiveCodeBench генерация кода | 32.1% |
Производительность и цена
Сравнение
| Модель | Index | Код | Контекст | Цена $/1M | Скорость |
|---|---|---|---|---|---|
| GO Gemini 2.0 Flash Thinking Experimental | 13.3 | 32 | 1m | 0 | — |
| AL Qwen3 VL 30B A3B | 13.3 | 70 | 256k | 0.3375 | 124 |
| GO Gemma 4 12B | 13.2 | — | 262k | 0.15 | 147 |
| MI Devstral Small 2 | 13.1 | 35 | 256k | 0 | 48 |