
DeepSeek V4 Pro 0813: контекст на 1 млн токенів і 17 провайдерів на OpenRouter
DeepSeek випустила GA-версію V4 Pro — MoE-модель із контекстом на мільйон токенів, ціною $0.66 за мільйон вхідних токенів і 17 провайдерами.
DeepSeek опублікувала реліз загальної доступності (GA) DeepSeek V4 Pro. На OpenRouter модель представлена як DeepSeek V4 Pro 0813. Це великомасштабна система типу mixture-of-experts із контекстним вікном 1 048 576 токенів — приблизно мільйон — і підтримкою до 384 000 токенів генерації в одній відповіді.
Ціна та можливості
На OpenRouter ціна становить $0.66 за мільйон вхідних токенів і $1.98 за мільйон вихідних, окремий тариф за читання кешу — $0.022 за мільйон токенів. Модель приймає параметри tools і tool_choice для виклику функцій та підтримує response_format для JSON-виводу — без валідації за JSON-схемою. Ваги опубліковано на Hugging Face під назвою deepseek-ai/DeepSeek-V4-Pro-0813.
Сімнадцять провайдерів в одному ендпоінті
Запити обслуговують 17 провайдерів, серед них сам DeepSeek, StreamLake, Alibaba Cloud International, GMICloud, DeepInfra, CoreWeave, NextBit і Sail Research — з автоматичним перемиканням між ними та маршрутизацією, що дозволяє закріпити або виключити конкретного оператора. За даними OpenRouter, найкраща пропускна здатність P50 — 77 токенів за секунду, найкраща латентність P50 — 0.48 секунди; за останні три дні uptime 100%, доступність — 99.46%.
Бенчмарки
У наведених на сторінці моделі оцінках результати GPQA Diamond коливаються від 86.0% до 90.7% залежно від провайдера, а з автоматичною маршрутизацією сягають 88.6%. У TAU-Bench SiliconFlow заявляє 79.9%, Baseten — 74.7%. OpenRouter зазначає, що доступність за останні 24 години з маршрутизацією становила 99.56% проти 96.94% без неї — нагадування, що досвід користувача визначає не лише модель, а й різноманітність провайдерів.
SiTech — веброзробка з підтримкою AI
Створюємо швидкі та сучасні сайти й інтегруємо AI у бізнес-процеси. Маєте проєкт чи запитання? Із задоволенням допоможемо.