Цена на кэш входных данных DeepSeek API снижена до одной десятой от первоначальной
Ведущая отечественная крупномасштабная языковая модель DeepSeek недавно объявила о значительном снижении цен, сократив стоимость использования кэша входных данных для всех серий API до одной десятой от первоначальной стоимости. Этот шаг знаменует собой новый этап в управлении затратами в сфере отечественного ИИ и направлен на привлечение большего числа разработчиков и предприятий за счет предложения исключительного соотношения цены и качества.
Снижение цен на основные услуги решает проблемы отрасли
Данная корректировка цен охватывает всю серию V4-Pro и V4-Flash. Стоимость кэша ввода для V4-Pro была снижена до 0,1 юаня за миллион токенов, а благодаря ограниченной по времени акции фактическая оплата составляет всего 0,025 юаня. По сравнению с зарубежными конкурентами цена на входной кэш составляет всего 1/700 от стоимости GPT-5.5 Pro, что демонстрирует высокую конкурентоспособность на рынке.
Помимо сценариев попадания в кэш, цены на сценарии промаха кэша и вывода также были снижены до одной четверти от первоначальной стоимости. Эта ценовая стратегия точно нацелена на сценарии высокочастотного использования, такие как базы знаний RAG, интеллектуальное обслуживание клиентов и анализ документов, что потенциально может сократить операционные расходы предприятий более чем на 90%.

Способность DeepSeek значительно снизить цены обусловлена самостоятельно разработанной архитектурой разреженного внимания. Эта технология поддерживает обработку сверхдлинного контекста объемом до 160K, повышая эффективность обработки длинных текстов и одновременно эффективно снижая потребление вычислительной мощности и затраты на хранение данных.
Связанная статья
Умные очки Apple могут быть представлены на WWDC27 с акцентом на защиту конфиденциальности
Журналист Bloomberg Марк Гурман сообщает, что умные очки Apple под кодовым названием N50 должны дебютировать на WWDC27 в июне 2027 года, а их розничные продажи ожидаются осенью 2027 года. Изначально выпуск устройства планировался на конец этого года
Внутри раскрыты подробности о Gemini следующего поколения: ограниченные вычислительные мощности, внутренние команды не сошлись в вопросах приоритетов разработки и распределения ресурсов
В отчётах указывается, что запуск долгожданной модели Gemini следующего поколения от Google был перенесён. Внутренние разногласия по вопросам приоритетов разработки и распределения ресурсов, в сочетании с ограниченной вычислительной мощностью и сложн
OpenAI отклоняет опасения по поводу замедления роста, заявляя о ускорении работы нескольких бизнес-подразделений
В ответ на внешнюю критику, связанную с замедлением роста продаж и невыполнением внутренних плановых показателей, лидер в области искусственного интеллекта компания OpenAI опубликовала во вторник, 28 апреля, уверенное заявление. Компания уточнила, чт
Рекомендации по связанным специальным темам
Комментарии (0)
Ведущая отечественная крупномасштабная языковая модель DeepSeek недавно объявила о значительном снижении цен, сократив стоимость использования кэша входных данных для всех серий API до одной десятой от первоначальной стоимости. Этот шаг знаменует собой новый этап в управлении затратами в сфере отечественного ИИ и направлен на привлечение большего числа разработчиков и предприятий за счет предложения исключительного соотношения цены и качества.
Снижение цен на основные услуги решает проблемы отрасли
Данная корректировка цен охватывает всю серию V4-Pro и V4-Flash. Стоимость кэша ввода для V4-Pro была снижена до 0,1 юаня за миллион токенов, а благодаря ограниченной по времени акции фактическая оплата составляет всего 0,025 юаня. По сравнению с зарубежными конкурентами цена на входной кэш составляет всего 1/700 от стоимости GPT-5.5 Pro, что демонстрирует высокую конкурентоспособность на рынке.
Помимо сценариев попадания в кэш, цены на сценарии промаха кэша и вывода также были снижены до одной четверти от первоначальной стоимости. Эта ценовая стратегия точно нацелена на сценарии высокочастотного использования, такие как базы знаний RAG, интеллектуальное обслуживание клиентов и анализ документов, что потенциально может сократить операционные расходы предприятий более чем на 90%.

Способность DeepSeek значительно снизить цены обусловлена самостоятельно разработанной архитектурой разреженного внимания. Эта технология поддерживает обработку сверхдлинного контекста объемом до 160K, повышая эффективность обработки длинных текстов и одновременно эффективно снижая потребление вычислительной мощности и затраты на хранение данных.
Умные очки Apple могут быть представлены на WWDC27 с акцентом на защиту конфиденциальности
Журналист Bloomberg Марк Гурман сообщает, что умные очки Apple под кодовым названием N50 должны дебютировать на WWDC27 в июне 2027 года, а их розничные продажи ожидаются осенью 2027 года. Изначально выпуск устройства планировался на конец этого года
Внутри раскрыты подробности о Gemini следующего поколения: ограниченные вычислительные мощности, внутренние команды не сошлись в вопросах приоритетов разработки и распределения ресурсов
В отчётах указывается, что запуск долгожданной модели Gemini следующего поколения от Google был перенесён. Внутренние разногласия по вопросам приоритетов разработки и распределения ресурсов, в сочетании с ограниченной вычислительной мощностью и сложн
OpenAI отклоняет опасения по поводу замедления роста, заявляя о ускорении работы нескольких бизнес-подразделений
В ответ на внешнюю критику, связанную с замедлением роста продаж и невыполнением внутренних плановых показателей, лидер в области искусственного интеллекта компания OpenAI опубликовала во вторник, 28 апреля, уверенное заявление. Компания уточнила, чт





Дом






