Дом
Claude Mythos дебютировал по цене 125 долларов за 1 млн токенов; метод «экономного пещерного человека» набирает популярность
Недавно компания Anthropic представила модель искусственного интеллекта Claude Mythos, которую называют самой мощной из всех выпущенных до сих пор. Однако ценовая политика вызвала настоящий шок в сообществе разработчиков: стоимость генерации результатов установлена на уровне 125 долларов за миллион токенов, что почти в восемь раз превышает стоимость текущей флагманской модели Claude Sonnet 4.6.

В центре внимания: непомерно дорогой Mythos
Ценовая структура Claude Mythos знаменует начало новой эры надбавок за вычислительную мощность ИИ:
Непомерно высокие затраты: стоимость ввода и вывода данных составляет 25 и 125 долларов за миллион токенов соответственно. Для сравнения: Claude Sonnet 4.6 обходится всего в 3 и 15 долларов.
Высокий барьер для входа: из-за своей чрезвычайной мощности и стоимости модель пока недоступна для обычных пользователей. Некоторые пользователи Reddit в шутку отмечают, что даже простое «Привет» может израсходовать 13 % месячного лимита токенов.
Самоспасение гиков: вирусный метод «Caveman»
Поскольку стоимость токенов сопоставима со стоимостью золота, разработчики прибегают к крайним мерам экономии. Один проект под метким названием «Caveman» быстро стал вирусным на GitHub:
Основная логика: он заставляет ИИ исключать все любезности (такие как «Рад вам помочь»), убирать артикли, избегать расплывчатых разговоров и выдавать только необходимые технические термины.
Впечатляющие результаты: тесты показывают, что этот режим «языка пещерного человека» позволяет сэкономить примерно 65 % токенов без ущерба для точности результатов.
Научное обоснование: Исследования показывают, что принуждение модели к выработке лаконичных ответов не только снижает затраты, но и устраняет негативные последствия излишнего размышления, повышая точность по некоторым тестам на 26%.
Практические советы: 10 приёмов для экономии токенов
Помимо технических решений, обычные пользователи могут обойти «убийцу токенов», изменив свои привычки взаимодействия:
Редактируйте на месте: если результат вас не устраивает, воспользуйтесь кнопкой «Редактировать», чтобы уточнить исходный запрос, тем самым предотвратив повторные расходы из-за длинных бесед.
Сокращайте диалоги: начинайте новый чат каждые 15–20 сообщений, чтобы избежать накопления контекста, превращающегося в «черную дыру» токенов.
Объединяйте вопросы: объединяйте несколько инструкций в одно сообщение, чтобы снизить нагрузку на систему.
Разумно используйте пространство проектов: загружайте длинные документы в «Проекты» и используйте кэширование, чтобы документ не сканировался повторно.
По возможности переходите на более дешевые модели: делегируйте простые задачи, такие как проверка грамматики, более дешевым моделям, например Haiku, оставляя дорогостоящую модель Claude Mythos для сложных задач.
Используйте часы вне пиковых нагрузок: избегайте пикового периода с 5:00 до 11:00 по тихоокеанскому времени, чтобы воспользоваться более низкими ценами.
Заключение: от расточительности к точности
От коротких сообщений в 2000 году, оплачиваемых за слово, до сегодняшних крупных моделей, оплачиваемых за токен, наше стремление к эффективности коммуникации прошло полный круг. Это эра дорогостоящего ИИ, которую открыл Claude Mythos .
Связанная статья
Генеральный директор DeepMind Хассабис: я сплю шесть часов в день, обычно чувствую прилив энергии около часа ночи.
В недавнем интервью журналу Fortune генеральный директор Google DeepMind Демис Хаассабис раскрыл свой нестандартный подход к отдыху и продуктивности. Хаассабис признался, что спит очень мало, распределяя свои бодрствующие часы на два отдельных рабочи
OpenAI и Anthropic борются за долю рынка, несмотря на снижение выручки
Несмотря на недавние сообщения о том, что OpenAI не достигла целевых показателей по выручке, что во вторник оказало давление на акции технологических компаний, частные инвесторы, вкладывающие средства
Соблюдение требований к автономным транспортным средствам в Калифорнии: новая эра штрафов, геозоны и 1 млн миль
Компания Guident эксплуатирует шаттл AuveTech в Южной Флориде, обслуживая маршрут протяженностью четыре мили в Вест-Палм-Бич и маршрут протяженностью одну милю в Бока-Ратоне с использованием своей тех
Рекомендации по связанным специальным темам
Комментарии (0)
Недавно

В центре внимания: непомерно дорогой Mythos
Ценовая структура
Непомерно высокие затраты: стоимость ввода и вывода данных составляет 25 и 125 долларов за миллион токенов соответственно. Для сравнения:
Высокий барьер для входа: из-за своей чрезвычайной мощности и стоимости модель пока недоступна для обычных пользователей. Некоторые пользователи Reddit в шутку отмечают, что даже простое «Привет» может израсходовать 13 % месячного лимита токенов.
Самоспасение гиков: вирусный метод «Caveman»
Поскольку стоимость токенов сопоставима со стоимостью золота, разработчики прибегают к крайним мерам экономии. Один проект под метким названием «Caveman» быстро стал вирусным на GitHub:
Основная логика: он заставляет ИИ исключать все любезности (такие как «Рад вам помочь»), убирать артикли, избегать расплывчатых разговоров и выдавать только необходимые технические термины.
Впечатляющие результаты: тесты показывают, что этот режим «языка пещерного человека» позволяет сэкономить примерно 65 % токенов без ущерба для точности результатов.
Научное обоснование: Исследования показывают, что принуждение модели к выработке лаконичных ответов не только снижает затраты, но и устраняет негативные последствия излишнего размышления, повышая точность по некоторым тестам на 26%.
Практические советы: 10 приёмов для экономии токенов
Помимо технических решений, обычные пользователи могут обойти «убийцу токенов», изменив свои привычки взаимодействия:
Редактируйте на месте: если результат вас не устраивает, воспользуйтесь кнопкой «Редактировать», чтобы уточнить исходный запрос, тем самым предотвратив повторные расходы из-за длинных бесед.
Сокращайте диалоги: начинайте новый чат каждые 15–20 сообщений, чтобы избежать накопления контекста, превращающегося в «черную дыру» токенов.
Объединяйте вопросы: объединяйте несколько инструкций в одно сообщение, чтобы снизить нагрузку на систему.
Разумно используйте пространство проектов: загружайте длинные документы в «Проекты» и используйте кэширование, чтобы документ не сканировался повторно.
По возможности переходите на более дешевые модели: делегируйте простые задачи, такие как проверка грамматики, более дешевым моделям, например Haiku, оставляя дорогостоящую модель
Используйте часы вне пиковых нагрузок: избегайте пикового периода с 5:00 до 11:00 по тихоокеанскому времени, чтобы воспользоваться более низкими ценами.
Заключение: от расточительности к точности
От коротких сообщений в 2000 году, оплачиваемых за слово, до сегодняшних крупных моделей, оплачиваемых за токен, наше стремление к эффективности коммуникации прошло полный круг. Это эра дорогостоящего ИИ, которую открыл
Генеральный директор DeepMind Хассабис: я сплю шесть часов в день, обычно чувствую прилив энергии около часа ночи.
В недавнем интервью журналу Fortune генеральный директор Google DeepMind Демис Хаассабис раскрыл свой нестандартный подход к отдыху и продуктивности. Хаассабис признался, что спит очень мало, распределяя свои бодрствующие часы на два отдельных рабочи
OpenAI и Anthropic борются за долю рынка, несмотря на снижение выручки
Несмотря на недавние сообщения о том, что OpenAI не достигла целевых показателей по выручке, что во вторник оказало давление на акции технологических компаний, частные инвесторы, вкладывающие средства











