Охота за вычислительными мощностями ИИ: станет ли Cerebras следующим крупным игроком?

Неуклонно растущий спрос на вычислительные мощности для запуска моделей искусственного интеллекта продолжает усиливаться, однако участники рынка сталкиваются с двумя критическими препятствиями: обеспечением соответствующим аппаратным обеспечением и его развертыванием в центрах обработки данных для начала генерации доходов.
General Compute, новый провайдер neocloud, специализирующийся на этапе развертывания, где модели взаимодействуют с пользователями, а не проходят обучение, предлагает решения, подчеркивающие эволюционное направление экосистемы ИИ. Эти стратегические преимущества позволили привлечь $15 млн на стадии seed-финансирования при постденежной оценке в $60 млн, при ведущем участии FUSE VC, а также при дополнительной поддержке со стороны Carya Venture Partners и Village Global Ventures.
Определение оптимального чипа является первой задачей. Хотя спрос на графические процессоры (GPU) стремительно вырос, все чаще признается, что они не являются наиболее эффективным выбором для запуска обученных моделей ИИ. Вычислительные требования для вывода (инференса) существенно отличаются от требований для обучения, что стимулирует разработку нового класса чипов, специально предназначенных для этой цели. Приобретение Nvidia компании Groq за $20 млрд в декабре и выход Cerebras на биржу с оценкой в $57 млрд на прошлой неделе подчеркивают этот сдвиг.
В условиях ограничений по мощности у Groq и Cerebras сооснователи General Compute, генеральный директор Финн Пукловски и технический директор Джейсон Гудисон, нашли альтернативу. Они заключили партнерство с SambaNova, производителем чипов при поддержке Intel, специализирующимся на решениях для вывода, который получил меньше внимания в Кремниевой долине.
Эта динамика может измениться, когда SambaNova выпустит свои новые чипы во второй половине этого года. Архитектура обеспечивает большую гибкость и использует больше памяти для хранения контекста во время вычислений вывода. SambaNova утверждает, что эти чипы превосходят не только GPU, но и специализированное оборудование конкурентов, таких как Groq и Cerebras. По словам Пукловски, новые чипы достигнут скорости 600–700 токенов в секунду по сравнению с примерно 250 токенами в секунду для стандартных GPU.
General Compute разместила заказ на $300 млн чипов SN50 от SambaNova и стремится стать первым neocloud, развернувшим их.
Эти чипы также решают вторую крупную проблему: место развертывания. Поскольку они охлаждаются воздухом, а не водой, и потребляют меньше энергии, их можно интегрировать в существующие объекты центров обработки данных без необходимости инвестиций в новую инфраструктуру.
Пукловски стремится к соглашениям о совместном размещении оборудования (colocation), где General Compute устанавливает свое оборудование в сторонних объектах. Эти партнерства выходят за рамки традиционных провайдеров центров обработки данных и включают криптодобытчиков, стремящихся перепрофилировать свою инфраструктуру, особенно учитывая, что стоимость добычи биткоинов часто превышает их рыночную стоимость.
General Compute запустила свой облачный сервис на прошлой неделе, заявив, что в настоящее время он обеспечивает самую высокую производительность для MiniMax 2.7, мощной открытой большой языковой модели.
Джо Хассельман, венчурный инвестор, поддержавший Groq в 2021 году на ранних этапах бума вывода, запустил в этом году новый фонд Evercrest Capital Partners, сфокусированный на ИИ. Он сделал General Compute своим первым инвестиционным проектом. Хассельман видит параллели между партнерством SambaNova и General Compute и отношениями Coreweave с Nvidia, а также комбинацией производства чипов Groq с ее предыдущими облачными предложениями.
«Им нужна разнообразная клиентская база, которая будет размещать их чипы в средах с высоким ростом», — отметил Хассельман. «Точно так же, как General Compute делает ставку на SambaNova, SambaNova делает ставку на General Compute».
Ключевой вопрос остается открытым: какая компьютерная архитектура захватит наибольшую долю ценности в будущем ИИ. Облака вывода представляют собой неявную ставку на ландшафт с множеством моделей и агентов, где ни один провайдер не доминирует, а скорость и стоимость становятся главными конкурентными факторами. Это отражается в недавнем привлечении OpenRouter $113 млн на раунде Series B, которое подчеркивает его способность предоставлять клиентам доступ к нескольким моделям для оптимизации расходов на токены.
Скорость имеет решающее значение для ценообразования и возможностей. Пукловски стремится сократить время выполнения задач кодовых агентов, занимающих час, до пяти или десяти минут, а также сделать более экономичными аудиоагенты для обслуживания клиентов за счет более быстрого вывода для эффективного ведения диалога.
«Если вы используете ChatGPT, и он генерирует 50 токенов в секунду, это все еще намного быстрее скорости чтения человека», — сказал Пукловски TechCrunch. «Однако при переходе к взаимодействиям между агентами, где агенты читают от нашего имени или запрашивают базы данных, им необходимо работать на гораздо более высоких скоростях».
Связанная статья
Проблема однообразия за этими непривлекательными меню, сгенерированными ИИ
Сначала вы можете усомниться в своей рассудочности. Вы заходите в кафе и просматриваете меню, заполненное сэндвичами с бубликами, но каждое изображение выглядит пугающе идеальным — безупречно симметричным и чрезмерно гладким, — что вызывает интуитивн
«Hello Robot» готовит домашних роботов к выходу на рынок Кремниевой долины
Город Мартинес в Калифорнии расположен на крайнем северо-востоке района залива Сан-Франциско, в целой мире от технологического центра Кремниевой долины. Именно здесь базируется стартап Hello Robot, ко
Бывший глава Infosys привлек еще $53 млн для своего стартапа в сфере ИИ
Hang Ten Systems, стартап в области искусственного интеллекта, основанный бывшим генеральным директором Infosys Вишалом Сиккой всего четыре месяца назад, привлек дополнительные 53 миллиона долларов в рамках раунда финансирования на стадии seed. Этот
Рекомендации по связанным специальным темам
Комментарии (0)

Неуклонно растущий спрос на вычислительные мощности для запуска моделей искусственного интеллекта продолжает усиливаться, однако участники рынка сталкиваются с двумя критическими препятствиями: обеспечением соответствующим аппаратным обеспечением и его развертыванием в центрах обработки данных для начала генерации доходов.
General Compute, новый провайдер neocloud, специализирующийся на этапе развертывания, где модели взаимодействуют с пользователями, а не проходят обучение, предлагает решения, подчеркивающие эволюционное направление экосистемы ИИ. Эти стратегические преимущества позволили привлечь $15 млн на стадии seed-финансирования при постденежной оценке в $60 млн, при ведущем участии FUSE VC, а также при дополнительной поддержке со стороны Carya Venture Partners и Village Global Ventures.
Определение оптимального чипа является первой задачей. Хотя спрос на графические процессоры (GPU) стремительно вырос, все чаще признается, что они не являются наиболее эффективным выбором для запуска обученных моделей ИИ. Вычислительные требования для вывода (инференса) существенно отличаются от требований для обучения, что стимулирует разработку нового класса чипов, специально предназначенных для этой цели. Приобретение Nvidia компании Groq за $20 млрд в декабре и выход Cerebras на биржу с оценкой в $57 млрд на прошлой неделе подчеркивают этот сдвиг.
В условиях ограничений по мощности у Groq и Cerebras сооснователи General Compute, генеральный директор Финн Пукловски и технический директор Джейсон Гудисон, нашли альтернативу. Они заключили партнерство с SambaNova, производителем чипов при поддержке Intel, специализирующимся на решениях для вывода, который получил меньше внимания в Кремниевой долине.
Эта динамика может измениться, когда SambaNova выпустит свои новые чипы во второй половине этого года. Архитектура обеспечивает большую гибкость и использует больше памяти для хранения контекста во время вычислений вывода. SambaNova утверждает, что эти чипы превосходят не только GPU, но и специализированное оборудование конкурентов, таких как Groq и Cerebras. По словам Пукловски, новые чипы достигнут скорости 600–700 токенов в секунду по сравнению с примерно 250 токенами в секунду для стандартных GPU.
General Compute разместила заказ на $300 млн чипов SN50 от SambaNova и стремится стать первым neocloud, развернувшим их.
Эти чипы также решают вторую крупную проблему: место развертывания. Поскольку они охлаждаются воздухом, а не водой, и потребляют меньше энергии, их можно интегрировать в существующие объекты центров обработки данных без необходимости инвестиций в новую инфраструктуру.
Пукловски стремится к соглашениям о совместном размещении оборудования (colocation), где General Compute устанавливает свое оборудование в сторонних объектах. Эти партнерства выходят за рамки традиционных провайдеров центров обработки данных и включают криптодобытчиков, стремящихся перепрофилировать свою инфраструктуру, особенно учитывая, что стоимость добычи биткоинов часто превышает их рыночную стоимость.
General Compute запустила свой облачный сервис на прошлой неделе, заявив, что в настоящее время он обеспечивает самую высокую производительность для MiniMax 2.7, мощной открытой большой языковой модели.
Джо Хассельман, венчурный инвестор, поддержавший Groq в 2021 году на ранних этапах бума вывода, запустил в этом году новый фонд Evercrest Capital Partners, сфокусированный на ИИ. Он сделал General Compute своим первым инвестиционным проектом. Хассельман видит параллели между партнерством SambaNova и General Compute и отношениями Coreweave с Nvidia, а также комбинацией производства чипов Groq с ее предыдущими облачными предложениями.
«Им нужна разнообразная клиентская база, которая будет размещать их чипы в средах с высоким ростом», — отметил Хассельман. «Точно так же, как General Compute делает ставку на SambaNova, SambaNova делает ставку на General Compute».
Ключевой вопрос остается открытым: какая компьютерная архитектура захватит наибольшую долю ценности в будущем ИИ. Облака вывода представляют собой неявную ставку на ландшафт с множеством моделей и агентов, где ни один провайдер не доминирует, а скорость и стоимость становятся главными конкурентными факторами. Это отражается в недавнем привлечении OpenRouter $113 млн на раунде Series B, которое подчеркивает его способность предоставлять клиентам доступ к нескольким моделям для оптимизации расходов на токены.
Скорость имеет решающее значение для ценообразования и возможностей. Пукловски стремится сократить время выполнения задач кодовых агентов, занимающих час, до пяти или десяти минут, а также сделать более экономичными аудиоагенты для обслуживания клиентов за счет более быстрого вывода для эффективного ведения диалога.
«Если вы используете ChatGPT, и он генерирует 50 токенов в секунду, это все еще намного быстрее скорости чтения человека», — сказал Пукловски TechCrunch. «Однако при переходе к взаимодействиям между агентами, где агенты читают от нашего имени или запрашивают базы данных, им необходимо работать на гораздо более высоких скоростях».
Проблема однообразия за этими непривлекательными меню, сгенерированными ИИ
Сначала вы можете усомниться в своей рассудочности. Вы заходите в кафе и просматриваете меню, заполненное сэндвичами с бубликами, но каждое изображение выглядит пугающе идеальным — безупречно симметричным и чрезмерно гладким, — что вызывает интуитивн
«Hello Robot» готовит домашних роботов к выходу на рынок Кремниевой долины
Город Мартинес в Калифорнии расположен на крайнем северо-востоке района залива Сан-Франциско, в целой мире от технологического центра Кремниевой долины. Именно здесь базируется стартап Hello Robot, ко
Бывший глава Infosys привлек еще $53 млн для своего стартапа в сфере ИИ
Hang Ten Systems, стартап в области искусственного интеллекта, основанный бывшим генеральным директором Infosys Вишалом Сиккой всего четыре месяца назад, привлек дополнительные 53 миллиона долларов в рамках раунда финансирования на стадии seed. Этот





Дом






