Новости и статьи об искусственном интеллекте и нейросетях. Мы собираем и обрабатываем самую актуальную информацию из мира AI. О проекте
SpaceX намерена увеличить вычислительные мощности более чем в пять раз к концу 2027 года, доведя их до 10 ГВт. Для этого может понадобиться более 2 млн графических процессоров Nvidia Vera Rubin. Параллельно ИИ-сегмент компании, включающий xAI и X, резко нарастил выручку за счёт облачных контрактов, но продолжает нести убытки.
Runware запустила портативный модульный дата-центр Sonic Inference Pod для инференса ИИ. Устройство быстро развёртывается, не требует воды для охлаждения и снижает затраты по сравнению с облачными решениями. Компания уже развернула 10 подов по всему миру и предоставляет мощности Higgsfield AI и Wix.
Инженеры полупроводникового подразделения Samsung массово уходят к конкуренту SK Hynix из-за значительной разницы в бонусах. Конфликт обостряет борьбу за таланты в индустрии HBM-чипов, критически важных для ИИ. Samsung рискует потерять ключевых специалистов, что может подорвать её позиции в гонке технологий.
Стартап Etched, основанный тремя бросившими Гарвард студентами, привлёк $300 млн при оценке $10,3 млрд и удвоил стоимость за полгода. Компания разработала чипы, ускоряющие инференс для любых AI-моделей, уже имеет заказы на $1 млрд и прошла путь от работы в гараже до собственного дата-центра.
General Compute привлекла $400 млн от Upper90, предоставив в залог инференс-чипы SambaNova. Это первый в истории кредит под специализированные чипы для выполнения ИИ-моделей, а не дорогие GPU. Сделка отражает растущий интерес к экономичной инфраструктуре для открытых моделей.
OpenAI совместно с Broadcom разрабатывает собственный ИИ-чип Jalapeño — компания присоединилась к Google, Apple и SpaceX, которые стремятся снизить зависимость от Nvidia. В новом выпуске подкаста Equity обсуждают кастомный кремний, рост стоимости памяти, облачную инфраструктуру и неожиданные партнёрства вроде A24 с Google DeepMind.
Reflection AI, стартап с открытыми весами, заключил сделку с SpaceX на аренду ИИ-чипов Nvidia GB300 в дата-центре Colossus 2. Ежемесячные расходы составят $150 млн, а общая сумма контракта может достигнуть $6,3 млрд. Сделка подчёркивает стратегическую важность открытых моделей ИИ.
Глобальный дефицит чипов RAMageddon вынуждает Apple готовиться к повышению цен этой осенью.
Anthropic подписала контракт на $10 млрд с облачным стартапом Volta. В Норвегии построят дата-центр мощностью 133 МВт на чипах Nvidia Vera Rubin. Сделка стала частью стратегии по расширению вычислительных ресурсов для конкуренции с лидерами рынка ИИ.
Recursive Superintelligence заключила многомиллионный контракт с AWS на вычислительные ресурсы. Стартап, привлёкший $650 млн, строит самосовершенствующиеся ИИ-системы и планирует выпустить первые продукты до конца 2025 года.
Nvidia вместе со стартапом Lunar Outpost готовит первую отправку GPU на Луну. Чипы Jetson будут управлять лидаром нового лунохода и помогут отработать технологии для будущих автономных миссий NASA.
Аналитики предупреждали, что ИИ-бум вызовет нехватку памяти для потребительской электроники, и Индия стала первым подтверждением: во втором квартале поставки смартфонов упали на 10%, сильнее всего пострадал бюджетный сегмент. Цены выросли до 68%, китайские бренды теряют долю, а OnePlus уже сворачивает операции в Европе и США.
Акции Nvidia упали на 15% с майского пика, несмотря на рост выручки. Инвесторы переключились на производителей памяти: цены DRAM подскочили десятикратно за год, в то время как стоимость аренды GPU падает из-за растущей конкуренции. Nvidia страдает от успеха созданного ею рынка вычислений.
OpenAI представила свой первый специализированный процессор Jalapeño, созданный совместно с Broadcom для задач инференса. Чип демонстрирует высокую производительность на ватт и снижает затраты на выполнение моделей в реальном времени. Компания стремится уменьшить зависимость от Nvidia и строит полный стек инфраструктуры для ИИ.
AWS ведёт переговоры о продаже своих ИИ-чипов Trainium сторонним компаниям, бросая вызов доминированию Nvidia. По оценкам главы Amazon, это направление может приносить до $50 млрд в год. Ранее AWS отказывалась от прямых продаж, предпочитая зарабатывать на облачных сервисах.
Исследователи из Университета Твенте применили динамическое масштабирование напряжения и частоты (DVFS) на уровне ядер GPU и сократили энергопотребление при обучении модели GPT-3-xl на 14%, практически не замедлив процесс. Метод основан на точной настройке тактовых частот для каждой вычислительной операции, что позволяет экономить энергию без потери производительности.