Новости и статьи об искусственном интеллекте и нейросетях. Мы собираем и обрабатываем самую актуальную информацию из мира AI. О проекте
Nvidia вместе со стартапом Lunar Outpost готовит первую отправку GPU на Луну. Чипы Jetson будут управлять лидаром нового лунохода и помогут отработать технологии для будущих автономных миссий NASA.
Аналитики предупреждали, что ИИ-бум вызовет нехватку памяти для потребительской электроники, и Индия стала первым подтверждением: во втором квартале поставки смартфонов упали на 10%, сильнее всего пострадал бюджетный сегмент. Цены выросли до 68%, китайские бренды теряют долю, а OnePlus уже сворачивает операции в Европе и США.
Акции Nvidia упали на 15% с майского пика, несмотря на рост выручки. Инвесторы переключились на производителей памяти: цены DRAM подскочили десятикратно за год, в то время как стоимость аренды GPU падает из-за растущей конкуренции. Nvidia страдает от успеха созданного ею рынка вычислений.
OpenAI представила свой первый специализированный процессор Jalapeño, созданный совместно с Broadcom для задач инференса. Чип демонстрирует высокую производительность на ватт и снижает затраты на выполнение моделей в реальном времени. Компания стремится уменьшить зависимость от Nvidia и строит полный стек инфраструктуры для ИИ.
AWS ведёт переговоры о продаже своих ИИ-чипов Trainium сторонним компаниям, бросая вызов доминированию Nvidia. По оценкам главы Amazon, это направление может приносить до $50 млрд в год. Ранее AWS отказывалась от прямых продаж, предпочитая зарабатывать на облачных сервисах.
Исследователи из Университета Твенте применили динамическое масштабирование напряжения и частоты (DVFS) на уровне ядер GPU и сократили энергопотребление при обучении модели GPT-3-xl на 14%, практически не замедлив процесс. Метод основан на точной настройке тактовых частот для каждой вычислительной операции, что позволяет экономить энергию без потери производительности.
DataRobot представил стандартизированные бенчмарки для LLM, измеряющие реальную производительность: максимальную конкурентность, задержку и стоимость токенов. Эти метрики позволяют точно рассчитать бюджет и инфраструктуру до запуска в продакшн.
Стартап Orbital Inc. анонсировал планы по созданию сети спутниковых дата-центров для ИИ-инференса. Компания рассчитывает использовать солнечную энергию в космосе, чтобы обойти дефицит мощностей на Земле. Первый тестовый запуск запланирован на 2027 год.
Стартап Etched, основанный тремя бросившими Гарвард студентами, привлёк $300 млн при оценке $10,3 млрд и удвоил стоимость за полгода. Компания разработала чипы, ускоряющие инференс для любых AI-моделей, уже имеет заказы на $1 млрд и прошла путь от работы в гараже до собственного дата-центра.
General Compute привлекла $400 млн от Upper90, предоставив в залог инференс-чипы SambaNova. Это первый в истории кредит под специализированные чипы для выполнения ИИ-моделей, а не дорогие GPU. Сделка отражает растущий интерес к экономичной инфраструктуре для открытых моделей.
OpenAI совместно с Broadcom разрабатывает собственный ИИ-чип Jalapeño — компания присоединилась к Google, Apple и SpaceX, которые стремятся снизить зависимость от Nvidia. В новом выпуске подкаста Equity обсуждают кастомный кремний, рост стоимости памяти, облачную инфраструктуру и неожиданные партнёрства вроде A24 с Google DeepMind.
Reflection AI, стартап с открытыми весами, заключил сделку с SpaceX на аренду ИИ-чипов Nvidia GB300 в дата-центре Colossus 2. Ежемесячные расходы составят $150 млн, а общая сумма контракта может достигнуть $6,3 млрд. Сделка подчёркивает стратегическую важность открытых моделей ИИ.
Глобальный дефицит чипов RAMageddon вынуждает Apple готовиться к повышению цен этой осенью.
На Computex 2026 Nvidia представила RTX Spark — версию суперчипа GB10 для Windows-ПК. Устройства на его базе анонсировали Microsoft, Asus, Dell и другие. Эксперты отмечают, что ключевое преимущество Nvidia — программная экосистема, но успех будет зависеть от того, сможет ли Windows на Arm стать массовой альтернативой x86-системам.
Дата-центры с гигаскальными ИИ-нагрузками сталкиваются с парадоксом питания из-за резких импульсов от GPU-кластеров, угрожающих сетям. Полутвердотельные батареи Ampace в связке с ИБП Eaton гасят миллисекундные пики, обеспечивая стабильность, безопасность и экономию без переразмеровки. Это позволяет масштабировать ИИ-инфраструктуру эффективно и надежно.
Статья описывает реальные трудности локального запуска LLM: от нехватки VRAM и задержек до проблем с промптами и дообучением. Подробно разобраны обходные пути вроде квантизации, оптимизации контекста и тестирования шаблонов. Само-хостинг требует инвестиций в железо и методичный подход, но даёт полный контроль.