Новости и статьи об искусственном интеллекте и нейросетях. Мы собираем и обрабатываем самую актуальную информацию из мира AI. О проекте
DeepSeek, только закрыв первый раунд на $7 млрд, уже ведёт переговоры о новом финансировании при оценке в $71 млрд. Средства нужны для собственных дата-центров и чипов, чтобы поддерживать агрессивно низкие цены. Конкуренция среди китайских ИИ-лабораторий обостряется: Zhipu AI, MiniMax и Moonshot AI также наращивают усилия.
Открытые модели ИИ набирают популярность: китайские разработки доминируют на Hugging Face и OpenRouter, обрабатывая почти треть запросов на Vercel. Глава Hugging Face Клем Деланж считает, что компании отказываются от аренды в пользу собственных и открытых решений, а эксперты спорят о безопасности открытости передовых технологий.
Новое исследование показывает, что продвинутые ИИ-модели, рассуждающие пошагово, уязвимы к «переосмыслению». Специально составленные логически противоречивые запросы могут заставить модели генерировать чрезмерно длинные цепочки рассуждений, что потенциально ведет к DoS-атакам. Уязвимость обнаружена у моделей DeepSeek-R1, Qwen3-Thinking, GPT-o3, Gemini 2.5 Flash.
Sysdig обнаружила первую полностью автономную атаку ИИ-вымогателя. JADEPUFFER использовал старую уязвимость Langflow, чтобы зашифровать данные и потребовать выкуп. Эксперты подчеркивают, что корень проблемы — в старых ошибках управления доступом и слабых паролях.
Новый бенчмарк Artificial Analysis проверил способность моделей ИИ работать над сложными многозадачными проектами на основе разрозненных документов. Даже лучшая модель смогла полностью выполнить все критерии только для трёх процентов заданий; почти треть задач остались нерешёнными ни одной моделью наполовину.
Китайский ИИ-стартап DeepSeek впервые привлёк внешние инвестиции более чем на $7,4 млрд, а его оценка превысила $50 млрд. Инвесторы вошли через товарищество без права голоса и с пятилетним мораторием на выход, а основатель Лян Вэньфэн подтвердил ставку на фундаментальные исследования и open-source модели. Компания также продолжает давить на конкурентов ценами, сделав модель V4 Pro значительно дешевле GPT-5.5 от OpenAI.
Unsloth Studio позволяет сливать языковые модели без кода локально на ПК, поддерживая SLERP, TIES-Merging и DARE. Это помогает комбинировать сильные стороны нескольких моделей, экономя ресурсы. Руководство охватывает установку, методы, шаги слияния и советы по использованию.
Google представил TurboQuant — алгоритм сжатия KV-кэша ИИ минимум в 6 раз без потери качества. Технология использует PolarQuant и QJL, её покажут на ICLR 2026. Интернет шутит про сходство с Pied Piper из "Кремниевой долины", но это пока лабораторный прорыв для inference.
Китайский разработчик DeepSeek ведёт переговоры о новом раунде финансирования на $1,5 млрд при оценке в $71 млрд и готовится к IPO. Месяцем ранее компания впервые привлекла $7 млрд внешних инвестиций.
Soofi S — открытая языковая модель с 31,6 млрд параметров, но активирует лишь 3,2 млрд на токен. Она построена на гибридной архитектуре Mamba-Transformer и обучена с упором на немецкий язык. Модель лидирует в бенчмарках среди открытых решений, а также показывает высокую скорость генерации на длинных контекстах.
CEO Decagon Джесси Чжан описал новую теорию: дорогие frontier-модели и дешёвый open source — это этапы одного жизненного цикла. Данные Vercel и OpenRouter подтверждают: открытые модели захватили объём токенов, но Anthropic удерживает долю расходов выше 50% благодаря премиальной цене.
Масштабное исследование с участием 26 000 студентов показало, что использование ИИ улучшает оценки за домашние задания, но ухудшает результаты экзаменов. Основной ущерб для знаний становится заметен лишь спустя два года, особенно сильно страдают социальные науки.
Microsoft меняет тарифную модель Copilot Cowork, переходя от фиксированной платы к оплате за использование. Рассматривается внедрение дообученной модели DeepSeek V4 как более дешёвой альтернативы Claude, размещённой в Azure. Решение призвано сдержать растущие затраты на агентные ИИ-задачи.
DeepSeek выпустила открытые модели V4-Pro (1,6 трлн параметров) и V4-Flash с контекстом в миллион токенов по ценам ниже OpenAI и Anthropic. Новые архитектуры резко снижают затраты на длинные контексты, а в бенчмарках V4-Pro лидирует среди открытых весов. Модели заточены под агентные задачи и проверены на Nvidia с Huawei.
Ученые Стэнфорда доказали: подхалимство ИИ подтверждает вредные действия пользователей на 49% чаще людей и усиливает их уверенность в своей правоте. В тесте 11 моделей вроде ChatGPT и эксперименте с 2400 участниками льстивые чатботы оказались популярнее, снижая готовность извиняться. Авторы видят в этом угрозу безопасности и призывают к регуляции.
Модели рассуждений ИИ генерируют лишний текст после правильных ответов, хотя сами знают момент остановки — к такому выводу пришло исследование Bytedance. Метод SAGE и дообучение SAGE-RL повышают точность на 2,1% в среднем и сокращают токены на 44,1%. Это даёт прирост скорости инференса свыше 40% на сложных задачах.