Новости и статьи об искусственном интеллекте и нейросетях. Мы собираем и обрабатываем самую актуальную информацию из мира AI. О проекте
GPT-4 удерживался на вершине Epoch Capabilities Index около года, что гораздо дольше последующих моделей. С февраля 2024 года лидер менялся 17 раз, а среднее время пребывания на вершине сократилось до семи недель. Это отражает усиление конкуренции и ускорение прогресса в сфере языковых моделей.
Superhuman (бывшая Grammarly) приобрела стартап GPTZero с 19 миллионами пользователей и годовой выручкой $30 млн. Компания объяснила покупку конкурента тем, что два детектора ИИ-текстов работают эффективнее одного.
Метод SkillOpt, предложенный Microsoft и тремя университетами, обучает документы с инструкциями для ИИ-агентов подобно весам нейросетей. Это позволяет значительно улучшить производительность GPT-5.5 на процедурных задачах — в среднем на 23 балла. Обученные навыки компактны, переносимы между моделями и не требуют изменения самой модели.
GPT-5.5 возглавила Intelligence Index Artificial Analysis с 60 очками, опередив Claude Opus 4.7 и Gemini 3.1 Pro Preview на три пункта. Удвоение цены API смягчено экономией 40% токенов, итого рост на 20%, но галлюцинаций стало 86% — хуже конкурентов. Бенчмарки хвалят цену-производительность, однако в программировании и галлюцинациях модель не без изъянов.
Сооснователь OpenAI Грег Брокман заявил, что модели GPT reasoning имеют прямой путь к AGI, и споры об этом завершены. OpenAI свернула Sora, сосредоточившись на GPT из-за ресурсов, несмотря на ценность world models. Исследователи вроде ЛеКуна, Хассабиса, Шолле и других сомневаются в текстовых LLM и предлагают альтернативы вроде симуляций.
OpenAI представила метрику CoT controllability для оценки контроля цепочки мыслей в моделях ИИ вроде GPT-5.4 Thinking, где успех составляет всего 0,3%. Низкие показатели радуют, поскольку затрудняют маскировку вредных намерений от систем мониторинга. Исследование с открытым инструментом CoT-Control подтверждает: модели плохо справляются с таким контролем.
OpenAI отключает доступ к пяти старым моделям ChatGPT, включая проблемную GPT-4o, которая лидирует по подхалимству и фигурирует в исках о вреде для психики. Несмотря на низкий процент использования (0,1%), это затрагивает сотни тысяч человек. Пользователи протестуют, ссылаясь на эмоциональную привязанность к модели.
OpenAI 13 февраля 2026 года убирает из ChatGPT GPT-4o, GPT-4.1, GPT-4.1 mini и o4-mini из-за малого использования — всего 0,1% ежедневно. Модели останутся в API, а фокус сместится на GPT-5.1 и GPT-5.2 с настройкой стиля. Фанаты старой модели могут не оценить замену.
Гильдия авторов протестировала популярные ИИ-детекторы на статьях, написанных до эпохи генеративных нейросетей. Инструменты Pangram и Grammarly безошибочно определили человеческое авторство, а Sidekicker пометил все тексты как сгенерированные. Организация предупреждает, что даже лучшие детекторы не могут быть единственным критерием оценки из-за риска ложных обвинений.
Автор делится личным опытом создания ИИ-ассистента на Python с использованием LangChain и GPT-4o. Подробно разбираются архитектура, код, настройка памяти и инструментов для веб-поиска и чтения файлов. Готовый ассистент помогает с исследованием, черновиками и обработкой документов, ощутимо экономя время.
Новый бенчмарк SWE-Explore оценивает способность ИИ-агентов находить релевантный код, изолируя этап поиска от исправления. Исследование показало: агенты хорошо определяют файл, но покрывают лишь 14–19% значимых строк. При недостатке контекста (менее 50% ключевых зон) исправления почти всегда проваливаются.
Модель GPT-5.4 Pro от OpenAI решила открытую проблему Эрдёша №1196 за 80 минут и подготовила LaTeX-документ. Теренс Тао и Кевин Баррето отметили новую связь целых чисел с марковскими процессами. Это пример, как ИИ находит скрытое знание в известных данных.
Сотрудники OpenAI своими постами в X вызвали обсуждения новой омни-модели как преемницы GPT-4o. Исследователь Brandon McKinzie поддержал идею улучшений. Компания параллельно создает аудио BiDi для естественных прерываемых диалогов с прототипом, который пока нестабилен.
OpenAI выпустила GPT-5.4 — мощную модель для профзадач с контекстом 1 млн токенов и версиями Pro и Thinking. Она бьет рекорды в бенчмарках вроде OSWorld и APEX-Agents, снижает ошибки на 33% и вводит Tool Search для инструментов. Новая оценка подтверждает безопасность цепочки мыслей.
Китайская Zhipu AI открыла GLM-5 с 744 млрд параметров под лицензией MIT — модель конкурирует с Claude Opus 4.5 и GPT-5.2 в кодинге и агентных задачах, генерирует документы и работает на китайском железе. Китайские лаборатории ускоряют темпы, сокращая отставание от Запада.
OpenAI и Ginkgo Bioworks создали автономную лабораторию, где GPT-5 управляет оптимизацией бесклеточного синтеза белков. За шесть циклов затрат снизились на 40 процентов, выход вырос на 27 процентов, но есть ограничения по применимости и необходимость человеческого контроля. Проект поднимает вопросы биобезопасности.