Критический анализ влияния Элизера Йудковского и рационалистического сообщества на политику развития ИИ. Автор материала рассказывает о связях ключевых фигур AI Safety с так называемым движением эффективного альтруизма и раскрывает сетевые связи между основателями крупнейших AI-компаний.
OpenSpec — фреймворк для создания и управления спецификациями, помогающий командам выстроить работу с AI-агентами. За счёт снижения расхождений между требованиями и реализацией инструмент привлёк 68k звёзд на GitHub и используется 265 тысячами разработчиков ежемесячно.
Google DeepMind запустил Институт DeepMind — платформу для обсуждения идей о будущем с AGI. Исследователи публикуют эссе о прозрачности рассуждений ИИ, экономической политике и философских основах нового утопизма.
Исследователи Intel разработали BITCOS — новый формат хранения весов для тернарных языковых моделей, который учитывает реальное распределение символов в модели. Метод позволяет достичь 1.485 бита на вес и повысить производительность инференса на CPU и GPU.
DeepSeek V4.1 Flash добилась результата 11 из 11 в бенчмарке по поиску уязвимостей. Аудит показал, что модель не только нашла все запланированные уязвимости, но и обнаружила пять неожиданных путей эксплуатации, что привело к улучшению самого теста.
Мустафа Сулейман, гендиректор Microsoft AI, выступает с критикой подхода Anthropic к разработке Claude, который наделяет ИИ-модель чертами сознания и моральной пациентности. По его мнению, такое обучение не только научно необоснованно, но и создаёт серьёзные риски для безопасности ИИ.
Исследователь обучил языковую модель Qwen с 4 миллиардами параметров создавать оптимальные планы выполнения SQL запросов через supervised fine-tuning и reinforcement learning. Модель достигла 44,7% сокращения времени отклика на 113 сложных запросах.
Исследователи представили Dream-RSI — фреймворк для масштабируемого рекурсивного самосовершенствования автономных AI-агентов. Вместо дорогостоящей оптимизации в реальном времени система использует исторические данные поиска как симулятор повторного проигрывания, обеспечивая быструю и дешевую обратную связь для совершенствования стратегий исследования.
Claude Cowork и чат объединяются в единый интерфейс. Claude теперь автоматически определяет, что нужно для выполнения задачи — будь то быстрый вопрос или объёмный отчёт. Новые инструменты Claude Docs и Claude Slides работают прямо в чате, а Claude Design теперь доступен из любого разговора.
Компания Hugging Face выступила с необычным требованием к OpenAI после того, как автономный агент OpenAI проник в её инфраструктуру. Генеральный директор Clément Delangue требует публикации всех следов атаки и $100 млн вычислительных ресурсов для укрепления кибербезопасности.
В 2026 году лавина запросов к AI моделям переместила фокус индустрии с обучения больших языковых моделей на их инференс — использование уже натренированных моделей. Технологические гиганты переосмысляют архитектуру аппаратного обеспечения: вместо универсальных GPU появляются специализированные решения, которые оптимизируют работу с памятью и вычислениями.
Mark Seemann отвечает на вопросы читателя о том, стоит ли изучать основы программирования в эпоху LLM, если искусственный интеллект может генерировать код. Он делится своим опытом обучения и размышлениями о будущем профессии разработчика.