IT Herald

Open Source

Бенчмарк квантизаций Qwen3.8 27B: 4-бит держит, 1-бит падает

Какая видеопамять нужна для запуска Qwen3.8 27B без потери качества? Модель в полной точности BF16 весит 55 ГБ, а Q4_K_M в 17 ГБ показывает такие же результаты на бенчмарках, помещаясь на RTX 4090. При сжатии до 1 бита модель падает на уровень случайных угадываний.

Copperhead — аппаратура с скоростью софтвера

Copperhead — это открытая платформа ИИ для проектирования, проверки и запуска электронных плат. Инструмент позволяет избежать рассинхронизации документации и кода: ведёт AI-агент, редактирующий реальные KiCad-файлы и проверяющий всё через встроенные в редактор проверки.

LibreOffice установила рекорд загрузок, объявив об отсутствии AI-функций

LibreOffice 26.8 стала самым популярным обновлением в истории проекта: установщик загрузили более миллиона раз за неделю. The Document Foundation объяснила рекорд позицией против встроенных AI-функций, назвав отказ от искусственного интеллекта полноценным функционалом.

Устаревшие HTML-фрагменты и артефакты

Веб постоянно меняется, и с ним меняется HTML. В статье рассказывается о необычных мета-тегах и HTML-паттернах, которые когда-то использовались для борьбы с конкретными браузерами, платформами и сервисами, но теперь остались только в коде старых сайтов.

Bedrock 2.0 — новая версия минималистичного стартера для Emacs

Вышла вторая версия Bedrock — минималистичного набора улучшенных стандартов для Emacs. Релиз требует Emacs 31 и приносит заметные улучшения: автоматическую установку пакетов, лучшую настройку tree-sitter и улучшенную конфигурацию поиска.

Новая "Google Jail": как поисковик блокирует независимые вики

После обновления Google в марте 2024 года новые домены с вики перестали появляться в результатах поиска, кроме главной страницы. Это серьёзно ударило по независимым сообществам — 85% трафика вики идет из Google. Разработчики объясняют ситуацию и делятся способами её обхода.

У нас есть год, чтобы починить безопасность везде

GLM 5.3-flash — дешёвая и открытая модель, способная находить и эксплуатировать реальные уязвимости в инфраструктуре. Это означает, что кибератаки теперь можно запускать в цикле for, и нужно срочно исправлять уязвимости по всей индустрии, пока системы защиты ещё могут это сделать.

Mistral привлекает €3 млрд для суверенного открытого AI на границе технологий

Mistral объявила о привлечении €3 млрд в раунде Series D при оценке свыше €21 млрд — крупнейшем раунде акционерного финансирования в истории европейских технологических компаний. Samsung Electronics возглавила раунд при поддержке других крупных инвесторов.

TALA — открытый исходный код

Алгоритм автоматической расстановки TALA (Terrastruct's AutoLayout Algorithm) стал открытым исходным кодом под лицензией MPL-2.0. Это ортогональный движок расстановки, разработанный для диаграмм архитектуры ПО, который уже включён в D2 v0.9.0.

Jellyfin 12.0

Вышел Jellyfin 12.0 со значительными улучшениями производительности благодаря доработкам базы данных, полноценной поддержкой книг и комиксов, новым режимом поиска и мощным расширениями для плагинов.

Факторизация RSA-ключей центра сертификации 90-х годов

Разработчик факторизировал 512-битные RSA-ключи корневого сертификата E-Certify, выданного компанией Netscape 4.51 в конце 90-х. Используя CADO-NFS на Ryzen 9 5950X, удалось восстановить приватные ключи и создать работающий TLS-сервер для древнейшей версии браузера.

Спекулятивное декодирование в vLLM на AMD GPU

vLLM поддерживает спекулятивное декодирование — метод, который позволяет проверить несколько предложенных токенов за один проход целевой модели. В экспериментах на AMD Instinct MI300X и MI355X это повышало пропускную способность выходных токенов в зависимости от метода предложения и других факторов.

Новости и дайджесты — в Telegram @it_herald