IT Herald

Инженерия

Сжатие данных — это предсказание

Алгоритмы сжатия данных и большие языковые модели решают, по сути, одну и ту же задачу — предсказание следующего символа с максимальной вероятностью. На примере арифметического кодирования и энтропии Шеннона можно показать, почему LLM теоретически являются отличными компрессорами данных, но на практике непригодны для повседневного сжатия трафика.

World Train Map — интерактивная карта 1250 железнодорожных маршрутов мира

World Train Map — бесплатный интерактивный атлас железных дорог мира: 1250 маршрутов в 120 странах с указанием расстояния, времени в пути, максимальной скорости, оператора, подвижного состава и года открытия линии.

Как в Snowflake встроили CDC прямо в Postgres и превратили репликацию в часовой механизм

Snowflake представила data mirroring — новую функцию Snowflake Postgres в публичном превью, которая реплицирует данные из Postgres в Snowflake через Apache Iceberg с транзакционной консистентностью, низкой задержкой и минимальными затратами. Вместо традиционного подхода с внешними коннекторами, читающими логическую репликацию по сети, изменения теперь пушатся прямо из расширения Postgres в объектное хранилище батчами, а затем бессерверно и транзакционно применяются в Snowflake.

Оптимизация хвостовых вызовов в C появилась относительно недавно

Хвостовые вызовы в C поддерживались компиляторами далеко не всегда: разработчик Gforth вспоминает историю оптимизации хвостовых вызовов в GCC и рассказывает, как современные компиляторы справляются с такими вызовами в интерпретаторах на основе паттерна copy-and-patch.

Rust SIMD на GPU

Компания VectorWare сообщила, что портируемый SIMD-модуль Rust (core::simd) теперь работает на GPU. Warp видеокарты рассматривается как обычный SIMD-вектор, поэтому один и тот же код на core::simd компилируется и на CPU, и на GPU без изменений.

Параметрон: японский компьютер 50-х годов, работавший без транзисторов и ламп

В 1954 году японский аспирант Эйити Гото изобрёл параметрон — логический элемент на ферритовых кольцах, использующий эффект параметрического возбуждения вместо электронных ламп или транзисторов. На основе 4200 таких элементов в Токийском университете был построен PC-1 — первая в Японии полностью программируемая ЭВМ с хранимой программой, ставшая в 1958 году самым быстрым компьютером страны.

Какой язык программирования лучше всего подходит для AI-агентов?

Популярный тезис о том, что динамические языки эффективнее статических при работе с LLM из-за меньшего расхода токенов, подтверждается только на тривиальных задачах вроде Rosetta Code. На более крупных и реалистичных задачах — реализации zstd-декодера и обработке Pandoc — разница между статическими и динамическими языками практически исчезает, а популярность языка оказывается более значимым фактором, чем его парадигма типизации.

Cactus Needle 2: 14 МБ агентная LLM для телефонов, носимых устройств, умного дома и роботов

Cactus Compute представила Needle 2 — открытую модель на 45 млн параметров весом всего 14 МБ, предназначенную для вызова функций, управления устройствами и структурированного извлечения данных. Модель работает без GPU и NPU, укладывается в 28 МБ ОЗУ и уже используется в носимом устройстве Pebble Index Ring.

Автоматический режим стал стандартным в Claude Code для тарифов Pro, Max и Team

Anthropic делает auto mode режимом по умолчанию в Claude Code для тарифов Pro, Max и Team начиная с 14 августа. По данным компании, автоматический классификатор действий блокирует опасные команды эффективнее, чем ручное подтверждение пользователями.

FCC предлагает запретить иностранные дроны с LiDAR в США

Федеральная комиссия по связи США (FCC) предложила задним числом запретить импорт и продажу иностранных дронов из своего Covered List, оснащённых LiDAR-датчиками для обхода препятствий, отнеся эту технологию к категории «военного назначения». Под удар могут попасть популярные модели DJI, а также дроны с тепловизорами, распылителями агрохимикатов и системами роевого полёта, включая световые дрон-шоу.

Как использовать LLM для изучения сложных тем

Разработчик предложил необычный способ изучения сложных технических тем с помощью LLM: вместо чтения текстов и списков модель просит построить низкополигональную симуляцию процесса в духе RollerCoaster Tycoon. Метод опробован на примере производства микрочипов — результат опубликован как интерактивный сайт ChipTycoon.

Крутые URI не меняются (1998)

Тим Бернерс-Ли в классическом эссе 1998 года объясняет, почему адреса веб-страниц ломаются не из-за технических ограничений, а из-за небрежного проектирования: включения в URI даты пересмотра, названий CGI-скриптов, имён сотрудников и категорий, которые со временем меняются.