ARCANADA
Все записи
Блог 27 июля 2026

Cubrim: результат, который можно измерить

Измеримый результат Cubrim показан как сравнительный benchmark архиваторов.

ИИ легко производит правдоподобные объяснения. В исследовании сжатия этого недостаточно: файл должен восстановиться байт в байт, а результат можно сравнить числом.

Cubrim — исследовательский проект по сжатию данных. По моему свидетельству, несколько моделей и инженерный контур помогают выдвигать, критиковать и проверять гипотезы. Решение принимает не самый красноречивый агент, а benchmark.

Опубликованный результат

В общем рейтинге Cubrim сравнивается aggregate ratio на нескольких корпусах. Чем меньше значение, тем лучше результат в пределах этой таблицы.

МестоАрхиваторРежимAggregate ratio
1cubrimcompetitive0.2204
2ppmd7z -m0=PPMd0.2286
3xz-9e0.2344
47z-m0=LZMA2 -mx90.2355
5brotli-q 110.2408
6zstd--ultra -220.2490
7rara -m50.2573
8bzip2-90.2671
9gzip-90.3330
10lz4-120.3822

Корректный вывод узок: в опубликованном overall ranking на указанных корпусах и настройках Cubrim занимает первое место с aggregate ratio 0.2204.

Эта таблица не доказывает превосходство на любых данных, при любых ограничениях памяти и скорости или в независимом benchmark. Она опубликована самим проектом. При изменении корпуса, версии или режима результат нужно измерять заново.

Зачем здесь агенты

Один человек обычно проверяет гипотезы последовательно. Несколько агентных ролей позволяют вести параллельные линии: предлагать преобразования, искать контрпримеры, анализировать провалы и готовить реализацию.

Польза появляется только потому, что критерий находится вне рассуждений модели. Архиватор либо восстанавливает исходные данные, либо нет. Коэффициент либо улучшился на заданном наборе, либо ухудшился.

Cubrim не доказывает, что ИИ способен самостоятельно проводить любое исследование. Он показывает более практичную вещь: один человек может расширить пространство проверяемых гипотез, если заранее определил внешний критерий и не позволяет агентам подменить измерение объяснением.

Для меня главный результат здесь даже не первая строка таблицы. Важнее, что один человек смог организовать исследование как работающую систему: параллельно выдвигать версии, сталкивать их с контрпримерами, реализовывать лучшие кандидаты и оставлять решение за измерением. Рейтинг ещё может измениться. Эта способность проводить гипотезу через полный проверяемый цикл останется.

Источник и дата проверки

Перед публикацией таблицу, версии и настройки нужно проверить повторно.