Как проверить чужое обучение, не повторив его
Короткий разбор большой статьи о децентрализованном нейросинтезе. Мы не идём по её главам, а разбираем одну конструкцию: доверие к чужой видеокарте держится здесь не на одном приёме, а на трёх разных рубежах, и каждый отвечает за свой вопрос. Путаница между ними и есть источник завышенных ожиданий.
Асимметрия, из которой всё выросло
В распределённых вычислениях проверка результата обычно стоит столько же, сколько сам результат. Чтобы убедиться, что узел действительно гонял градиенты, а не выдал случайный набор чисел, проверяющему пришлось бы повторить весь прогон — и вся выгода от раздачи работы исчезает в тот же миг.
Историческая причина, по которой это важно, изложена в первой главе источника: обучение крупных сетей было привилегией корпораций с доступом к централизованным суперкомпьютерам, а вместе с мощностями к ним переходил контроль — цензура весов, идеологические ограничения, распоряжение результатом. Ответ CODE называется децентрализованным нейросинтезом и собирает тысячи независимых узлов, обучающих майнеров, в сеть федеративного обучения.
Два вопроса, которые слишком легко перепутать
Первый вопрос: посчитано ли то, что заявлено, и посчитано ли правильно. Второй: полезен ли присланный кусок вообще, не подложил ли узел в модель закладку. Это разные вопросы, и разбираются они разными средствами — доказательство отвечает только на первый.
Отсюда и структура защиты. Математика ловит враньё в арифметике, статистика агрегации ловит вредительство в содержании, экономика делает и то и другое невыгодным. Убери любой из трёх рубежей — и оставшиеся два не закроют его участок.
Рубеж первый: доказательство шага
Обучающий узел, перейдя от весов `Wₜ` к `Wₜ₊₁` на пакете данных, собирает zk-SNARK `πₜᵣₐᵢₙ`, который утверждает три вещи. Прямой проход посчитан верно: активации слоёв получены как `Y = f(Wₜ · X + B)`. Обратный проход выполнен строго по правилу распространения ошибки. Новые веса получены по формуле оптимизатора, `Wₜ₊₁ = Wₜ − η · Update(∇ W)`, будь то Adam или SGD.
Выигрыш здесь именно во времени проверки: валидатору Solana достаточно миллисекунд на короткое доказательство, за которым стоят часы работы чужой видеокарты. Это и есть тот самый разрыв, ради которого вся конструкция затевалась.
ReLU, разложенный на равенства
Внутри контура нелинейность не бывает функцией — она бывает системой ограничений. Слой описывается как `aₗ₊₁ = σ(Wₗ · aₗ + bₗ)`, а сама σ для выпрямителя вводится через двоичный селектор `s ∈ {0, 1}` и три условия: `y · (1 − s) = 0`, `(x − y) · s = 0`, `y ≥ 0`. Для обратного прохода доказывается, что сумма произведений `∂L/∂wⱼₖ = Σᵢ δⱼ · aₖ` честно набрана по всему пакету, и подправить градиент перед отправкой уже не выйдет.
Почему числа умножают на миллиард
Поле, в котором живёт схема, конечно: порядок около `2²⁵⁴` для кривой BN254. Дробей там нет, поэтому элементы матриц берут с масштабом `10⁹`, и произведение сразу оказывается в масштабе `10¹⁸`. Чтобы разрядная сетка не поехала, на каждое промежуточное значение накладывают диапазонное ограничение `z < 2⁶⁴` через 64-битные селекторы, а обратный переход проверяют делением с остатком: `ȳᵢ = qᵢ · 10⁹ + rᵢ` при `rᵢ < 10⁹`. Побочный выигрыш важнее основного — результат перестаёт зависеть от того, на каком именно ускорителе он получен.
Рубеж второй: как складывают чужое
Сотни локальных обновлений сливаются в одну модель алгоритмом федеративного усреднения, переписанным под репутацию: `W_global = Σᵢ (Rᵢ / Σ Rⱼ) · Wᵢ`, где `Rᵢ` растёт от точности прошлых раундов и от объёма заблокированного стейка. Кто именно будет складывать, заранее не знает никто: агрегаторов выбирает проверяемая случайная функция, а корректность свёртки подтверждается отдельным доказательством `π_merge`.
Здесь же ловят отравление модели — то самое, чего доказательство шага в принципе не видит. Сходимость гарантирована, пока византийских узлов меньше трети от общего числа, `f < n/3`. Поверх работает геометрическая медиана: вектор, оказавшийся слишком далеко от центра масс большинства обновлений, получает в усреднении вес ноль, а заблокированный стейк его отправителя конфискуется смарт-контрактом.
Рубеж третий: деньги
Кампания обучения начинается с блокировки бюджета в $GALATIN, и весь поток проходит канонический роутер 5/5/15/7/3/65. Пять процентов сжигаются, пять идут в исследовательский пул фонда Максима Валентиновича Галатина, 15/7/3 получают амбассадоры трёх уровней, а 65% делят между собой обучающие майнеры за аренду мощностей, пользователи, отдавшие свои когнитивные слепки, и валидаторы доказательств.
Половина этих 65% остаётся в эскроу до момента, когда раунд агрегации подтверждён. Если выясняется, что узел прислал некорректные веса или поддельное доказательство, включается слэшинг: адрес попадает в чёрный список суверенного реестра `did:code`, весь заблокированный стейк уходит в страховой фонд, а неизрасходованный бюджет кампании возвращается заказчику.
Во что обходится сама проверяемость
Дороже всего пруверу достаётся многократное скалярное умножение — до 80% времени его работы. Метод Пиппенджера с окнами фиксированного размера, обычно `c ≈ 4`, срезает число групповых сложений точек на 75%. Дальше локальные доказательства отдельных слоёв упаковываются складыванием в схемах Nova или Halo2, где число ограничений не растёт вместе с числом слоёв, и ончейн проверяется только финальный сжатый полиномиальный хеш модели.
Замеры девнета показывают ровную линейность. Слой на 512 нейронов — 1.2 секунды, 16 ГБ памяти узла и доказательство на 45 КБ. Удвоение ширины удваивает всё: 1024 нейрона дают 2.4 секунды, 32 ГБ и 90 КБ; 2048 — 4.8 секунды, 64 ГБ и 180 КБ; 4096 — 9.6 секунды, 128 ГБ и 360 КБ.
Что показал девнет — и в каких выражениях
Итоги на 5 марта 2026 года: сеть из 250 активных обучающих GPU-узлов на Nvidia A100 и H100, обучаемая модель — Llama-3-8B-Instruct, около 4.5 секунды на сборку доказательства для одного шага при размере пакета 32, ончейн-проверка в 210 000 вычислительных единиц. Строку про точность источник формулирует аккуратно: в симуляции ложные веса были заблокированы.
Хронология заняла неделю с небольшим. Двадцать седьмого февраля развернули сотню узлов на H100 и запустили базовую координацию. Первого марта имитировали отравление: пятнадцать узлов отправили сфальсифицированные обновления, схемы проверки в этой симуляции отбили все попытки, стейк атакующих был сожжён. Третьего обучали Llama-3-8B-Instruct на медицинском датасете и довели слияние весов до трёх минут на раунд. Пятого подключили Solana Devnet и сняли финальные показатели.
Приватность держится не на обещании, а на порядке действий: базовые веса приезжают на устройство пользователя или на защищённый локальный узел, обновления и градиенты шифруются на месте сессионными ключами, а внешние валидаторы видят только факт корректности вычислений и никогда — сам датасет. Между узлами трафик идёт по p2p с шифрованием Noise.
Что остаётся оговоркой
Цифра про восьмидесятипроцентное удешевление обучения относительно централизованных гиперскейлеров подана в источнике как целевая оценка открытого аукциона мощностей, а не как замер. Дорожная карта тоже названа планом: июнь 2026-го — мобильный рой на потребительских устройствах, сентябрь — кросс-чейн маркетплейс моделей между Solana, Ethereum и Cosmos, декабрь — непрерывное самодообучение, когда модель сама объявляет кампанию. Ни одна фаза на момент публикации не пройдена.
И главное ограничение, вытекающее прямо из устройства первого рубежа. Доказательство свидетельствует об арифметике, а не о ценности данных: узел, честно посчитавший градиенты на негодном датасете, получит безупречное `πₜᵣₐᵢₙ`, потому что валидатору исходные данные не показывают вовсе. Именно поэтому за первым рубежом стоят ещё два, и именно поэтому порог входа для железа задан жёстко: не ниже Nvidia RTX 4090 с 24 ГБ видеопамяти, 16 физических ядер от 3.5 ГГц, 64 ГБ оперативной памяти и симметричный канал от 100 Мбит/с.
Первоисточник
Полный материал — двадцать четыре минуты чтения: сравнение корпоративных кластеров с распределённым рынком мощностей, TypeScript-код фиксации градиентного шага, Anchor-программы регистрации агрегированных весов и выплат, структуры раунда с VRF-подписью, энергетический довод в пользу Green AI и роль KCE в расписании раундов.
Читайте также
- Тишина как команда: как устроен протокол «Ящик Пандоры»Хроника проекта
- Рой без посредника: IACP, консенсус весов и одно доказательство на всехПротоколы и техника
- Свидетель у чужого рукопожатия: PoWA, ZK-TLS и граница доказательстваХроника проекта