В Китае научили ИИ-модели общаться без слов — они заработали в 2,5 раза быстрее
Исследователи из Университета Цинхуа создали технологию, которая позволяет нейросетям обмениваться информацией напрямую, полностью минуя текстовый язык. Метод под названием Cache-to-Cache (C2C) уже приняли на международную конференцию ICLR 2026, а его исходный код выложили в открытый доступ, пишет TechRadar.
Исследователи из Университета Цинхуа создали технологию, которая позволяет нейросетям обмениваться информацией напрямую, полностью минуя текстовый язык. Метод под названием Cache-to-Cache (C2C) уже приняли на международную конференцию ICLR 2026, а его исходный код выложили в открытый доступ, пишет TechRadar.
Проблема в том, что когда несколько ИИ-моделей работают в связке (например, одна ищет факты, а вторая пишет текст), они сильно тормозят друг друга. Первая должна сначала перевести свой внутренний ход мыслей в привычные предложения и слова, напечатать их, а вторая — прочитать и распознать. На эти манипуляции уходит куча вычислительных ресурсов, а по пути теряется множество мелких деталей и контекста, которые были в «голове» у первой модели.
Технология C2C просто берёт рабочую память одной модели и напрямую переливает её в память другой — без слов, текста и чатов. Однако сделать это «в лоб» нельзя: у разных моделей память устроена совершенно по-разному, отличаясь структурой, объёмом и логикой хранения.
Чтобы вторая модель не сломалась и не стала выдавать бред, китайские учёные добавили в систему два элемента. Прослойка-конвертер Fuser на лету «переводит» и подгоняет структуру памяти одной модели под формат другой. А умный фильтр решает, какие куски чужой памяти второй нейросети нужно впитать сразу, а какие внутренние слои должны продолжать думать самостоятельно, чтобы не сбиться.
На практике это дало ощутимый прирост скорости: при совместной работе нейросети стали выполнять задачи на 100-150% быстрее, чем при обычной текстовой переписке. Также при передаче «мыслей» напрямую точность работы моделей в связке увеличилась на 14,2% по сравнению с одиночной работой и на 3-5% по сравнению с обычным текстовым обменом.
Пока C2C работает только с моделями с открытыми весами. Чтобы передать кэш напрямую, разработчикам нужен доступ к внутренним слоям и памяти нейросети. Кроме того, эксперты советуют относиться к цифрам с разумным скепсисом: все тесты проводили сами создатели C2C. Насколько метод реален и эффективен на практике, покажут только независимые проверки других разработчиков.
Релоцировались? Теперь вы можете комментировать без верификации аккаунта.