Профиль: Аноним (вход | регистрация) неRU opennet.me  
The OpenNET Project / Index page

[ новости /+++ | форум | теги | ]

Использование GPU для ускорения обработки сетевых пакетов в ядре Linux

28.07.2026 11:43 (MSK)

Для обсуждения разработчиками ядра Linux опубликован набор патчей c реализацией механизма KNOD, позволяющего использовать GPU AMD для ускорения обработки сетевых пакетов. KNOD взаимодействует с GPU напрямую, без обращения к фреймворкам в пространстве пользователя, таким как AMD ROCm и NVIDIA CUDA, самостоятельно управляет очередями GPU и выполняет JIT-компиляцию BPF-программ обработки пакетов для выполнения на GPU. Пакеты для обработки перенаправляются из памяти сетевого адаптера в GPU с использованием DMA и Device Memory TCP.

Из сетевых возможностей сетевого стека, выполнение которых можно ускорить при помощи GPU, отмечаются обработчики сетевых протоколов, IPsec, туннели, шифрование, netfilter, управление трафиком, OVS (Open vSwitch) и XDP. На данном этапе развития внимание проекта сосредоточено на ускорении подсистемы XDP (eXpress Data Path), которая дополняет eBPF возможностью запускать BPF-программы на уровне сетевого драйвера, с поддержкой прямого доступа к DMA-буферу пакетов и работой на стадии до выделения памяти сетевым стеком.

При выполнении таких операций, как балансировка нагрузки на транспортном уровне (L4 OSI) и IPsec-шифрование через XDP, производительность упирается в число ядер CPU. В контексте KNOD подобные BPF-программы при помощи JIT-компилятора транслируются в машинный код GPU и выполняются на GPU. Применение GPU даёт возможность тысячам потоков параллельно выполнять одну и ту же программу над разными сетевыми пакетами, перенося нагрузку с CPU на GPU и позволяя масштабировать пропускную способность за счёт массового параллелизма GPU (SIMT), а не количества ядер CPU.

Проект может использоваться на системах с видеокартами AMD на базе архитектуры GCN. Выбор GPU AMD объясняется наличием полноценного открытого драйвера AMDGPU, интегрированного в основной состав ядра Linux, в котором документирована функциональность, необходимая для организации вычислений на GPU без лишних прослоек и абстракций. В будущем не исключается реализация поддержки GPU Intel. Поддержка GPU NVIDIA пока затруднена из-за отсутствия полноценного открытого драйвера в основном составе ядра (имеющийся драйвер Nouveau пока непригоден для использования в KNOD).

  1. Главная ссылка к новости (https://www.phoronix.com/news/...)
  2. OpenNews: Опубликована платформа LibreQoS 2.0 для оптимизации трафика
  3. OpenNews: Архитектура набора команд BPF получила статус предложенного стандарта
  4. OpenNews: Lunatik - инструментарий для создания в ядре Linux обработчиков на языке Lua
  5. OpenNews: Nokia представила сетевую операционную систему SR Linux для маршрутизаторов
  6. OpenNews: Компания AMD открыла модуль ядра GIM для виртуализации GPU
Лицензия: CC BY 3.0
Наводку на новость прислал Аноним
Короткая ссылка: https://opennet.ru/65983-knod
Ключевые слова: knod, gpu, kernel, xdp
При перепечатке указание ссылки на opennet.ru обязательно


Обсуждение (140) Ajax | 1 уровень | Линейный | +/- | Раскрыть всё | RSS
  • 1.1, Аноним (1), 11:55, 28/07/2026 [ответить] [﹢﹢﹢] [ · · · ]  
  • +15 +/
    Когда единственный инструмент молоток...
     
     
  • 2.3, нах. (?), 12:00, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • –10 +/
    Мариванна, это... не молоток, в общем. Для забивания груш тоже сойдет.

    причем из всех перечисленных якобы-нужных и полезных применений к реализации принято самое бесполезное и бестолковое, нужное видимо одному-единственному корпоративному заказчику (из китая, вестимо)

    ниче, ниче, это вам не devfs, и даже не bcachefs, это божок-с-пальцем точно одобрит, китайские доллары выглядят точь-в-точь как американские баксы.

     
     
  • 3.6, kravich (ok), 12:05, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +15 +/
    >Мариванна, это... не молоток, в общем

    ...и густо покраснел

     
     
  • 4.153, Аноним (153), 12:14, 30/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    Предлагаю им свободную идею: ускорить системный зуммер с помощью GPU. А то компутер при включении слишком устаревши пикает.
     
  • 3.57, JoePeach (ok), 14:38, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +3 +/
    >нужное видимо одному-единственному корпоративному заказчику

    Уже нет. Балканизация Интернета нарастает. Теперь это нужно всем, даже Штатам и Европе.

    > это божок-с-пальцем точно одобрит

    Так у него выбора нет. И вопрос не в деньгах. Просто из АНБ позвонят и скажут: "Нам надо! Метнулся и вмержыл!"

    >Мариванна, это... не молоток, в общем. Для забивания

    Ты даже не представляешь, как они нас задолбят. Ведь теперь ТСПУ получат поистине вселенскую мощь! Ну и новый дефицит видеокарт.

     
  • 3.63, Аноним (63), 14:48, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    >заказчику (из китая, вестимо)

    Там свой путь огораживания:
    https://servernews.ru/1145614

     
  • 3.97, Однако (?), 23:05, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    Для обивания груш ...
     
  • 2.19, Аноним (19), 12:34, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +6 +/
    Теперь вирусы будут сразу по сети рисовать на экране что надо :)
     

  • 1.5, Аноним (5), 12:02, 28/07/2026 [ответить] [﹢﹢﹢] [ · · · ]  
  • –11 +/
    Как быть с тем, что в видеокартах память сбойная всегда? Прямо так ускорение получается с копированием туда-сюда, или это только для видеокарт без собственной памяти?
     
     
  • 2.11, Аноним (11), 12:21, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +9 +/
    что значит сбойная? в нормальных видеокартах вообще-то ЕСС память
     
     
  • 3.20, Аноним (19), 12:35, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • –3 +/
    > ЕСС память

    Знаете, почему ECC требуется? Потому что память сбойная.

     
     
  • 4.26, aname (ok), 13:08, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +1 +/
    >> ЕСС память
    > Знаете, почему ECC требуется? Потому что память сбойная.

    Значение "ECC" знаешь?

     
     
  • 5.44, Анонисссм (?), 14:01, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +3 +/
    >Значение "ECC" знаешь?

    а ты? ECC не гарантия детекта и тем более исправления любой ошибки.

     
     
  • 6.107, edo (ok), 03:30, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • –3 +/
    Любой – нет. Но вероятность необнаружения ошибки при рабочем ecc крайне низкая. Другое дело, что именно в случае видеокарт не гнать как смотреть статистику обнаружения и исправления ошибок
     
  • 4.29, Аноним1234 (?), 13:13, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +1 +/
    Ну и потому что там ecc есть она не "сбойная" в итоге.
     
     
  • 5.42, Аноним (19), 14:00, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +1 +/
    Как правильно, что Вы используете кавычки. Там ещё смайлики можно было понавставить.
     
  • 4.66, Аноним (11), 15:00, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +1 +/
    Ну и? Жесткие диски уже лет 20 работают только с коррекцией ошибок. "сбойные", не иначе.
     
     
  • 5.134, Аноним (153), 21:08, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • –1 +/
    А ты сравни блоки ECC у дисков и рамки...
     
  • 5.135, Аноним (153), 21:11, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    И второе по дискам: диск начинает чтение, когда головка ещё не встала точно на дорогу. Потому что быстрее прочитать примерно и исправить через ECC, чем тискаться с точным выставлением головок.
     
  • 4.67, Alladin (?), 15:09, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    интересная у вас логика, вот существует серверная ecc озу память, у пользователей обычная.. значит серверам нужна сбойная память?)
     
     
  • 5.72, Аноним (19), 15:31, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • –1 +/
    Давайте погадаем, почему у юзеров обычная память да ещё без ЕЦЦ работает, а у серверов какая-то особенная да ещё с ЕЦЦ обязательно...
     
     
  • 6.98, Аноним (98), 23:29, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +4 +/
    Потому что если у юзера память втихую попортится, то это проблемы юзера. Ребутнётся и дальше поедет, юзеру надо чтобы подешевле было. А если на сервере, то так можно и деньги потерять.
     
  • 2.45, Аноним (63), 14:01, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    Есть PRO видеокарты с ECC-памятью:
    - https://www.techpowerup.com/img/DxrRV5UDmiOGPmTo.jpg
    - https://www.techpowerup.com/img/saj8I2z3Efs9F8eN.jpg
     
     
  • 3.54, Аноним (5), 14:27, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +1 +/
    Да вот стоят они неприлично. Асики в любом случае будут дешевле и эффективнее.
     
  • 3.137, Аноним (137), 23:22, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    Видеокарты, для типичного Нормиса.
     
     
  • 4.143, Аноним (63), 01:27, 30/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    Arc Pro B60/B65/B70 стоят относительно не дорого даже у нас, есть версии игровых RTX 5080 которые дороже.
     
  • 2.139, Аноним (139), 23:29, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • +1 +/
    И как же люди GPGPU-вычислениями занимались до вашего откровения.
     
     
  • 3.140, Аноним (5), 23:32, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    Так и занимались, зачем ты их людьми называешь?
     

  • 1.7, aname (ok), 12:15, 28/07/2026 [ответить] [﹢﹢﹢] [ · · · ]  
  • +6 +/
    > позволяющего использовать GPU AMD для ускорения обработки сетевых пакетов

    Очередная победа AMD

     
     
  • 2.21, Аноним (19), 12:36, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • –1 +/
    Очередное замедление работы экрана и всех графических программ.
     
     
  • 3.25, aname (ok), 13:06, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    > Очередное замедление работы экрана и всех графических программ.

    Пруфы будут, или как всегда- опеннетный эксперт?

     
     
  • 4.46, Аноним (19), 14:01, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +1 +/
    Естественно, технология zero-cost для GPU.
     
     
  • 5.48, aname (ok), 14:05, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • –1 +/
    > Естественно, технология zero-cost для GPU.

    Ты примеры показывай.

     
     
  • 6.73, Аноним (19), 15:32, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +2 +/
    Примеры - чего? Zero-cost для GPU? Дак это ты должен это показывать.
     
  • 3.92, Аноним (92), 21:57, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +1 +/
    > Очередное замедление работы экрана и всех графических программ

    А ты гоняешь Игоря на хосте, который в это же время прожевывает десятки гигабит трафика?

     
     
  • 4.93, Аноним (19), 22:07, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • –1 +/
    Я дочь очень большого хостера, подскажите, как в роутер цыски установить видюху амд?
     

  • 1.10, Аноним (10), 12:20, 28/07/2026 [ответить] [﹢﹢﹢] [ · · · ]  
  • +10 +/
    тады-уж и ядро целиком на ЖПУ запускать, чего мелочиться, а ЦПУ можно сдать в ломбард и купить ище одну видяху. Линус ты это, не останавливайся теперь на полпути, мы ждем, если, чё...
     
     
  • 2.13, aname (ok), 12:22, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +2 +/
    Если оно сможет, почему нет?
     
     
  • 3.94, Джон Титор (ok), 22:11, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    У вас электричество бесплатное?
     
     
  • 4.104, aname (ok), 01:16, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    > У вас электричество бесплатное?

    Своё электричество трачу по своему усмотрению

     
     
  • 5.105, Джон Титор (ok), 01:48, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    Ну что не понятного то? А на телефоне?
     
  • 4.138, Аноним (139), 23:25, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    Надо понимать, CPU у вас электричество не жрёт.
     
     
  • 5.144, Джон Титор (ok), 03:13, 30/07/2026 [^] [^^] [^^^] [ответить]  
  • –1 +/
    > Надо понимать, CPU у вас электричество не жрёт.

    Ну поменьше чем у GPU

     
     
  • 6.155, Аноним (155), 14:20, 30/07/2026 [^] [^^] [^^^] [ответить]  
  • +1 +/
    У какого CPU (а они сейчас кушают много)? Меньше, чем у какого GPU? И самое главное — какова эффективность на ватт?
     
  • 2.30, Bob (??), 13:29, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +2 +/
    тут некоторые cpu + gpu + ram + npu воедино собрали и ssd распаяли. Куда дальше то?)
    p.s.: огрызок
     
     
  • 3.35, Аноним (-), 13:45, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +1 +/
    > тут некоторые cpu + gpu + ram + npu воедино собрали и ssd распаяли. Куда дальше то?)

    мне хотелось бы пару (десятков) гигов HBM прям на проц
    но цена будет огого

    > p.s.: огрызок

    при этом отлично работает


     
  • 3.36, Аноним (36), 13:49, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • –1 +/
    Ещё процессор кубитов добавить. Затопив это всё в жидком азоте.
     
  • 3.39, эксперт по всему (?), 13:53, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    в итоге получилось прекрасно за счет это. можно не сильно порезанный qwen гонять на ноуте с 36Гб RAM

    ну а в целом, если вы припаяете сетевые порты к gpu, то получите что-то типа NPU (но где N это neural, а network). такие NPU и сейчас есть, но они все под NDA

     
  • 3.125, laindono (ok), 19:39, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    Дальше в один большой чип размером с кремниевую кругляшечку. Потом слоями так чтоб столб получился. На столбе можно будет вешать несогласных.
     
  • 2.62, Аноним (62), 14:44, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    > тады-уж и ядро целиком на ЖПУ запускать,

    Так было уже. НАписали эмулфтор на пикселном шейдере и запустили порт линукс ядра для risc-v внутри VRChat.

     

  • 1.18, localhostadmin (ok), 12:30, 28/07/2026 [ответить] [﹢﹢﹢] [ · · · ]  
  • –1 +/
    Это конечно здорово, но я не совсем понимаю зачем. Сейчас мощности и так упираются в пропускную способность канала. Использовать эту технологию на большинстве серверов это как экскаватором играть в песочнице
     
     
  • 2.24, BeLord (ok), 13:04, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +1 +/
    Для "изучения" каждого пакета, как вариант, чтобы CPU не отвлекались на сетевые нагрузки, монитиоринг в чем-то будет проще.
     
  • 2.27, aname (ok), 13:09, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • –2 +/
    > Это конечно здорово, но я не совсем понимаю зачем. Сейчас мощности и
    > так упираются в пропускную способность канала. Использовать эту технологию на большинстве
    > серверов это как экскаватором играть в песочнице

    Так а кто заставляет- то? Не надо- не включай, в чём проблема- то?

     
  • 2.33, Аноним1234 (?), 13:36, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +2 +/
    Найдите мне хоть один l4 vpn который может, хоть при каком канале 10+ Гбит. Таких нет, может появятся с этой штукой.
     
  • 2.68, Alladin (?), 15:12, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • –1 +/
    сейчас мощности не упираются в пропускную канала, продолжать даже смешно
     
  • 2.108, edo (ok), 03:35, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • –1 +/
    Да ничего не упирается, уже есть сетевые карты с портами 400g
     
     
  • 3.166, Брат Анон (ok), 20:09, 31/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    У тебя нет. И денег тебе на такое не хватит в ближайшие лет 10..15
     
  • 2.111, slavanap (?), 05:48, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • +2 +/
    Новые технологии DPI
     

  • 1.22, Аноним (22), 12:37, 28/07/2026 [ответить] [﹢﹢﹢] [ · · · ]  
  • +2 +/
    Где-то я это уже видел... GPUDirect RDMA
    https://lore.kernel.org/netdev/6376CA34-BC6F-45DE-9FFD-7E32664C7569@fb.co
    https://www.opennet.dev/opennews/art.shtml?num=53485
    https://lwn.net/Articles/827213/
     
  • 1.23, Аноним (23), 12:56, 28/07/2026 [ответить] [﹢﹢﹢] [ · · · ]  
  • +/
    Ждем ускорение ввода текста на удаленном терминале с использованием GPU.
     

  • 1.34, test (??), 13:41, 28/07/2026 [ответить] [﹢﹢﹢] [ · · · ]  
  • –3 +/
    > Поддержка GPU NVIDIA пока затруднена из-за отсутствия полноценного открытого драйвера в основном составе ядра

    В смысле? Давно уже есть открытый драйвер в ядре от nvidia.

    Правда либы в прострастве пользователя закрытые, но судя по сабжу тут это не нужно.

     
  • 1.37, Аноним (37), 13:49, 28/07/2026 [ответить] [﹢﹢﹢] [ · · · ]  
  • +5 +/
    В бытность одной из причин, по которой серьёзное телеком оборудование было на са... большой текст свёрнут, показать
     
     
  • 2.58, Аноним (58), 14:39, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +2 +/
    Как будто Карманова прочитал.
     

  • 1.40, Аноним (40), 13:57, 28/07/2026 [ответить] [﹢﹢﹢] [ · · · ]  
  • +2 +/
    Это очень опасная область для 0-day, причем современные LLM-ки её плохо понимают, потому что у них такого кода нет в обучающих датасетах.Коммерческий или академический, узкоспециализированный код.
     
     
  • 2.43, Аноним (40), 14:01, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +1 +/
    Вынесу GPU подсистему и еще одну физическую железку в сеть. Что может пойти не так ? ¯\_(ツ)_/¯
     
  • 2.49, Аноним (40), 14:05, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +1 +/
    Правильно ли я понял, что помимо проприетарных блобов внутри CPU и сетевой карты, теперь мои пакеты будет еще и проприетарный блоб видеокарты обрабатывать ? Firmware
     
     
  • 3.89, Аноним (89), 20:13, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    > помимо проприетарных блобов внутри CPU и сетевой карты, теперь мои пакеты будет еще и проприетарный блоб видеокарты обрабатывать

    Ну, они думают, что раз ты затерпел блобы внутри цпу и сетевухи, то и против фирмвари в видеокарте будет выступать только на форумах.

     
  • 2.145, Аноним (-), 08:43, 30/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    > выполняет JIT-компиляцию BPF-программ обработки пакетов для выполнения на GPU.

    Это значит что никто не знает даже что в конечном итоге будет исполнятся на GPU!

    Почему нельзя все скомпилить во время сборки ядра? Зачем JIT.  Там даже нет смысла искать дыру в коде. Мозга с помощью JIT сразу вирусной код собирать и запускать.

     
     
  • 3.148, Аноним (148), 09:13, 30/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    Если хочется нативный код в ядре, надо писать модуль а не BPF.

    BPF это пользовательский код для виртуальной машины. Пользователю не дают загружать нативный код, чтобы он не поломал ядро.

    JIT для BPF можно при желании отключить через sysfs или флагами ядра

     
     
  • 4.149, Аноним (149), 10:13, 30/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    Матчу ядро руками, чтобы этот BPF вообще отключить на amd64.

    Не желаю, чтобы пользователь на ядре что-то запускал.

    Да я за наличный код ядра, с возможностью выбора монолит или модуль, что кому нравится.

     
  • 4.150, Аноним (-), 10:21, 30/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    Матчу ядро руками, чтобы этот BPF вообще отключить на amd64.

    Не желаю, чтобы пользователь на ядре что-то запускал.

    Да я за наличный код ядра, с возможностью выбора монолит или модуль, что кому нравится.

     

  • 1.41, Аноним (41), 13:58, 28/07/2026 [ответить] [﹢﹢﹢] [ · · · ]  
  • +2 +/
    а что производители сетевых карточек акселераторы всяких ipsec не додумались изобрести? Хотя по идее крипто-операции должны исполняться на криптографическом сопроцессоре. А тут сунули какой-то гпу как компьют (дата) юнит, а цпу как менеджмент юнит. Все как в современных аля коробочных файерволах, только там за место гпу, всякие фпга и асики.
     
     
  • 2.70, Аноним (62), 15:25, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    > только там за место гпу, всякие фпга и асики

    фпга запрограммированные под конкретную задачу справляются порой не хуже (а иногда и лучше) чем гпу, их только программировать долго и муторно.
    А асики под конкретную задачу вообще уделывают гпу, но их перепрограммировать нельзя под другую.

     
     
  • 3.99, Аноним (41), 23:32, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +1 +/
    так и есть, только в данном случае оверхед в любом случае на копировании из памяти в память будет, так что как наколенное решение, якобы ускоряющее пакет хендлинг, выглядит весьма сомнительно, поэтому используют dma.
     
  • 2.74, devl547 (ok), 16:08, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    >производители сетевых карточек акселераторы всяких ipsec не додумались изобрести?

    Додумались. Тот же Intel QuickAssist.

     
     
  • 3.101, Аноним (41), 23:42, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    у вас и сетевушка и сам цпу должен поддерживать эту технологию.
     
  • 2.109, edo (ok), 03:37, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    Сетевые карты mellanox умеют оффлоад tls, ipsec, и ещё чего-то
     
     
  • 3.116, Аноним (41), 12:29, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • +1 +/
    сто лет как
     

  • 1.50, Аноним (50), 14:17, 28/07/2026 [ответить] [﹢﹢﹢] [ · · · ]  
  • +/
    >для ускорения обработки сетевых пакетов в ядре Linux

    А что, железного ускорения уже не хватает? Для сетевых пакетов-то, ну.

     
     
  • 2.51, Аноним (50), 14:19, 28/07/2026 Скрыто ботом-модератором     [к модератору]
  • +/
     
  • 2.103, pofigist (?), 23:50, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +1 +/
    Попытайся затерменировать хотя бы несколько тысяч vpn-сесий... Вот тогда и поймёшь нафига козе баян...
     
     
  • 3.113, халявщик не корпораст (?), 11:11, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    - несколько тысяч vpn-сесий..

    А на что ты расчитывал когда сервак мутил?

     
     
  • 4.117, pofigist (?), 12:37, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • –2 +/
    Это ты мутишь - покупаешь железо, а потом пишешь по собственному, поскольку нифига не работает.
    А я - умею рассчитывать сайзинги.
     
  • 3.132, bOOster (ok), 20:51, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    И нафига козе баян? Чтобы положить напрочь PCI-E шину? Или по твоему данные от процессора до GPU и обратно святой дух в пакетах передает?
     
     
  • 4.151, Аноним (139), 11:11, 30/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    Как вы положите шину, если видеокарте выделено фиксированное количество линий?
     
     
  • 5.165, pofigist (?), 11:17, 31/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    > Как вы положите шину, если видеокарте выделено фиксированное количество линий?

    Можно. Просто root switch имеет не безграничные ресурсы...

     
  • 4.154, pofigist (?), 13:37, 30/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    Ну у современных карт для pci-e gen5 предел это где-то 150-250 mpps... Положить конечно можно, но для этого потребуются 100gbe eth. Поверь - раньше ляжет CPU, в попытках шифровать/дешифровать такой поток...
     

  • 1.52, Аноним (52), 14:20, 28/07/2026 [ответить] [﹢﹢﹢] [ · · · ]  
  • +1 +/
    Всё равно слабо представляю себе такую ультра-сетевую железку на терабайты трафика с видяхой.

    А так, как бы обработку сетевого трафика логичнее переваливать на сетевой адаптер, а не на графический. Помнится в далёком прошлом были популярны TCP Offload настройки

     
     
  • 2.55, Аноним (41), 14:28, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    в эру всяких технологий виртуализации - отрубали к х3рам собачим
     
     
  • 3.90, нах. (?), 21:40, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    у кого вместо технологий были шв@60дкиные под(д)елки - те вырубали. У вас всегда ничего толком не работало.

    У кого были технологии - ничего не вырубали, а потом и вовсе в sr-iov начали делить физические карты на ломтики с пробросом этих ломтиков напрямую в виртуалки. Именно ради того чтобы виртуалкин драйвер мог напрямую управлять ускорителем.

    И да, там не только tcp offload из нулевых, там еще много чего.

    Ну, правда, не на рылотыке с китайского базара конечно, да и тот на днях сгорел.

     
     
  • 4.102, Аноним (41), 23:47, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    > У вас всегда ничего толком не работало.

    А нуда, я забыл, что всякие nutanix юзают собственную виртуализацию, а не всякие там наколенные qemu-kvm, так вот именно в этом Г и надо было это все отрубать в вирт машине.

    > У кого были технологии - ничего не вырубали, а потом и вовсе в sr-iov начали делить физические карты на ломтики с пробросом этих ломтиков напрямую в виртуалки.

    А нуда, технологиес, потом пришел бродком и всех натянул.

    > Ну, правда, не на рылотыке с китайского базара конечно, да и тот на днях сгорел.

    какой рылотык? в глаза не видел, только Ынтел.

     
     
  • 5.112, нах. (?), 07:55, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    > что всякие nutanix

    то есть ровно то что ничего толком и не умеет, и предназначено только для любителей докера в докере под докером.

    > какой рылотык? в глаза не видел, только Ынтел.

    ынтел как раз потому и вылетел с рынка серверов что остался там, в далеких десятых годах, прозевав момент перехода к виртуализации сетей. Все еще отличная карта... для тех у кого нет и не будет никакой виртуализации. Впрочем, ей и там сильно подгадила неспособность интела в драйверы для чего-то кроме lin00ps.

    А так да, года с 12го остался один broadcom. (ну и цискины карты у которых даже названия нет, и они из ucs не вынимабельны)

     
     
  • 6.118, Аноним (41), 12:41, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    > то есть ровно то что ничего толком и не умеет, и предназначено только для любителей докера в докере под докером.

    зависит от задач, не всем же рассчитывать баллистику полета ракет или заниматься сбором персональных данных всего мира (аля эспионажэм)

    > А так да, года с 12го остался один broadcom.

    чур меня чур упаси хоспади от этого бредкома (брокейда), меланокса и кулогика достаточно.

     
     
  • 7.123, нах. (?), 19:10, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    да все хорошо с бредкомом Даже драйверы под линукс, в общем и целом, нормальные... большой текст свёрнут, показать
     
     
  • 8.124, Аноним (41), 19:26, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    особенности в любом случае только по бенчам под задачу, а так для HPC выбирали в... текст свёрнут, показать
     
     
  • 9.126, нах. (?), 19:42, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    ib совершенно другая история Мы тут про сетевые адаптеры для сетевых применений... текст свёрнут, показать
     
     
  • 10.141, Аноним (41), 00:52, 30/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    так оно и используется для построение сети во всяких вычислительных кластерах И... текст свёрнут, показать
     
  • 2.59, Аноним (5), 14:39, 28/07/2026 Скрыто ботом-модератором     [к модератору]
  • +/
     
     
  • 3.84, нах. (?), 18:45, 28/07/2026 Скрыто ботом-модератором     [к модератору]
  • +/
     

  • 1.53, BorichL (ok), 14:22, 28/07/2026 [ответить] [﹢﹢﹢] [ · · · ]  
  • +2 +/
    Пора переименовать GPU в CPU, CPU в контроллер ввода-вывода.
     
     
  • 2.56, Аноним (41), 14:29, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    ну да было время IO-card :)
     

  • 1.61, Аноним (61), 14:41, 28/07/2026 [ответить] [﹢﹢﹢] [ · · · ]  
  • +/
    А почему параллелизм, а не параллелелизм? Хочу параллелелизм в параллелограмме
     
  • 1.65, Аноним (65), 14:56, 28/07/2026 [ответить] [﹢﹢﹢] [ · · · ]  
  • +2 +/
    Дак вкрячьте в видюху сразу сетевой разъём, зачем эти нелепые телодвижения. И usb на вырост, антенну опять же.
     
     
  • 2.120, Аноним (120), 13:50, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    Да понятно, но многие неопнимают.
    Если вкорячть Gpu, вообще вместо всего то.
    Gpu, не умеет обрабатывать процессы на уровне если-то.
    Тоесть если использовать Gpu, вообще для всего. То какая бы она мощная не была, в Gpu, придется ждать завершение предыдущщего процесса.
    Что конечно не является проблемой вообще для любого Cpu, хоть 2000 года.
     

  • 1.71, ятупойтролль (ok), 15:26, 28/07/2026 [ответить] [﹢﹢﹢] [ · · · ]  
  • –2 +/
    конечно же связка сетевуха-цпу-память-цпу-видеокарта-цпу-память-сетевуха работает быстрее, чем сетевуха-память-цпу-память-сетевуха.
     
     
  • 2.86, Мемоним (?), 19:04, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    > Пакеты для обработки перенаправляются из памяти сетевого адаптера в GPU с использованием DMA и Device Memory TCP.
     
     
  • 3.96, ятупойтролль (ok), 22:52, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • –1 +/
    ну ага, а маршрутизацию как выстраивать то? тоже видеокартой?
     
     
  • 4.100, Аноним (98), 23:33, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    Таблица маршрутизации меняется редко. Современное (ну как современное...) телекоммуникационное оборудование ребутает так control plane для апгрейда прошивок без остановки сервиса. А так, не вижу препятствий чтобы BGP прямо на GPU обслуживать, кроме бессмысленности этой затеи.
     

  • 1.75, anonymous (??), 16:13, 28/07/2026 [ответить] [﹢﹢﹢] [ · · · ]  
  • +1 +/
    Нахрена GPU? Вроде бы на приличных сетевых картах есть собственные хардварные ускорители. И стоят они дешевле чем приличные GPU с ECC памятью. Какая-то хрень странная.
     
     
  • 2.78, Аноним (-), 17:17, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    Как я понял, моё видение Шифрование - параллелизм десятки тысяч запросов сможет... большой текст свёрнут, показать
     
     
  • 3.79, Аноним (-), 17:30, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    "В спецификациях NVIDIA ядра называют CUDA Cores, а AMD использует термин Stream Processors (Потоковые процессоры). Важный нюанс: почему ядра AMD и NVIDIA нельзя сравнивать «в лоб» Из таблицы видно, что флагман AMD (6 144 ядра) имеет меньше шейдеров, чем карта среднего класса от NVIDIA. Это связано с разницей в архитектуре: Ядра NVIDIA считают каждый математический блок (ALU) отдельно. AMD в архитектуре RDNA3 использует «двойные» вычислительные блоки (Dual Issue), которые при определенных условиях могут выполнять в два раза больше инструкций за такт. Поэтому при меньшем числе «на бумаге» они конкурируют с более крупными чипами соперника"
     
     
  • 4.80, Аноним (63), 18:05, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    >Важный нюанс: почему ядра AMD и NVIDIA нельзя сравнивать «в лоб»

    Ну можно, по производительности в одной и той же задаче.
    А вообще сами же CUDA-ядра отличаются по архитектуре в зависимости от поколения:
    https://en.wikipedia.org/wiki/CUDA#Version_features_and_specifications

     
     
  • 5.82, Аноним (-), 18:23, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    Укого задачи именно скорость и деньги не проблема будут максимально производительные видеокарты если им продадут.

    "Про 384 шейдера и скорость. Да, 384 шейдера (например, уровень встроенной графики или старых бюджетных карт вроде GT 1030) — это немного по современным меркам. O «десятках тысяч запросов за пару миллисекунд» здесь речи не идет. Однако такая карта все равно может выполнять шифрование (например, AES-CTR) в 3–5 раз быстрее, чем 2-ядерный или 4-ядерный CPU, за счет того, что процессоры обрабатывают данные в 4–8 потоков, а ваша видеокарта — в 384 потока одновременно"

     
     
  • 6.85, Аноним (85), 18:51, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +2 +/
    Сравнение 171 в 3 8211 5 раз быстрее 187 справедливо для процессоров БЕЗ а... большой текст свёрнут, показать
     
     
  • 7.133, bOOster (ok), 20:55, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    >[оверквотинг удален]
    > в CPU — специализированный, жестко "впаянный" в логику ядра и работает
    > на частоте ~4 ГГц.Когда видеокарта все равно побеждает?Даже если в CPU
    > есть AES-NI, видеокарта вырвется вперед только в двух случаях:Если видеокарта мощная
    > (флагман): Когда ядер не 384, а 5 000 – 20 000.
    > Тогда гигантский масштаб параллелизма компенсирует любые задержки на пересылку данных.Если
    > сменить алгоритм шифрования: Например, если вы используете алгоритм, под который в
    > CPU нет встроенных транзисторов (какой-нибудь специфический хэш, асимметричное шифрование
    > RSA/ЭЦП или новые постквантовые алгоритмы). Тут видеокарта со своими 384 шейдерами
    > снова окажется в разы быстрее, так как CPU вернется к медленному
    > программному расчету"

    хоть одно разумное мнение. Сорри, оно свернуто было, я от себя тоже про PCI-E на "маслах" писал.

     
     
  • 8.142, Аноним (-), 01:20, 30/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    Разграничивать надо Если у процессора аппаратное решение есть тогда слабые виде... текст свёрнут, показать
     
     
  • 9.146, Аноним (-), 09:03, 30/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    KNOD в ядре Linux Это узкоспециализированная, сугубо инженерная разработка, ко... текст свёрнут, показать
     
  • 9.147, Аноним (-), 09:06, 30/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    В чем суть этой технологии KNOD Разработчики предложили компилировать BPF-пр... текст свёрнут, показать
     
  • 6.130, bOOster (ok), 20:46, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    Ага, в 3-5 раз. Абсолютно бестолковое рассуждение.
    Во первых процессор может иметь свое AES шифрование (без разницы какой постфикс -CTR или что-то еще. что есть алгоритм "перемешивания" шифрованных блоков), в большинстве современных процессоров AES встроен, а перемещивание, значительно менее трудоемкая задача.
    Во вторых толкать массивы данных по PCI-E шине туда-сюда - весьма трудоемкое занятие. Особенно когда надо зайдействовать хрен сколько потоков.
    Мощность видеокарт в том что они запихивают данные в свою RAM и работают с ними длительный период времени, практически не обращаясь с шине PCI-E.
     
  • 3.81, Аноним (-), 18:19, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • –1 +/
    Виртуализяция которую я рсматриваю это коробка и VMware.
     

  • 1.77, Аноним (77), 16:49, 28/07/2026 [ответить] [﹢﹢﹢] [ · · · ]  
  • –1 +/
    >масштабировать .... за счёт массового параллелизма GPU, а не количества ядер CPU.

    Сдается мне, что 16 GPU стоят значительно дороже 16-ти ядерного CPU

     
  • 1.83, zionist (ok), 18:42, 28/07/2026 [ответить] [﹢﹢﹢] [ · · · ]  
  • +1 +/
    Жду появления возможности ускорять графику на контроллераз сетевых интерфейсов. Вангую батлы сколько FPS добавляют ускорители IPv4 vs IPv6.
     
     
  • 2.91, нах. (?), 21:42, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    давай уже сразу битки майнить, зачем нам эти полумеры.

     

  • 1.87, Аноним (28), 19:14, 28/07/2026 [ответить] [﹢﹢﹢] [ · · · ]  
  • +1 +/
    И что теперь, ставить AMDGPU в cisco?
     
     
  • 2.88, Аноним (88), 20:05, 28/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    В cisco вставлять amdgpu - на любителя, но кому-то может и понравиться. Думаю, японцам зайдёт.
     
     
  • 3.115, халявщик не корпораст (?), 11:22, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    кетайцам будет нужнее, вот только партия немножко таблицу пифагора подучит и научится правильно в сложение....
     
  • 3.127, нах. (?), 19:44, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    > В cisco вставлять amdgpu - на любителя, но кому-то может и понравиться.
    > Думаю, японцам зайдёт.

    Циски, оне разные бывают... там иногда такое попадается, что да, японцам бы зашло.

    (надо будет посмотреть, истек срок nda или нет еще)

     
  • 2.119, Аноним (120), 13:48, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    Самое забавное, что встройка, впайка Яблочников, Gpu Озу Cpu, уже имеет все эти функции.
    Хоть это и встройка, что осуждаю.
    Типа если мало озу, то надо менять ноут, лол.
    Но Gpu Озу Cpu, означает что Gpu и Cpu, имеют прямой доступ к Озу, без всяких там Knod.
     

  • 1.95, Джон Титор (ok), 22:18, 28/07/2026 [ответить] [﹢﹢﹢] [ · · · ]  
  • +/
    Ага и модель ИИ вкорячем для безопасной передачи данных, пусть само как-то разруливает маршрутизацию оптимальным образом. И назовем по современному (sky.net)
     
  • 1.106, Аноним (106), 03:15, 29/07/2026 [ответить] [﹢﹢﹢] [ · · · ]  
  • +/
    Linux уже как снежный ком обрастает всевозможной ересью, в итоге становясь недоступной какому-либо аудиту системой.
     
  • 1.114, nc (ok), 11:13, 29/07/2026 [ответить] [﹢﹢﹢] [ · · · ]  
  • +/
    Похоже, будущее именно за APU-подобной архитектурой, когда есть кристалл с объединенными центральным процессором, видеокартой со множеством математических ядер и общей памятью. Так что ядро линукса неизбежно будет включать в себя все больше такого кода.
     
     
  • 2.122, Аноним (122), 16:38, 29/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    Дык амуде норм дискретки слабать не в состоянии. Вот на удивление хоть в цпу кристал завелся. Так что акционер яжефинский палец покажет и стремаясь Кента с бебекешфс все сразу и запилят в нужном направлении.
     

  • 1.129, bOOster (ok), 20:34, 29/07/2026 [ответить] [﹢﹢﹢] [ · · · ]  
  • +/
    Полный бред. сетевые карты оффлоадят все что нужно. А обрабатывать остальное на 600+ ваттных GPU - стрельба из пушки по воробьям.
     
  • 1.131, bOOster (ok), 20:50, 29/07/2026 [ответить] [﹢﹢﹢] [ · · · ]  
  • +/
    А так молодцы, латентность Linux сетевого стека и так практически худшая относительно Unix систем, а с ускорением на GPU станет вообще аховой.
    Плюс будет тормозить всю остальную переферию, так как GPU будет эксклюзивно забирать на себя всю пропускную способность PCI-E

    Современные бредогенераторы из разряда растаманов и иже с ними - тупо не понимают как работает железо вычислительной техники.

     
  • 1.152, Аноним (153), 12:12, 30/07/2026 [ответить] [﹢﹢﹢] [ · · · ]  
  • +1 +/
    Ввод мышки ещё не ускоряли на GPU?
     
     
  • 2.156, Аноним (-), 14:51, 30/07/2026 [^] [^^] [^^^] [ответить]  
  • –1 +/
    Отвечаю прямо на ваш вопрос нет, сам ввод мыши на GPU не переносили, и делать ... большой текст свёрнут, показать
     
     
  • 3.160, Аноним (153), 20:09, 30/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    > Это происходит на CPU и занимает микросекунды

    Увы, но нет. Вы забыли про стёк USB. В котором цикл для HID-а занимет 1 мс.

     
     
  • 4.161, Аноним (161), 20:51, 30/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    Я использую PS 2 для мыши которая может работать через переходник USB - PS 2 В... большой текст свёрнут, показать
     
     
  • 5.162, Аноним (-), 21:26, 30/07/2026 [^] [^^] [^^^] [ответить]  
  • +/
    Для клавиатур и мышей USB 2 0 остается золотым стандартом Он обеспечивает мини... большой текст свёрнут, показать
     

     Добавить комментарий
    Имя:
    E-Mail:
    Текст:



    Партнёры:
    PostgresPro
    Inferno Solutions
    Hosting by Hoster.ru
    Хостинг:

    Закладки на сайте
    Проследить за страницей
    Created 1996-2026 by Maxim Chirkov
    Добавить, Поддержать, Вебмастеру