Профиль: Аноним (вход | регистрация) неRU opennet.me  
The OpenNET Project / Index page

[ новости /+++ | форум | теги | ]



"Использование GPU для ускорения обработки сетевых пакетов в ядре Linux"
Вариант для распечатки  
Пред. тема | След. тема 
Форум Разговоры, обсуждение новостей
Изначальное сообщение [ Отслеживать ]

"Использование GPU для ускорения обработки сетевых пакетов в ядре Linux"  +/
Сообщение от opennews (??), 28-Июл-26, 11:55 
Для обсуждения разработчиками ядра Linux опубликован набор патчей c реализацией механизма KNOD, позволяющего использовать GPU AMD для ускорения обработки сетевых пакетов. KNOD взаимодействует с GPU напрямую, без обращения к фреймворкам в пространстве пользователя, таким как  AMD ROCm и NVIDIA CUDA,  самостоятельно управляет очередями GPU и выполняет JIT-компиляцию BPF-программ обработки пакетов для выполнения на GPU. Пакеты для обработки перенаправляются из памяти сетевого адаптера в GPU с использованием DMA и Device Memory TCP...

Подробнее: https://www.opennet.dev/opennews/art.shtml?num=65983

Ответить | Правка | Cообщить модератору

Оглавление

Сообщения [Сортировка по ответам | RSS]

1. Сообщение от Аноним (1), 28-Июл-26, 11:55   +15 +/
Когда единственный инструмент молоток...
Ответить | Правка | Наверх | Cообщить модератору
Ответы: #3, #19

3. Сообщение от нах. (?), 28-Июл-26, 12:00   –10 +/
Мариванна, это... не молоток, в общем. Для забивания груш тоже сойдет.

причем из всех перечисленных якобы-нужных и полезных применений к реализации принято самое бесполезное и бестолковое, нужное видимо одному-единственному корпоративному заказчику (из китая, вестимо)

ниче, ниче, это вам не devfs, и даже не bcachefs, это божок-с-пальцем точно одобрит, китайские доллары выглядят точь-в-точь как американские баксы.

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #1 Ответы: #6, #57, #63, #97

5. Сообщение от Аноним (5), 28-Июл-26, 12:02   –11 +/
Как быть с тем, что в видеокартах память сбойная всегда? Прямо так ускорение получается с копированием туда-сюда, или это только для видеокарт без собственной памяти?
Ответить | Правка | Наверх | Cообщить модератору
Ответы: #11, #45, #139

6. Сообщение от kravich (ok), 28-Июл-26, 12:05   +15 +/
>Мариванна, это... не молоток, в общем

...и густо покраснел

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #3 Ответы: #153

7. Сообщение от aname (ok), 28-Июл-26, 12:15   +6 +/
> позволяющего использовать GPU AMD для ускорения обработки сетевых пакетов

Очередная победа AMD

Ответить | Правка | Наверх | Cообщить модератору
Ответы: #21

10. Сообщение от Аноним (10), 28-Июл-26, 12:20   +10 +/
тады-уж и ядро целиком на ЖПУ запускать, чего мелочиться, а ЦПУ можно сдать в ломбард и купить ище одну видяху. Линус ты это, не останавливайся теперь на полпути, мы ждем, если, чё...
Ответить | Правка | Наверх | Cообщить модератору
Ответы: #13, #30, #62

11. Сообщение от Аноним (11), 28-Июл-26, 12:21   +9 +/
что значит сбойная? в нормальных видеокартах вообще-то ЕСС память
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #5 Ответы: #20

13. Сообщение от aname (ok), 28-Июл-26, 12:22   +2 +/
Если оно сможет, почему нет?
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #10 Ответы: #94

18. Сообщение от localhostadmin (ok), 28-Июл-26, 12:30   –1 +/
Это конечно здорово, но я не совсем понимаю зачем. Сейчас мощности и так упираются в пропускную способность канала. Использовать эту технологию на большинстве серверов это как экскаватором играть в песочнице
Ответить | Правка | Наверх | Cообщить модератору
Ответы: #24, #27, #33, #68, #108, #111

19. Сообщение от Аноним (19), 28-Июл-26, 12:34   +6 +/
Теперь вирусы будут сразу по сети рисовать на экране что надо :)
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #1

20. Сообщение от Аноним (19), 28-Июл-26, 12:35   –3 +/
> ЕСС память

Знаете, почему ECC требуется? Потому что память сбойная.

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #11 Ответы: #26, #29, #66, #67

21. Сообщение от Аноним (19), 28-Июл-26, 12:36   –1 +/
Очередное замедление работы экрана и всех графических программ.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #7 Ответы: #25, #92

22. Сообщение от Аноним (22), 28-Июл-26, 12:37   +2 +/
Где-то я это уже видел... GPUDirect RDMA
https://lore.kernel.org/netdev/6376CA34-BC6F-45DE-9FFD-7E326...
https://www.opennet.dev/opennews/art.shtml?num=53485
https://lwn.net/Articles/827213/
Ответить | Правка | Наверх | Cообщить модератору

23. Сообщение от Аноним (23), 28-Июл-26, 12:56   +/
Ждем ускорение ввода текста на удаленном терминале с использованием GPU.
Ответить | Правка | Наверх | Cообщить модератору
Ответы: #28

24. Сообщение от BeLord (ok), 28-Июл-26, 13:04   +1 +/
Для "изучения" каждого пакета, как вариант, чтобы CPU не отвлекались на сетевые нагрузки, монитиоринг в чем-то будет проще.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #18

25. Сообщение от aname (ok), 28-Июл-26, 13:06   +/
> Очередное замедление работы экрана и всех графических программ.

Пруфы будут, или как всегда- опеннетный эксперт?

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #21 Ответы: #46

26. Сообщение от aname (ok), 28-Июл-26, 13:08   +1 +/
>> ЕСС память
> Знаете, почему ECC требуется? Потому что память сбойная.

Значение "ECC" знаешь?

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #20 Ответы: #44

27. Сообщение от aname (ok), 28-Июл-26, 13:09   –2 +/
> Это конечно здорово, но я не совсем понимаю зачем. Сейчас мощности и
> так упираются в пропускную способность канала. Использовать эту технологию на большинстве
> серверов это как экскаватором играть в песочнице

Так а кто заставляет- то? Не надо- не включай, в чём проблема- то?

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #18

28. Сообщение от Аноним (28), 28-Июл-26, 13:12    Скрыто ботом-модератором–1 +/
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #23

29. Сообщение от Аноним1234 (?), 28-Июл-26, 13:13   +1 +/
Ну и потому что там ecc есть она не "сбойная" в итоге.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #20 Ответы: #42

30. Сообщение от Bob (??), 28-Июл-26, 13:29   +2 +/
тут некоторые cpu + gpu + ram + npu воедино собрали и ssd распаяли. Куда дальше то?)
p.s.: огрызок
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #10 Ответы: #35, #36, #39, #125

33. Сообщение от Аноним1234 (?), 28-Июл-26, 13:36   +2 +/
Найдите мне хоть один l4 vpn который может, хоть при каком канале 10+ Гбит. Таких нет, может появятся с этой штукой.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #18

34. Сообщение от test (??), 28-Июл-26, 13:41   –3 +/
> Поддержка GPU NVIDIA пока затруднена из-за отсутствия полноценного открытого драйвера в основном составе ядра

В смысле? Давно уже есть открытый драйвер в ядре от nvidia.

Правда либы в прострастве пользователя закрытые, но судя по сабжу тут это не нужно.

Ответить | Правка | Наверх | Cообщить модератору

35. Сообщение от Аноним (-), 28-Июл-26, 13:45   +1 +/
> тут некоторые cpu + gpu + ram + npu воедино собрали и ssd распаяли. Куда дальше то?)

мне хотелось бы пару (десятков) гигов HBM прям на проц
но цена будет огого

> p.s.: огрызок

при этом отлично работает


Ответить | Правка | Наверх | Cообщить модератору
Родитель: #30

36. Сообщение от Аноним (36), 28-Июл-26, 13:49   –1 +/
Ещё процессор кубитов добавить. Затопив это всё в жидком азоте.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #30

37. Сообщение от Аноним (37), 28-Июл-26, 13:49   +5 +/
В бытность одной из причин, по которой серьёзное телеком оборудование было на самописных системах (или модифицированной бзде), а не на всепобеждающем онтопике было банальное затачивание под аппаратное ускорение обработки сети. Контроллеры не просто перекладывали пакеты, но и могли брать на себя многие вещи на L2/L3.
Сейчас серьёзные аппаратные штуки может делать наверное только huawei, потому что там много сложной математики, которую нужно скрестить с ограничениями железа; из последнего — интеллектуальный АФАР в топовых трубках где-то с 19-го года.
Остальные же наоборот упрощают железную часть, полагаясь на грубую мощность процессора и рост пропускной способности интерконнекта; все эти SDR из той же оперы, где вместо сложного железа пытаются компенсировать многие вещи софтом. Это работает до поры до времени, однако сейчас все хотят не просто передавать данные, но и ещё на лету оперативно их изучать, чтобы пативен приезжал не по факту обнаружения и удаления неугодного комментария, а саму нежелательную информацию можно было бы обнаружить и остановить сразу при попытке её опубликовать. Вкупе с обилием вычислительных мощностей, закупленных под пузырь нейронок (ну не получается из гиберкуба со свёрткой робобога, сколько туда мощностей не закидывай) вполне можно разгрузить и ускорить все эти типовые задачи полицейского государства.

Технически это всё конечно выглядит интересно, но по факту поводов для радости мало; как бы плохо не было там, местная власть в рамках best practices привычно подорвётся повторять, и ТСПУ/СОРМ на этом фоне покажутся цветочками.

Ответить | Правка | Наверх | Cообщить модератору
Ответы: #58

39. Сообщение от эксперт по всему (?), 28-Июл-26, 13:53   +/
в итоге получилось прекрасно за счет это. можно не сильно порезанный qwen гонять на ноуте с 36Гб RAM

ну а в целом, если вы припаяете сетевые порты к gpu, то получите что-то типа NPU (но где N это neural, а network). такие NPU и сейчас есть, но они все под NDA

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #30

40. Сообщение от Аноним (40), 28-Июл-26, 13:57   +2 +/
Это очень опасная область для 0-day, причем современные LLM-ки её плохо понимают, потому что у них такого кода нет в обучающих датасетах.Коммерческий или академический, узкоспециализированный код.
Ответить | Правка | Наверх | Cообщить модератору
Ответы: #43, #49, #145

41. Сообщение от Аноним (41), 28-Июл-26, 13:58   +2 +/
а что производители сетевых карточек акселераторы всяких ipsec не додумались изобрести? Хотя по идее крипто-операции должны исполняться на криптографическом сопроцессоре. А тут сунули какой-то гпу как компьют (дата) юнит, а цпу как менеджмент юнит. Все как в современных аля коробочных файерволах, только там за место гпу, всякие фпга и асики.
Ответить | Правка | Наверх | Cообщить модератору
Ответы: #70, #74, #109

42. Сообщение от Аноним (19), 28-Июл-26, 14:00   +1 +/
Как правильно, что Вы используете кавычки. Там ещё смайлики можно было понавставить.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #29

43. Сообщение от Аноним (40), 28-Июл-26, 14:01   +1 +/
Вынесу GPU подсистему и еще одну физическую железку в сеть. Что может пойти не так ? ¯\_(ツ)_/¯
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #40

44. Сообщение от Анонисссм (?), 28-Июл-26, 14:01   +3 +/
>Значение "ECC" знаешь?

а ты? ECC не гарантия детекта и тем более исправления любой ошибки.

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #26 Ответы: #107

45. Сообщение от Аноним (63), 28-Июл-26, 14:01   +/
Есть PRO видеокарты с ECC-памятью:
- https://www.techpowerup.com/img/DxrRV5UDmiOGPmTo.jpg
- https://www.techpowerup.com/img/saj8I2z3Efs9F8eN.jpg
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #5 Ответы: #54, #137

46. Сообщение от Аноним (19), 28-Июл-26, 14:01   +1 +/
Естественно, технология zero-cost для GPU.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #25 Ответы: #48

48. Сообщение от aname (ok), 28-Июл-26, 14:05   –1 +/
> Естественно, технология zero-cost для GPU.

Ты примеры показывай.

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #46 Ответы: #73

49. Сообщение от Аноним (40), 28-Июл-26, 14:05   +1 +/
Правильно ли я понял, что помимо проприетарных блобов внутри CPU и сетевой карты, теперь мои пакеты будет еще и проприетарный блоб видеокарты обрабатывать ? Firmware
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #40 Ответы: #89

50. Сообщение от Аноним (50), 28-Июл-26, 14:17   +/
>для ускорения обработки сетевых пакетов в ядре Linux

А что, железного ускорения уже не хватает? Для сетевых пакетов-то, ну.

Ответить | Правка | Наверх | Cообщить модератору
Ответы: #51, #103

51. Сообщение от Аноним (50), 28-Июл-26, 14:19    Скрыто ботом-модератором+/
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #50

52. Сообщение от Аноним (52), 28-Июл-26, 14:20   +1 +/
Всё равно слабо представляю себе такую ультра-сетевую железку на терабайты трафика с видяхой.

А так, как бы обработку сетевого трафика логичнее переваливать на сетевой адаптер, а не на графический. Помнится в далёком прошлом были популярны TCP Offload настройки

Ответить | Правка | Наверх | Cообщить модератору
Ответы: #55, #59

53. Сообщение от BorichL (ok), 28-Июл-26, 14:22   +2 +/
Пора переименовать GPU в CPU, CPU в контроллер ввода-вывода.
Ответить | Правка | Наверх | Cообщить модератору
Ответы: #56

54. Сообщение от Аноним (5), 28-Июл-26, 14:27   +1 +/
Да вот стоят они неприлично. Асики в любом случае будут дешевле и эффективнее.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #45

55. Сообщение от Аноним (41), 28-Июл-26, 14:28   +/
в эру всяких технологий виртуализации - отрубали к х3рам собачим
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #52 Ответы: #90

56. Сообщение от Аноним (41), 28-Июл-26, 14:29   +/
ну да было время IO-card :)
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #53

57. Сообщение от JoePeach (ok), 28-Июл-26, 14:38   +3 +/
>нужное видимо одному-единственному корпоративному заказчику

Уже нет. Балканизация Интернета нарастает. Теперь это нужно всем, даже Штатам и Европе.

> это божок-с-пальцем точно одобрит

Так у него выбора нет. И вопрос не в деньгах. Просто из АНБ позвонят и скажут: "Нам надо! Метнулся и вмержыл!"

>Мариванна, это... не молоток, в общем. Для забивания

Ты даже не представляешь, как они нас задолбят. Ведь теперь ТСПУ получат поистине вселенскую мощь! Ну и новый дефицит видеокарт.

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #3

58. Сообщение от Аноним (58), 28-Июл-26, 14:39   +2 +/
Как будто Карманова прочитал.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #37

59. Сообщение от Аноним (5), 28-Июл-26, 14:39    Скрыто ботом-модератором+/
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #52 Ответы: #84

61. Сообщение от Аноним (61), 28-Июл-26, 14:41   +/
А почему параллелизм, а не параллелелизм? Хочу параллелелизм в параллелограмме
Ответить | Правка | Наверх | Cообщить модератору

62. Сообщение от Аноним (62), 28-Июл-26, 14:44   +/
> тады-уж и ядро целиком на ЖПУ запускать,

Так было уже. НАписали эмулфтор на пикселном шейдере и запустили порт линукс ядра для risc-v внутри VRChat.

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #10

63. Сообщение от Аноним (63), 28-Июл-26, 14:48   +/
>заказчику (из китая, вестимо)

Там свой путь огораживания:
https://servernews.ru/1145614

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #3

65. Сообщение от Аноним (65), 28-Июл-26, 14:56   +2 +/
Дак вкрячьте в видюху сразу сетевой разъём, зачем эти нелепые телодвижения. И usb на вырост, антенну опять же.
Ответить | Правка | Наверх | Cообщить модератору
Ответы: #120

66. Сообщение от Аноним (11), 28-Июл-26, 15:00   +1 +/
Ну и? Жесткие диски уже лет 20 работают только с коррекцией ошибок. "сбойные", не иначе.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #20 Ответы: #134, #135

67. Сообщение от Alladin (?), 28-Июл-26, 15:09   +/
интересная у вас логика, вот существует серверная ecc озу память, у пользователей обычная.. значит серверам нужна сбойная память?)
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #20 Ответы: #72

68. Сообщение от Alladin (?), 28-Июл-26, 15:12   –1 +/
сейчас мощности не упираются в пропускную канала, продолжать даже смешно
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #18

70. Сообщение от Аноним (62), 28-Июл-26, 15:25   +/
> только там за место гпу, всякие фпга и асики

фпга запрограммированные под конкретную задачу справляются порой не хуже (а иногда и лучше) чем гпу, их только программировать долго и муторно.
А асики под конкретную задачу вообще уделывают гпу, но их перепрограммировать нельзя под другую.

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #41 Ответы: #99

71. Сообщение от ятупойтролль (ok), 28-Июл-26, 15:26   –2 +/
конечно же связка сетевуха-цпу-память-цпу-видеокарта-цпу-память-сетевуха работает быстрее, чем сетевуха-память-цпу-память-сетевуха.
Ответить | Правка | Наверх | Cообщить модератору
Ответы: #86

72. Сообщение от Аноним (19), 28-Июл-26, 15:31   –1 +/
Давайте погадаем, почему у юзеров обычная память да ещё без ЕЦЦ работает, а у серверов какая-то особенная да ещё с ЕЦЦ обязательно...
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #67 Ответы: #98

73. Сообщение от Аноним (19), 28-Июл-26, 15:32   +2 +/
Примеры - чего? Zero-cost для GPU? Дак это ты должен это показывать.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #48

74. Сообщение от devl547 (ok), 28-Июл-26, 16:08   +/
>производители сетевых карточек акселераторы всяких ipsec не додумались изобрести?

Додумались. Тот же Intel QuickAssist.

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #41 Ответы: #101

75. Сообщение от anonymous (??), 28-Июл-26, 16:13   +1 +/
Нахрена GPU? Вроде бы на приличных сетевых картах есть собственные хардварные ускорители. И стоят они дешевле чем приличные GPU с ECC памятью. Какая-то хрень странная.
Ответить | Правка | Наверх | Cообщить модератору
Ответы: #78

77. Сообщение от Аноним (77), 28-Июл-26, 16:49   –1 +/
>масштабировать .... за счёт массового параллелизма GPU, а не количества ядер CPU.

Сдается мне, что 16 GPU стоят значительно дороже 16-ти ядерного CPU

Ответить | Правка | Наверх | Cообщить модератору

78. Сообщение от Аноним (-), 28-Июл-26, 17:17   +/
Как я понял, моё видение. Шифрование - параллелизм десятки тысяч запросов сможет обработать видеокарта за несколько миллисекунд если мощная видеокарта, а если не мощная то не знаю насколько это быстрее. Параллелизм в видеокарте по количеству шейдеров считают. Имею 384 шейдера в видеокарте. Но, поскольку это виртуализация то работать это не будет с хостом Windows в ближайшие 10-20 лет а может и больше.

"Количество шейдерных ядер по сегментам (на 2026 год). Бюджетный уровень (1080p гейминг): 2 000 — 3 500 ядер.Пример: NVIDIA GeForce RTX 4060 имеет 3 072 ядра CUDA.Средний уровень (1440p гейминг): 4 500 — 10 000 ядер. Пример: NVIDIA GeForce RTX 4070 Super имеет 7 168 ядер CUDA. Флагманский уровень (4K гейминг): 10 000 — 21 000+ ядер. Примеры: AMD Radeon RX 7900 XTX оснащена 6 144 потоковыми процессорами, а новейший суперфлагман NVIDIA GeForce RTX 5090 несет на борту рекордные 21 760 ядер CUDA.

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #75 Ответы: #79, #81

79. Сообщение от Аноним (-), 28-Июл-26, 17:30   +/
"В спецификациях NVIDIA ядра называют CUDA Cores, а AMD использует термин Stream Processors (Потоковые процессоры). Важный нюанс: почему ядра AMD и NVIDIA нельзя сравнивать «в лоб» Из таблицы видно, что флагман AMD (6 144 ядра) имеет меньше шейдеров, чем карта среднего класса от NVIDIA. Это связано с разницей в архитектуре: Ядра NVIDIA считают каждый математический блок (ALU) отдельно. AMD в архитектуре RDNA3 использует «двойные» вычислительные блоки (Dual Issue), которые при определенных условиях могут выполнять в два раза больше инструкций за такт. Поэтому при меньшем числе «на бумаге» они конкурируют с более крупными чипами соперника"
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #78 Ответы: #80

80. Сообщение от Аноним (63), 28-Июл-26, 18:05   +/
>Важный нюанс: почему ядра AMD и NVIDIA нельзя сравнивать «в лоб»

Ну можно, по производительности в одной и той же задаче.
А вообще сами же CUDA-ядра отличаются по архитектуре в зависимости от поколения:
https://en.wikipedia.org/wiki/CUDA#Version_features_and_spec...

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #79 Ответы: #82

81. Сообщение от Аноним (-), 28-Июл-26, 18:19   –1 +/
Виртуализяция которую я рсматриваю это коробка и VMware.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #78

82. Сообщение от Аноним (-), 28-Июл-26, 18:23   +/
Укого задачи именно скорость и деньги не проблема будут максимально производительные видеокарты если им продадут.

"Про 384 шейдера и скорость. Да, 384 шейдера (например, уровень встроенной графики или старых бюджетных карт вроде GT 1030) — это немного по современным меркам. O «десятках тысяч запросов за пару миллисекунд» здесь речи не идет. Однако такая карта все равно может выполнять шифрование (например, AES-CTR) в 3–5 раз быстрее, чем 2-ядерный или 4-ядерный CPU, за счет того, что процессоры обрабатывают данные в 4–8 потоков, а ваша видеокарта — в 384 потока одновременно"

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #80 Ответы: #85, #130

83. Сообщение от zionist (ok), 28-Июл-26, 18:42   +1 +/
Жду появления возможности ускорять графику на контроллераз сетевых интерфейсов. Вангую батлы сколько FPS добавляют ускорители IPv4 vs IPv6.
Ответить | Правка | Наверх | Cообщить модератору
Ответы: #91

84. Сообщение от нах. (?), 28-Июл-26, 18:45   +/
> Интересно, а уже придумали асики для сугубофашистских технологий вроде DPI?

любой ngfw, еще с начала 10х годов. И цискины специфические чорные коробки тем более.

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #59

85. Сообщение от Аноним (85), 28-Июл-26, 18:51   +2 +/
"Сравнение «в 3–5 раз быстрее» справедливо для процессоров БЕЗ аппаратного ускорения AES.Если у центрального процессора (CPU) нет встроенных инструкций AES-NI (Advanced Encryption Standard New Instructions), он вынужден выполнять шифрование чисто программно, тратя на каждый байт данных множество тактов общего назначения. В этом сценарии даже слабая видеокарта с 384 шейдерами легко обходит CPU за счет своей многопоточности.Однако, если мы возьмем процессор С АППАРАТНЫМ AES, ситуация кардинально меняется.Что происходит, если в CPU есть аппаратный AES (AES-NI)?Современные процессоры (начиная с Intel Core 2010 года и AMD Ryzen) имеют внутри ядер специальные крошечные транзисторные блоки, заточенные исключительно под одну задачу — шифрование AES.Бешеная скорость на одно ядро: Одно современное ядро CPU с поддержкой AES-NI способно шифровать данные со скоростью порядка 3–5 Гбайт/секунду на один поток.Отсутствие задержек: Процессору не нужно пересылать данные по шине PCIe на видеокарту и обратно. Все происходит прямо внутри кристалла CPU на частоте около 4-5 ГГц.Сравнение: CPU (с AES-NI) против вашей видеокарты (384 шейдера)Если включить аппаратное ускорение на CPU, ваша видеокарта на 384 шейдера, скорее всего, проиграет обычному 4-ядерному процессору. Вот почему:Узкое горлышко шины (PCIe): Чтобы задействовать 384 шейдера, процессор должен собрать пакет данных, отправить его через шину PCIe в видеокарту, подождать, пока шейдеры отработают, и забрать назад. Время на эту пересылку убьет всю выгоду от параллелизма на маленьком числе ядер.Специфика ядер: Шейдерное ядро — универсальное и относительно медленное (работает на частоте ~1.5 ГГц). Аппаратный блок AES-NI в CPU — специализированный, жестко "впаянный" в логику ядра и работает на частоте ~4 ГГц.Когда видеокарта все равно побеждает?Даже если в CPU есть AES-NI, видеокарта вырвется вперед только в двух случаях:Если видеокарта мощная (флагман): Когда ядер не 384, а 5 000 – 20 000. Тогда гигантский масштаб параллелизма компенсирует любые задержки на пересылку данных.Если сменить алгоритм шифрования: Например, если вы используете алгоритм, под который в CPU нет встроенных транзисторов (какой-нибудь специфический хэш, асимметричное шифрование RSA/ЭЦП или новые постквантовые алгоритмы). Тут видеокарта со своими 384 шейдерами снова окажется в разы быстрее, так как CPU вернется к медленному программному расчету"
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #82 Ответы: #133

86. Сообщение от Мемоним (?), 28-Июл-26, 19:04   +/
> Пакеты для обработки перенаправляются из памяти сетевого адаптера в GPU с использованием DMA и Device Memory TCP.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #71 Ответы: #96

87. Сообщение от Аноним (28), 28-Июл-26, 19:14   +1 +/
И что теперь, ставить AMDGPU в cisco?
Ответить | Правка | Наверх | Cообщить модератору
Ответы: #88, #119

88. Сообщение от Аноним (88), 28-Июл-26, 20:05   +/
В cisco вставлять amdgpu - на любителя, но кому-то может и понравиться. Думаю, японцам зайдёт.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #87 Ответы: #115, #127

89. Сообщение от Аноним (89), 28-Июл-26, 20:13   +/
> помимо проприетарных блобов внутри CPU и сетевой карты, теперь мои пакеты будет еще и проприетарный блоб видеокарты обрабатывать

Ну, они думают, что раз ты затерпел блобы внутри цпу и сетевухи, то и против фирмвари в видеокарте будет выступать только на форумах.

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #49

90. Сообщение от нах. (?), 28-Июл-26, 21:40   +/
у кого вместо технологий были шв@60дкиные под(д)елки - те вырубали. У вас всегда ничего толком не работало.

У кого были технологии - ничего не вырубали, а потом и вовсе в sr-iov начали делить физические карты на ломтики с пробросом этих ломтиков напрямую в виртуалки. Именно ради того чтобы виртуалкин драйвер мог напрямую управлять ускорителем.

И да, там не только tcp offload из нулевых, там еще много чего.

Ну, правда, не на рылотыке с китайского базара конечно, да и тот на днях сгорел.

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #55 Ответы: #102

91. Сообщение от нах. (?), 28-Июл-26, 21:42   +/
давай уже сразу битки майнить, зачем нам эти полумеры.

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #83

92. Сообщение от Аноним (92), 28-Июл-26, 21:57   +1 +/
> Очередное замедление работы экрана и всех графических программ

А ты гоняешь Игоря на хосте, который в это же время прожевывает десятки гигабит трафика?

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #21 Ответы: #93

93. Сообщение от Аноним (19), 28-Июл-26, 22:07   –1 +/
Я дочь очень большого хостера, подскажите, как в роутер цыски установить видюху амд?
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #92

94. Сообщение от Джон Титор (ok), 28-Июл-26, 22:11   +/
У вас электричество бесплатное?
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #13 Ответы: #104, #138

95. Сообщение от Джон Титор (ok), 28-Июл-26, 22:18   +/
Ага и модель ИИ вкорячем для безопасной передачи данных, пусть само как-то разруливает маршрутизацию оптимальным образом. И назовем по современному (sky.net)
Ответить | Правка | Наверх | Cообщить модератору

96. Сообщение от ятупойтролль (ok), 28-Июл-26, 22:52   –1 +/
ну ага, а маршрутизацию как выстраивать то? тоже видеокартой?
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #86 Ответы: #100

97. Сообщение от Однако (?), 28-Июл-26, 23:05   +/
Для обивания груш ...
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #3

98. Сообщение от Аноним (98), 28-Июл-26, 23:29   +4 +/
Потому что если у юзера память втихую попортится, то это проблемы юзера. Ребутнётся и дальше поедет, юзеру надо чтобы подешевле было. А если на сервере, то так можно и деньги потерять.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #72

99. Сообщение от Аноним (41), 28-Июл-26, 23:32   +1 +/
так и есть, только в данном случае оверхед в любом случае на копировании из памяти в память будет, так что как наколенное решение, якобы ускоряющее пакет хендлинг, выглядит весьма сомнительно, поэтому используют dma.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #70

100. Сообщение от Аноним (98), 28-Июл-26, 23:33   +/
Таблица маршрутизации меняется редко. Современное (ну как современное...) телекоммуникационное оборудование ребутает так control plane для апгрейда прошивок без остановки сервиса. А так, не вижу препятствий чтобы BGP прямо на GPU обслуживать, кроме бессмысленности этой затеи.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #96

101. Сообщение от Аноним (41), 28-Июл-26, 23:42   +/
у вас и сетевушка и сам цпу должен поддерживать эту технологию.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #74

102. Сообщение от Аноним (41), 28-Июл-26, 23:47   +/
> У вас всегда ничего толком не работало.

А нуда, я забыл, что всякие nutanix юзают собственную виртуализацию, а не всякие там наколенные qemu-kvm, так вот именно в этом Г и надо было это все отрубать в вирт машине.

> У кого были технологии - ничего не вырубали, а потом и вовсе в sr-iov начали делить физические карты на ломтики с пробросом этих ломтиков напрямую в виртуалки.

А нуда, технологиес, потом пришел бродком и всех натянул.

> Ну, правда, не на рылотыке с китайского базара конечно, да и тот на днях сгорел.

какой рылотык? в глаза не видел, только Ынтел.

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #90 Ответы: #112

103. Сообщение от pofigist (?), 28-Июл-26, 23:50   +1 +/
Попытайся затерменировать хотя бы несколько тысяч vpn-сесий... Вот тогда и поймёшь нафига козе баян...
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #50 Ответы: #113, #132

104. Сообщение от aname (ok), 29-Июл-26, 01:16   +/
> У вас электричество бесплатное?

Своё электричество трачу по своему усмотрению

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #94 Ответы: #105

105. Сообщение от Джон Титор (ok), 29-Июл-26, 01:48   +/
Ну что не понятного то? А на телефоне?
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #104

106. Сообщение от Анонимemail (106), 29-Июл-26, 03:15   +/
Linux уже как снежный ком обрастает всевозможной ересью, в итоге становясь недоступной какому-либо аудиту системой.
Ответить | Правка | Наверх | Cообщить модератору

107. Сообщение от edo (ok), 29-Июл-26, 03:30   –3 +/
Любой – нет. Но вероятность необнаружения ошибки при рабочем ecc крайне низкая. Другое дело, что именно в случае видеокарт не гнать как смотреть статистику обнаружения и исправления ошибок
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #44

108. Сообщение от edo (ok), 29-Июл-26, 03:35   –1 +/
Да ничего не упирается, уже есть сетевые карты с портами 400g
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #18 Ответы: #166

109. Сообщение от edo (ok), 29-Июл-26, 03:37   +/
Сетевые карты mellanox умеют оффлоад tls, ipsec, и ещё чего-то
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #41 Ответы: #116

111. Сообщение от slavanap (?), 29-Июл-26, 05:48   +2 +/
Новые технологии DPI
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #18

112. Сообщение от нах. (?), 29-Июл-26, 07:55   +/
> что всякие nutanix

то есть ровно то что ничего толком и не умеет, и предназначено только для любителей докера в докере под докером.

> какой рылотык? в глаза не видел, только Ынтел.

ынтел как раз потому и вылетел с рынка серверов что остался там, в далеких десятых годах, прозевав момент перехода к виртуализации сетей. Все еще отличная карта... для тех у кого нет и не будет никакой виртуализации. Впрочем, ей и там сильно подгадила неспособность интела в драйверы для чего-то кроме lin00ps.

А так да, года с 12го остался один broadcom. (ну и цискины карты у которых даже названия нет, и они из ucs не вынимабельны)

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #102 Ответы: #118

113. Сообщение от халявщик не корпорастemail (?), 29-Июл-26, 11:11   +/
- несколько тысяч vpn-сесий..

А на что ты расчитывал когда сервак мутил?

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #103 Ответы: #117

114. Сообщение от nc (ok), 29-Июл-26, 11:13   +/
Похоже, будущее именно за APU-подобной архитектурой, когда есть кристалл с объединенными центральным процессором, видеокартой со множеством математических ядер и общей памятью. Так что ядро линукса неизбежно будет включать в себя все больше такого кода.
Ответить | Правка | Наверх | Cообщить модератору
Ответы: #122

115. Сообщение от халявщик не корпорастemail (?), 29-Июл-26, 11:22   +/
кетайцам будет нужнее, вот только партия немножко таблицу пифагора подучит и научится правильно в сложение....
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #88

116. Сообщение от Аноним (41), 29-Июл-26, 12:29   +1 +/
сто лет как
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #109

117. Сообщение от pofigist (?), 29-Июл-26, 12:37   –2 +/
Это ты мутишь - покупаешь железо, а потом пишешь по собственному, поскольку нифига не работает.
А я - умею рассчитывать сайзинги.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #113

118. Сообщение от Аноним (41), 29-Июл-26, 12:41   +/
> то есть ровно то что ничего толком и не умеет, и предназначено только для любителей докера в докере под докером.

зависит от задач, не всем же рассчитывать баллистику полета ракет или заниматься сбором персональных данных всего мира (аля эспионажэм)

> А так да, года с 12го остался один broadcom.

чур меня чур упаси хоспади от этого бредкома (брокейда), меланокса и кулогика достаточно.

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #112 Ответы: #123

119. Сообщение от Аноним (120), 29-Июл-26, 13:48   +/
Самое забавное, что встройка, впайка Яблочников, Gpu Озу Cpu, уже имеет все эти функции.
Хоть это и встройка, что осуждаю.
Типа если мало озу, то надо менять ноут, лол.
Но Gpu Озу Cpu, означает что Gpu и Cpu, имеют прямой доступ к Озу, без всяких там Knod.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #87

120. Сообщение от Аноним (120), 29-Июл-26, 13:50   +/
Да понятно, но многие неопнимают.
Если вкорячть Gpu, вообще вместо всего то.
Gpu, не умеет обрабатывать процессы на уровне если-то.
Тоесть если использовать Gpu, вообще для всего. То какая бы она мощная не была, в Gpu, придется ждать завершение предыдущщего процесса.
Что конечно не является проблемой вообще для любого Cpu, хоть 2000 года.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #65

122. Сообщение от Аноним (122), 29-Июл-26, 16:38   +/
Дык амуде норм дискретки слабать не в состоянии. Вот на удивление хоть в цпу кристал завелся. Так что акционер яжефинский палец покажет и стремаясь Кента с бебекешфс все сразу и запилят в нужном направлении.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #114

123. Сообщение от нах. (?), 29-Июл-26, 19:10   +/
да все хорошо с бредкомом. Даже драйверы под линукс, в общем и целом, нормальные:
ethtool -k eno2
Features for eno2:
rx-checksumming: on
tx-checksumming: on
        tx-checksum-ipv4: on
        tx-checksum-ip-generic: off [fixed]
        tx-checksum-ipv6: on
        tx-checksum-fcoe-crc: off [fixed]
        tx-checksum-sctp: off [fixed]
scatter-gather: on
        tx-scatter-gather: on
        tx-scatter-gather-fraglist: off [fixed]
tcp-segmentation-offload: on
        tx-tcp-segmentation: on
        tx-tcp-ecn-segmentation: on
        tx-tcp-mangleid-segmentation: off
        tx-tcp6-segmentation: on
udp-fragmentation-offload: off
generic-segmentation-offload: on
generic-receive-offload: on
large-receive-offload: off
rx-vlan-offload: on [fixed]
tx-vlan-offload: on
ntuple-filters: off [fixed]
receive-hashing: on
highdma: on [fixed]
rx-vlan-filter: on
vlan-challenged: off [fixed]
tx-lockless: off [fixed]
netns-local: off [fixed]
tx-gso-robust: off [fixed]
tx-fcoe-segmentation: off [fixed]
tx-gre-segmentation: on
tx-gre-csum-segmentation: on
tx-ipxip4-segmentation: on
tx-ipxip6-segmentation: off [fixed]
tx-udp_tnl-segmentation: on
tx-udp_tnl-csum-segmentation: on
tx-gso-partial: on
tx-sctp-segmentation: off [fixed]
tx-esp-segmentation: off [fixed]
fcoe-mtu: off [fixed]
tx-nocache-copy: off
loopback: off
rx-fcs: off [fixed]
rx-all: off [fixed]
tx-vlan-stag-hw-insert: off [fixed]
rx-vlan-stag-hw-parse: off [fixed]
rx-vlan-stag-filter: off [fixed]
l2-fwd-offload: off [fixed]
hw-tc-offload: off [fixed]
esp-hw-offload: off [fixed]
esp-tx-csum-hw-offload: off [fixed]
rx-udp_tunnel-port-offload: on

т.е. GRO нет но в целом что-то есть и работает. NetXtreme2, мягко говоря, устаревшие.


меланнокс в общем и целом про ib, где его хм...особенности и потерпеть можно.

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #118 Ответы: #124

124. Сообщение от Аноним (41), 29-Июл-26, 19:26   +/
> где его хм...особенности

особенности в любом случае только по бенчам под задачу, а так для HPC выбирали всегда меланокс инфинибанд.

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #123 Ответы: #126

125. Сообщение от laindono (ok), 29-Июл-26, 19:39   +/
Дальше в один большой чип размером с кремниевую кругляшечку. Потом слоями так чтоб столб получился. На столбе можно будет вешать несогласных.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #30

126. Сообщение от нах. (?), 29-Июл-26, 19:42   +/
ib совершенно другая история. Мы тут про сетевые адаптеры для сетевых применений (для которых и нужны (нет) эти вон ускорители). И тут кроме броадкома и немношк циски все либо сдохли либо сами себе сделали сепукку, как-то прозевав массовый переход в виртуализацию (и сетей тоже). Причем, надо заметить, это было еще задолго до продажи вмвари, т.е. никто конкурентов не выдавливал, сами, сами, все сами.

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #124 Ответы: #141

127. Сообщение от нах. (?), 29-Июл-26, 19:44   +/
> В cisco вставлять amdgpu - на любителя, но кому-то может и понравиться.
> Думаю, японцам зайдёт.

Циски, оне разные бывают... там иногда такое попадается, что да, японцам бы зашло.

(надо будет посмотреть, истек срок nda или нет еще)

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #88

129. Сообщение от bOOster (ok), 29-Июл-26, 20:34   +/
Полный бред. сетевые карты оффлоадят все что нужно. А обрабатывать остальное на 600+ ваттных GPU - стрельба из пушки по воробьям.
Ответить | Правка | Наверх | Cообщить модератору

130. Сообщение от bOOster (ok), 29-Июл-26, 20:46   +/
Ага, в 3-5 раз. Абсолютно бестолковое рассуждение.
Во первых процессор может иметь свое AES шифрование (без разницы какой постфикс -CTR или что-то еще. что есть алгоритм "перемешивания" шифрованных блоков), в большинстве современных процессоров AES встроен, а перемещивание, значительно менее трудоемкая задача.
Во вторых толкать массивы данных по PCI-E шине туда-сюда - весьма трудоемкое занятие. Особенно когда надо зайдействовать хрен сколько потоков.
Мощность видеокарт в том что они запихивают данные в свою RAM и работают с ними длительный период времени, практически не обращаясь с шине PCI-E.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #82

131. Сообщение от bOOster (ok), 29-Июл-26, 20:50   +/
А так молодцы, латентность Linux сетевого стека и так практически худшая относительно Unix систем, а с ускорением на GPU станет вообще аховой.
Плюс будет тормозить всю остальную переферию, так как GPU будет эксклюзивно забирать на себя всю пропускную способность PCI-E

Современные бредогенераторы из разряда растаманов и иже с ними - тупо не понимают как работает железо вычислительной техники.

Ответить | Правка | Наверх | Cообщить модератору

132. Сообщение от bOOster (ok), 29-Июл-26, 20:51   +/
И нафига козе баян? Чтобы положить напрочь PCI-E шину? Или по твоему данные от процессора до GPU и обратно святой дух в пакетах передает?
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #103 Ответы: #151, #154

133. Сообщение от bOOster (ok), 29-Июл-26, 20:55   +/
>[оверквотинг удален]
> в CPU — специализированный, жестко "впаянный" в логику ядра и работает
> на частоте ~4 ГГц.Когда видеокарта все равно побеждает?Даже если в CPU
> есть AES-NI, видеокарта вырвется вперед только в двух случаях:Если видеокарта мощная
> (флагман): Когда ядер не 384, а 5 000 – 20 000.
> Тогда гигантский масштаб параллелизма компенсирует любые задержки на пересылку данных.Если
> сменить алгоритм шифрования: Например, если вы используете алгоритм, под который в
> CPU нет встроенных транзисторов (какой-нибудь специфический хэш, асимметричное шифрование
> RSA/ЭЦП или новые постквантовые алгоритмы). Тут видеокарта со своими 384 шейдерами
> снова окажется в разы быстрее, так как CPU вернется к медленному
> программному расчету"

хоть одно разумное мнение. Сорри, оно свернуто было, я от себя тоже про PCI-E на "маслах" писал.

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #85 Ответы: #142

134. Сообщение от Аноним (153), 29-Июл-26, 21:08   –1 +/
А ты сравни блоки ECC у дисков и рамки...
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #66

135. Сообщение от Аноним (153), 29-Июл-26, 21:11   +/
И второе по дискам: диск начинает чтение, когда головка ещё не встала точно на дорогу. Потому что быстрее прочитать примерно и исправить через ECC, чем тискаться с точным выставлением головок.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #66

137. Сообщение от Аноним (137), 29-Июл-26, 23:22   +/
Видеокарты, для типичного Нормиса.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #45 Ответы: #143

138. Сообщение от Аноним (139), 29-Июл-26, 23:25   +/
Надо понимать, CPU у вас электричество не жрёт.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #94 Ответы: #144

139. Сообщение от Аноним (139), 29-Июл-26, 23:29   +1 +/
И как же люди GPGPU-вычислениями занимались до вашего откровения.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #5 Ответы: #140

140. Сообщение от Аноним (5), 29-Июл-26, 23:32   +/
Так и занимались, зачем ты их людьми называешь?
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #139

141. Сообщение от Аноним (41), 30-Июл-26, 00:52   +/
> ib совершенно другая история. Мы тут про сетевые адаптеры для сетевых применений (для которых и нужны (нет) эти вон ускорители).

так оно и используется для построение сети во всяких вычислительных кластерах. И фишка именно в RDMA.

> И тут кроме броадкома и немношк циски все либо сдохли либо сами себе сделали сепукку

берем тот же леново и видим, сетевухи от интела и бродкома, тоже самое у всяких делл или хпе.

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #126

142. Сообщение от Аноним (-), 30-Июл-26, 01:20   +/
Разграничивать надо. Если у процессора аппаратное решение есть тогда слабые видеокарты не годятся и только если этого нет в процессоре аппаратно то тогда можно рассматривать слабые видеокарты или встроенные в процессор. Мощные видеокарты это если на видеокарте не параллельно с ресурсной игрой которая сама ресурсы видеокарты потребляет много. Знать надо логику что, где, и когда. Я сразу прочитав новость представил не для дома, для себя, а что-то вреде майнинга с кучей видеокарт в кластерах.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #133 Ответы: #146, #147

143. Сообщение от Аноним (63), 30-Июл-26, 01:27   +/
Arc Pro B60/B65/B70 стоят относительно не дорого даже у нас, есть версии игровых RTX 5080 которые дороже.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #137

144. Сообщение от Джон Титор (ok), 30-Июл-26, 03:13   –1 +/
> Надо понимать, CPU у вас электричество не жрёт.

Ну поменьше чем у GPU

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #138 Ответы: #155

145. Сообщение от Аноним (-), 30-Июл-26, 08:43   +/
> выполняет JIT-компиляцию BPF-программ обработки пакетов для выполнения на GPU.

Это значит что никто не знает даже что в конечном итоге будет исполнятся на GPU!

Почему нельзя все скомпилить во время сборки ядра? Зачем JIT.  Там даже нет смысла искать дыру в коде. Мозга с помощью JIT сразу вирусной код собирать и запускать.

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #40 Ответы: #148

146. Сообщение от Аноним (-), 30-Июл-26, 09:03   +/
"KNOD в ядре Linux. Это узкоспециализированная, сугубо инженерная разработка, которая обычному пользователю (и даже среднему серверу) дома или в офисе абсолютно не нужна"
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #142

147. Сообщение от Аноним (-), 30-Июл-26, 09:06   +/
"В чем суть этой технологии (KNOD)? Разработчики предложили компилировать BPF-программы (сетевые фильтры, маршрутизацию) прямо в машинный код видеокарты. Сетевой адаптер перенаправляет терабайты пакетов напрямую в память GPU (минуя процессор), и видеокарта параллельно обрабатывает их тысячами своих потоков"
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #142

148. Сообщение от Аноним (148), 30-Июл-26, 09:13   +/
Если хочется нативный код в ядре, надо писать модуль а не BPF.

BPF это пользовательский код для виртуальной машины. Пользователю не дают загружать нативный код, чтобы он не поломал ядро.

JIT для BPF можно при желании отключить через sysfs или флагами ядра

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #145 Ответы: #149, #150

149. Сообщение от Аноним (149), 30-Июл-26, 10:13   +/
Матчу ядро руками, чтобы этот BPF вообще отключить на amd64.

Не желаю, чтобы пользователь на ядре что-то запускал.

Да я за наличный код ядра, с возможностью выбора монолит или модуль, что кому нравится.

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #148

150. Сообщение от Аноним (-), 30-Июл-26, 10:21   +/
Матчу ядро руками, чтобы этот BPF вообще отключить на amd64.

Не желаю, чтобы пользователь на ядре что-то запускал.

Да я за наличный код ядра, с возможностью выбора монолит или модуль, что кому нравится.

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #148

151. Сообщение от Аноним (139), 30-Июл-26, 11:11   +/
Как вы положите шину, если видеокарте выделено фиксированное количество линий?
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #132 Ответы: #165

152. Сообщение от Аноним (153), 30-Июл-26, 12:12   +1 +/
Ввод мышки ещё не ускоряли на GPU?
Ответить | Правка | Наверх | Cообщить модератору
Ответы: #156

153. Сообщение от Аноним (153), 30-Июл-26, 12:14   +/
Предлагаю им свободную идею: ускорить системный зуммер с помощью GPU. А то компутер при включении слишком устаревши пикает.
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #6

154. Сообщение от pofigist (?), 30-Июл-26, 13:37   +/
Ну у современных карт для pci-e gen5 предел это где-то 150-250 mpps... Положить конечно можно, но для этого потребуются 100gbe eth. Поверь - раньше ляжет CPU, в попытках шифровать/дешифровать такой поток...
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #132

155. Сообщение от Аноним (155), 30-Июл-26, 14:20   +1 +/
У какого CPU (а они сейчас кушают много)? Меньше, чем у какого GPU? И самое главное — какова эффективность на ватт?
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #144

156. Сообщение от Аноним (-), 30-Июл-26, 14:51   –1 +/
"Отвечаю прямо на ваш вопрос: нет, сам ввод мыши на GPU не переносили, и делать этого никто не будет, потому что физическая обработка движений мыши — это задача центрального процессора (CPU) и ядра операционной системы, а не видеокарты.Вся ирония и проблема Wayland, из-за которой рождается этот вопрос, кроется в фундаментальной ошибке разделения обязанностей между CPU и GPU.Как устроен путь мыши (почему кажется, что её «не ускорили»):Захват движения (CPU): Когда вы двигаете мышь, её сенсор шлет сигналы. Ядро Linux (через драйвер evdev и библиотеку libinput) обрабатывает эти координаты. Это происходит на CPU и занимает микросекунды.Отрисовка (GPU): Чтобы вы увидели движение, видеокарта должна перерисовать курсор на новом месте экрана.В чем разница между X11 и Wayland:Как было в X11: Ядро Linux сообщало видеокарте новые координаты мыши напрямую (через аппаратный оверлей). Видеокарта просто двигала аппаратный спрайт стрелочки поверх картинки. CPU и графический сервер X11 в этом вообще не участвовали. Отрисовка мыши была «оторвана» от отрисовки окон.Как сделали в Wayland: Разработчики решили, что всё на экране (включая мышь) должно быть частью одного идеального кадра без разрывов (tearing-free). Теперь координаты мыши приходят в композитор (GNOME или KDE), который работает на CPU. Композитор должен смешать картинку рабочего стола и курсор, а затем отдать это на GPU для финальной отрисовки.Итог:Ввод мыши тормозит в Wayland не потому, что его «не ускорили на GPU», а как раз наоборот — потому что отображение мыши слишком сильно завязали на графический конвейер (GPU) и вертикальную синхронизацию (V-Sync). Если видеокарта занята тяжелой задачей или игрой, кадр с новой позицией мыши просто ждет своей очереди, создавая дикое ощущение задержки («ватности»).Сейчас разработчики Wayland пытаются исправить эту архитектурную ошибку, внедряя «асинхронные оверлеи» (фактически возвращаясь к схеме X11), чтобы мышь снова могла отрисовываться на GPU в обход общей очереди кадров.Если у вас сейчас курсор двигается с задержкой, скажите, какая у вас видеокарта? Я подскажу, как в вашей системе обойти этот баг отрисовки Wayland"
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #152 Ответы: #160

160. Сообщение от Аноним (153), 30-Июл-26, 20:09   +/
> Это происходит на CPU и занимает микросекунды

Увы, но нет. Вы забыли про стёк USB. В котором цикл для HID-а занимет 1 мс.

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #156 Ответы: #161

161. Сообщение от Аноним (161), 30-Июл-26, 20:51   +/
Я использую PS/2 для мыши которая может работать через переходник USB -> PS/2. В данный момент мне так удобнее.

Есть такая информация: "В чём разница на пальцах (в миллисекундах):Игровая USB-мышь (1000 Гц) быстрее, чем PS/2.Она передает новые координаты строго каждые 1 мс. Топовые игровые мыши на 4000–8000 Гц снижают этот порог до 0.25–0.125 мс. Физически USB тут выигрывает у старого порта.Обычная офисная USB-мышь (125 Гц) медленнее, чем PS/2.Из-за редкого опроса шины задержка составляет огромные 8 мс. На контрасте с ней PS/2 ощущается более резкой и отзывчивой.Почему PS/2 уникален?У него время ожидания самой шины равно 0 мс. Пакет не ждёт своей очереди, а отправляется мгновенно. Но из-за древности контроллера сам поток данных идет «редкими» порциями (раз в 5–10 мс), что создает микрорывки, которых нет на игровых USB-мышках.Итог: Хорошая USB-мышь (1000 Гц) обгоняет PS/2 на 1.5–4 мс. Но обычная дешевая USB-мышь проигрывает PS/2 около 5–8 мс"

"Wayland действительно всё уравнял. Ему абсолютно всё равно, какая у вас мышь:Старая добрая PS/2 с её мгновенными аппаратными прерываниями;Дешевая офисная USB на 125 Гц с дикой задержкой в 8 мс;Сверхдорогая геймерская USB на 8000 Гц с откликом в 0.125 мс.Как только координаты от любой из этих мышей попадают в графический движок Wayland, они упираются в «великий уравнитель» — принудительный вертикальный синхроимпульс (V-Sync) композитора.Если ваш монитор работает на частоте 60 Гц, Wayland будет обновлять картинку (включая курсор) строго каждые 16.6 миллисекунд. Если видеокарта загружена тяжелой игрой или рендером и пропускает кадры, эта задержка легко прыгает до 33 мс или 50 мс.В этот момент сверхбыстрый отклик PS/2 или игровой мыши просто «растворяется» в ожидании, пока графический сервер соизволит нарисовать следующий идеальный кадр без разрывов. Архитектура победила физику железа"

Мне на отклик мыши всё равно я в игры не играю. А когда играл мне хватало и хватает настроек в Windows двигая ползунок чувствительность движения.

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #160 Ответы: #162

162. Сообщение от Аноним (-), 30-Июл-26, 21:26   +/
"Для клавиатур и мышей USB 2.0 остается золотым стандартом. Он обеспечивает минимальное энергосбережение (шина всегда «прогрета»), полное отсутствие радиопомех на частоте 2.4 ГГц и честную задержку в 1 мс.Порты USB 3.0 и 4.0 созданы для «тяжелых» данных — внешних дисков, мониторов и видеокарт, а мышке на этом празднике скоростей ловить нечего" Игроманам заморачиватся приходится с мышью если они в теме.

"Золотые правила для киберспортсмена (Чек-лист «В теме»):Никаких внешних хабов-коробочек: Мышь втыкается только напрямую в материнскую плату (в порты на задней панели).Для частоты 125 – 1000 Гц: Идеален порт USB 2.0 (меньше наводок, стабильное питание).Для частоты 4000 – 8000 Гц: Строго порт USB 3.0 (и выше) + беспроводной передатчик должен лежать прямо на столе возле мышки.И главное — Windows/X11: Если человек играет на профессиональном уровне, он обходит Wayland стороной (или настраивает Gamescope/Explicit Sync), иначе все эти 8000 Гц и 0.125 мс отклика превратятся в кашу из-за вертикальной синхронизации графического сервера"

И как я уже писал меня это не волнует. Единственное на что я смотрю это какой сенсор у мыши и удобство. Сенсор чтобы работал на гладких поверхностях и срывов курсора на гладких поверхностях не было.

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #161

165. Сообщение от pofigist (?), 31-Июл-26, 11:17   +/
> Как вы положите шину, если видеокарте выделено фиксированное количество линий?

Можно. Просто root switch имеет не безграничные ресурсы...

Ответить | Правка | Наверх | Cообщить модератору
Родитель: #151

166. Сообщение от Брат Анон (ok), 31-Июл-26, 20:09   +/
У тебя нет. И денег тебе на такое не хватит в ближайшие лет 10..15
Ответить | Правка | Наверх | Cообщить модератору
Родитель: #108


Архив | Удалить

Рекомендовать для помещения в FAQ | Индекс форумов | Темы | Пред. тема | След. тема




Партнёры:
PostgresPro
Inferno Solutions
Hosting by Hoster.ru
Хостинг:

Закладки на сайте
Проследить за страницей
Created 1996-2026 by Maxim Chirkov
Добавить, Поддержать, Вебмастеру