4 mLuXoR Лига тыжпрограммистов Производительность процессора по памяти 4 месяца назад решил проапгрейдиться, но синтетика показывает, что случился down-grade....комрады, подскажите, где кроется причина. Сервер перезагружал, биос не сбрасывал. был проц 2620v4, стал 2680v4 до (2620v4) после (2680v4) вопрос решен - пересобрал память по каналам, стало [моё] Процессор Оперативная память Сервер Компьютерное железо Компьютер 2 1 Ещё 0
Спросил у нейронки. Ответ:
Потому что уперся не в «мощность процессора», а в организацию подсистемы памяти и поведение контроллера памяти у конкретного Xeon.
У тебя было:
Intel Xeon E5-2620 v4 — 8 ядер
стало: 14-Core Intel Xeon E5-2680 v4
И что видно:
Было (2620v4)
Read: ~41.4 GB/s
Write: ~35.5 GB/s
Copy: ~37.2 GB/s
Стало (2680v4)
Read: ~33.3 GB/s
Write: ~28.9 GB/s
Copy: ~31.1 GB/s
Но при этом:
L1/L2/L3 стали сильно быстрее
latency даже чуть лучше (89 ns vs 92 ns)
CPU clock выше: 3.29 ГГц vs 2.8 ГГц
То есть сам процессор быстрее. Просела именно ОЗУ.
Главная причина — у тебя память работает в triple channel вместо quad channel.
На обоих скринах видно:
А у платформы LGA2011-v3 контроллер памяти — 4-канальный.
Для Broadwell-EP очень важно:
сколько каналов занято,
сколько рангов,
как распределены модули.
С 2620v4 контроллер мог легче держать более агрессивный режим работы, а с 2680v4:
больше ядер,
больше нагрузка на ring bus/uncore,
другой mesh/cache behavior,
другой IMC binning (качество контроллера памяти).
Из-за этого реальная пропускная способность памяти может стать ниже, особенно в triple channel.
Еще важный момент:
У тебя NB Clock:
2620v4 → 1300 MHz
2680v4 → 1396 MHz
Но memory throughput ниже — это типичный признак того, что:
не хватает одного канала памяти,
либо память распределена несимметрично по слотам.
То есть проблема почти наверняка не в «процессор хуже», а в конфигурации RAM.
Что бы я проверил первым:
Стоят ли планки в правильных слотах для quad-channel
У Supermicro это критично.
Почему вообще Triple Channel?
Для Xeon E5 v4 желательно:
4 одинаковых модуля
или
8 одинаковых модулей.
Нет ли режима NUMA/Node Interleaving в BIOS
Иногда он режет результаты AIDA.
Uncore/cache ratio
На Xeon v3/v4 он сильно влияет на memory benchmark.
Rank модулей
Quad-rank RDIMM иногда снижают скорость.
И еще важное:
AIDA memory benchmark очень чувствителен к:
частоте uncore,
таймингам,
interleaving,
количеству каналов.
Поэтому более мощный CPU вполне может показать меньшие MB/s в AIDA, но при этом быть быстрее в реальных задачах.
Особенно 2680v4:
имеет намного больше ядер,
больше L3,
лучше многопоток.
Если хочешь — можешь скинуть:
сколько планок памяти,
какие именно модули,
в какие слоты вставлены,
и я скажу, почему именно у тебя triple channel и как вернуть 45–55 GB/s на этой платформе.
Насчет скинуть конфиги и добить эту тему - это уже сам, думаю, сможешь осилить.