Процессорная топология

Кэш процессора

Определение

Кэш процессора — быстрая память для данных и инструкций, которая сокращает обращения к основной памяти. Уровни, объём и совместное использование кэша ядрами зависят от модели CPU.

Также ищут: CPU cache · процессорный кэш · кэш CPU

Зачем это знать

Больший общий объём кэша не гарантирует меньшую задержку задачи. Важны рабочий набор, схема доступа, разделение кэша между ядрами и обращения к основной памяти, поэтому результат проверяют нагрузкой.

Связи из словаря

Карта понятия

Доказательная часть

Что подтверждено

  1. В описании Sandy Bridge у каждого ядра есть кэш инструкций L1, кэш данных L1 и L2, а ядра пакета подключены к общему последнему уровню кэша.

    Граница применимости: Intel Optimization Reference Manual 248966-026, апрель 2012, §2.1.5, PDF с. 52 (печатная 2-15): Sandy Bridge; это не универсальная схема всех CPU.

  2. В Sandy Bridge фактическая задержка загрузки может зависеть от занятости очередей кэша и кольца LLC, компонентов памяти и их параметров.

    Граница применимости: Intel Optimization Reference Manual 248966-026, апрель 2012, §2.1.5.1, PDF с. 53 (печатная 2-16): Sandy Bridge; числа задержек на другую модель не переносят.

  3. Один объём кэша не даёт общего прогноза времени задачи: для вывода о нагрузке нужны измерения её обращений к данным.

    Граница применимости: Редакторский вывод: исторический пример Sandy Bridge ограничен своей моделью, а VTune 2025.1 измеряет промахи LLC и обращения к DRAM; численная выгода не обещается.

Перед спецификацией

Что проверить

  1. Сверьте точную модель CPU и её паспорт кэшей.
  2. Зафиксируйте размер и схему доступа рабочего набора.
  3. Учтите, какие уровни кэша разделяют ядра.
  4. Измерьте целевую задачу, а не только объём кэша.
Открытые основания

Первоисточники

  • Документация2
  • Официальная документация
    Intel® 64 and IA-32 Architectures Optimization Reference Manual Intel · 248966-026, апрель 2012, §2.1.5–2.1.5.1, Sandy Bridge, PDF с. 52–53 · проверено

    Sandy Bridge: L1I, L1D и L2 у ядра, общий LLC; фактическая задержка зависит от занятости очередей, кольца LLC и параметров памяти. Исторический пример, не паспорт иной модели.

  • Официальная документация
    Memory Access Analysis for Cache Misses and High Bandwidth Issues Intel · VTune Profiler User Guide 2025.1, How It Works · проверено

    Документация описывает метрики промахов LLC, обращений к локальной и удалённой DRAM, а также ограничений L1/L2/L3 и DRAM; набор метрик зависит от микроархитектуры.

Карта знаний

Связанные понятия

Из знания — в навык

Курсы по теме

Следующий шаг

Сформулируйте задачу и уточните требования к своей системе.

Подготовить состав проекта

Откроется черновик вопроса. Отправьте его, когда будете готовы.

Сообщить об ошибке

Опишите проблему — постараемся исправить как можно скорее.

Спасибо!

Получили ваше сообщение.
Подтвердите действие