Смекни!
smekni.com

Усовершенствование материнской платы (стр. 4 из 11)

Нередко кэш-память распределяют по нескольким уровням. Кэш первого уровня выполняется в том же кристалле, что и сам процессор, и имеет объем порядка десятков Кбайт. Кэш второго уровня находится либо в кристалле процессора, либо в том же узле, что и процессор, хотя и исполняется на отдельном кристалле. Кэш-память первого и второго уровня работает на частоте, согласованной с частотой ядра процессора.

Кэш-память третьего уровня выполняют на быстродействующих микросхемах типа SRAM и размещают на материнской плате вблизи процессора. Ее объемы могут достигать нескольких Мбайт, но работает она на частоте материнской платы.

Процессор на материнской плате находится в специальных колодках, которые носят название сокет или слот 1. Подавляющее большинства моделей процессоров установлены именно в сокетах. Слот использовали 2 поколение процессоров Пентиум и используют процессоры АМД.

В основе работы современных процессоров лежит вероятностная модель. Её смысл заключается в том, что процессор предсказывает последующие действия программы или пользователя, основываясь на их предыдущих действиях.

Немаловажным фактом при анализе процесса является фирма изготовитель.

Существует несколько таких фирм, это: Intel, AMD, Cyrix, IBM, Texas Instruments. (Размышления на тему процессоров). В принципе все фирмы производители конфигурировали свои процессоры, таким образом, чтоб они были Intel совместимы. Долгое время лидирующие места на рынке процессоров занимала фирма Intel. В основном это связано с тем, что до шестого поколения процессор фирмы AMD, у данных процессоров существовала серьезная проблема, связанная с плавающей точкой. (Заключается в том, округления производимые компьютером при вычислениях, при суммировании давали существенную ошибку). Сегодня эта ошибка компанией AMD устранена. На сегодняшний день данной фирмой разработано и выпущено в серийное производство семь поколений процессоров Pentium.

К первому поколению относятся процессоры 8086.

Второе поколение процессоров - это 286, 386, 486.

Третье поколение процессоров - Пентиум 1

Четвертое поколение - Пентиум ММХ

Пятое поколение - Пентиум 2

Шестое поколение - Пентиум 3

Седьмое поколение - Пентиум 4.

Современные процессоры Intel выпускаются в двух модификациях полная модель и более дешевая модель, не имеющая кеша второго уровня, которая называется Celeron, что отражается на производительности компьютера. (Немного философии). Компания Intel выпускает 32-разрядные процессоры, компанией AMD был выпущен 64-разрядный процессор, который имеет удвоенную внутреннюю шину, за счет чего быстродействие его значительно повысилось по сравнению с процессорами фирмы Intel. Что сделало процессоры фирмы AMD более востребованными по сравнению с процессорами фирмы Intel. (Соотношение цена -качество, однако только для бытовых целей).

Рассмотрим архитектуру современного компьютера фирмы Intel.

Intel Pentium 4 - это первый процессор в семействе 32-битных процессор седьмого поколения от Intela. В след за ним в этом семействе разработаны процессоры с кодовыми именами Foster (модифицированный Intel Pentium 4, предназначенный для использования в серверах) и Northwood (модификация Intel Pentium 4, изготавливаемая по 0,13 - микронной технологии).

Позиционируется Intel Pentium 4 как процессор высокопроизводительных настольных компьютеров и рабочих станций начального уровня.

Его основные характеристики:

- тактовая частота: 1,30-3,06 ГГц;

- технология производства - 0,18 мкм (но это все скоро умрет вместе с кремнием, будущее за алюминием, в продаже пока нет);

- L1-кэш 200 Кбайт;

- L2-кэш 256 Кбайт, работает на тактовой частоте ядра, интегрирован на одном кристалле с процессором, поддерживает ECC-механизм обнаружения и коррекции ошибок при обмене данными с ядром процессора, обмен данными с ядром процессора идет по 256-битной шине;

- частота системной шины: физическая - 100 МГц, эффективная - 400МГц;

- напряжение питания ядра процессора 1,70 В;

- поддерживается SSE и SSE2 наборы SIMD-инструкции;

- исполнение: PGA-микросхема с 423 контактными ножками;

- процессорный разъем Socket 478.

Несмотря на то что Intel Pentium 4 сильно отличается от архитектуры процессоров Р6 (в него входят процессоры Intel Pentium Pro, Intel Pentium II, Intel Pentium III, Intel Celeron, Intel Xeon) и даже получило специальное название - NetBurst. В числе основных новшеств, появившихся в NetBurst - Hyper Pipelined Technology, Advanced Dynamic Execution, Trace Cache, Rapid Execute Engine, Streaming SIND Extension 2 (SSE2).

Hyper Pipelined Technology.

Названием Hyper Pipelined Technology конвейер (буфер содержащий команды процессора) Pentium 4 обязан своей длине - 20 стадий. Для сравнения - длина конвейераPentium III составляет 10 стадий. Чего же достиг Intel, так удлинив конвейер? Благодаря декомпозиции выполнения каждой команды на более мелкие этапы, каждый из этих этапов теперь может выполняться быстрее, что позволяет беспрепятственно увеличивать частоту процессора. Так, если при используемом сегодня технологическом процессе 0.18 мкм предельная частота для Pentium III составляет 1 ГГц (ну или, по более оптимистичным оценкам, 1.13 ГГц), Pentium 4 сможет достигнуть частоты 2 ГГц.

Однако, у чрезмерно длинного конвейера есть и свои недостатки. Первый недостаток очевиден - каждая команда теперь, проходя большее число стадий, выполняется дольше. Поэтому, чтобы младшие модели Pentium 4 превосходили по производительности старшие модели Pentium III, частоты Pentium4 начинаются с 1.4 ГГц. Если бы Intel выпустил бы Pentium 4 1 ГГц, то этот процессор, несомненно, проиграл в производительности гигагерцовому PentiumIII. Второй недостаток длинного конвейера вскрывается при ошибках в предсказании переходов. Как и любой современный процессор, Pentium 4 может выполнять инструкции не только последовательно, но и параллельно, соответственно не всегда в том порядке, как они следуют в программе и не всегда доподлинно зная направления условных переходов. Для того чтобы выбирать в таких случаях ветви программы для дальнейшего выполнения, процессор прогнозирует результаты выполнения условных переходов на основании накопленной статистики. Однако, иногда блок предсказания переходов все же ошибается, и в этом случае приходится полностью очищать конвейер, сводя на нет всю предварительно проделанную процессором работу по выполнению не той ветви в программе. Естественно, при более длинном конвейере, его очистка обходится дороже в том смысле, что на новое заполнение конвейера уходит больше процессорных тактов, а, следовательно, и времени.

Advanced Dynamic Execution.

Целью ряда ухищрений в архитектуре Pentium 4, под общим названием Advanced Dynamic Execution, как раз и является минимизация простоя процессора при неправильном предсказании переходов и увеличение вероятности правильных предсказаний. Для этого Intel улучшил блок выбор конструкций для внеочередного выполнения и повысил правильность предсказания переходов. Правда, для этого алгоритмы предсказания переходов были доработаны минимально, основным же средством для достижения цели было выбрано увеличение размеров буферов, с которыми работают соответствующие блоки процессора. Так, для выборки следующей инструкции для исполнения используется теперь окно величиной в 126 команд против 42 команд у процессора Pentium III. Буфер же, в котором сохраняются адреса выполненных переходов и на основании которого процессор предсказывает будущие переходы, теперь увеличен до 4 Кбайт, в то время как у Pentium III его размер составлял всего 512 байт. Результатом этого, а также благодаря небольшой доработке алгоритма, вероятность правильного предсказания переходов была улучшена по сравнению с Pentium III на 33%. Это - очень хороший показатель, поскольку теперь Pentium 4 предсказывает переходы правильно в 90-95% случаев.

Trace Cache.

Вместо обычного L1 кеша, который в Pentium III был разделен на область инструкций и область данных в Pentium 4 применен новый подход. Инструкции в L1 кэше не сохраняются, он предназначен теперь только для данных. Для кэширования инструкций теперь используется Trace Cache, однако по сравнению с обычным L1-кешем он имеет много преимуществ, направленных опять же на минимизацию простоев процессора при выполнении неправильных предсказаний переходов. Первое, и основное - в Trace Cache сохраняются уже декодированные инструкции. Это значит, что в нем хранятся не классические x86 инструкции, а так называемые микрокоманды, более простые операции, которыми непосредственно оперирует процессорное ядро. Сохранение в Trace Cache микроопераций позволяет избежать повторного декодирования x86 инструкций при повторном выполнении того же участка программы или при неправильном предсказании переходов.

Второе преимущество Trace Cache заключается в том, что микрооперации в нем сохраняются именно в том порядке, в каком они выполняются. Правда, правильный порядок определяется на основании предсказания переходов, однако вероятность того, что переходы предсказываются неправильно, достаточно мала для того, чтобы отказаться от очевидного выигрыша, получаемого путем отказа от повторных декодирований и предсказаний переходов.

Intel не раскрывает размеров своего Trace Cache в килобайтах, однако, известно, что в нем может быть сохранено до 12000 микроопераций.

Rapid Execute Engine.

Наиболее простая часть современного процессора - это ALU (арифметико-логическое устройство). Благодаря этому факту, Intel счел возможным увеличить его тактовую частоту внутри Pentium 4 вдвое по отношению к самому процессору. Таким образом, например, в 1.4 ГГц Pentium 4 ALU работает на частоте 2.8 ГГц.

В ALU исполняются простые целочисленные инструкции, поэтому, производительность нового процессора при операциях с целыми числами должна быть очень высокой. Однако, на производительности Pentium 4 при операциях с вещественными числами, MMX или SSE двукратное ускорение ALU никак не сказывается.