Intel Sandy Bridge

AI权益加码!Claude Code、Cursor等20+工具免费用! 购周边限时加赠Coding Plan Lite,畅享主流AI工具!学习进阶更高效! 阅读详情

Intel Sandy Bridge

Configuration

Intel i5-2400 (Sandy Bridge), 3.1 GHz, 32 nm.

  • L1 Data cache = 32 KB. 64 B/line, 8-WAY. (Write-Allocate?), 2 * 16 Bytes read ports + 16 Bytes store port.
  • L1 Instruction cache = 32 KB. 8-WAY. 64 B/line
  • mOp Cache: 1.5k instructions, 8-WAY, 6 MOP / line
  • 4 decoders, 16 bytes per cycle
  • L2 cache = 256 KB. 64 B/line, 8-WAY
  • L3 cache = 6 MB. 64 B/line, 12-WAY
  • Load Buffers = 64
  • Store Buffers = 36
  • Line fill buffers (LFB) = 10
  • RS = 54 items
  • PRF Integer = 160 registers
  • PRF Float = 144 registers
  • ROB = 168 items
  • RSB (return stack buffer) = 16 items ?

4 KB pages mode (64-bit Windows)

  • Data TLB L1 size = 64 items. Miss penalty = 7. 4- WAY
  • Instruction TLB L1 size = 64 items per thread.
  • TLB L2 size = 512 items. . 4- WAY
  • PDE cache = 32 items?
Size Latency Description
32 K4 | 5TLB + L1
256 K12+7 (L2)
2 M36+17 (L3) +7 (L1 TLB miss)
6 M46+10 (L2 TLB miss)
64 M46 + 65 ns+ 65 ns (RAM)
...58 + 65 ns+ 12 (PDE cache miss)
  • L1 Latency = 4 cycles is for direct pointers mode. The [R1 + R2*4] Load has 5 cycles latency.
  • L3 Latency for cores 2 and 3 is 1-cycle smaller than L3 Latency for cores 1 and 4.

2 MB pages mode (64-bit Windows, 64-bit soft)

  • Data TLB L1 size = 32 items.
  • Data TLB L2 size = 512 items.
  • Instruction TLB L1 = ? items

1 GB mode

  • Data TLB L1 size = 4 items.
  • Data TLB L2 size = 512 items.
  • Instruction TLB L1 = ? items

MISC

Branch misprediction penalty = 14 cycles.

  • 64-bytes range cross penalty = 5 cycles
  • 4096-bytes range cross penalty = 24 cycles
  • L1 B/W (Parallel Random Read) = 0.51 cycles per one access
  • L2->L1 B/W (Parallel Random Read) = 2.5 cycles per cache line
  • L2->L1 B/W (Read, 64 bytes step) = 2.1 cycles per cache line
  • L2 Write (Write, 64 bytes step) = 6.70 cycles per write (cache line)
  • L3->L1 B/W (Parallel Random Read) = 4.85 cycles per cache line
  • L3->L1 B/W (Read, 64 bytes step) = 5.05 cycles per cache line
  • L3 Write (Write, 64 bytes step) = 9.00 cycles per write (cache line)
  • RAM Read B/W (Parallel Random Read) = 10 ns / cache line = 6400 MB/s
  • RAM Read B/W (Read, 8 Bytes step) = 13700 MB/s
  • RAM Read B/W (Read, 64 Bytes step) = 15200 MB/s
  • RAM Read B/W (Read, 64 Bytes step - pointer chasing) = 11700 MB/s
  • RAM Write B/W (Write, 4-64 Bytes step) = 9200 MB/s

http://www.7-cpu.com/cpu/SandyBridge.html
intel历代架构演进5—— Sandy Bridge 2.2.6 Intel® Microarchitecture Code Name Sandy Bridge Intel® microarchitecture code name Sandy Bridge builds on the successes of Intel® CoreTM microarchitecture and Intel microarchitecture code n 阅读详情

相关推荐

Intel 软件优化手册】E2 Sandy Bridge 微架构(包含宏融合与微融合的描述)

Sandy Bridge 微架构构建在 Intel Core 微架构和 Nehalem 微架构之后的基础上。它提供了以下革命性的特征:– 256位浮点指令集,对128位 Intel Streaming SIMD 扩展,相比于128位代码,提供了高达2倍的性能增益。– 非销毁性的目的操作数编码提供了更灵活的代码编写技术。比如: – 支持灵活的移植以及在 256位 AVX 代码、128位 AVX 代码 以及遗留的 128位 SSE 代码协同存在。– 新的被译码的 ICache 组件提升了前端带宽并从而减少了分

zenny_chen的专栏 1074

Intel Sandy Bridge Microarchitecture Events

This is a list of all Intel Sandy Bridge Microarchitecture performance counter event types. Please see Intel Architecture Developer's Manual Volume 3B, Appendix A and Intel Architecture Optimizat...

ashi702061的专栏 613

Intel芯片架构演进史:从Sandy Bridge到Alder Lake的十年技术变革

本文梳理了Intel芯片架构从Sandy Bridge到Alder Lake的十年演进历程。从奠定基础的环形总线与模块化设计,到应对多核扩展的Mesh互联网络与Chiplet初探,再到工艺困境下的微架构精进,最终迈向以“性能核+效率核”为代表的异构计算时代。这十年变革不仅是技术的迭代,更是应对物理极限与多样化计算需求的系统级设计智慧。

ttt77的博客 914

Intel Sandy Bridge/Ivy Bridge架构/微架构/流水线 (3) - 流水线概述

Intel Sandy Bridge微架构的指令流水线主要由下列3部分构成: 有序发射前端,负责取指(x86指令)并将其译码为微指令(也叫微操作)。前端给流水线中的后续阶段提供稳定的微指令流,这些微指令流来自于最可能执行到的程序路径。 乱序的超标量执行引擎,负责将微指令分发执行,每周期最多可分发6条微指令。Allocate/Rename单元将微指令重排列成“数据流”顺序;这样,一旦数据流需要的...

一凡stkeke 1005

Intel Sandy Bridge/Ivy Bridge架构/微架构/流水线 (4) - 流水线前端概述

The Front End 本节讲述流水线前端的关键特征。下表列出了前端的主要部件,以及对应的功能和所面临的性能挑战。 表:Intel Sandy Bridge微架构的前端部件 部件 功能 性能挑战 指令缓存 32K字节,存储指令字节流 对于“热代码”指令字节提供快速访问 ...

一凡stkeke 759

Intel Haswell是英特爾的中央處理器架構,由英特爾的奧勒岡團隊負責研發,用以取代Intel Ivy BridgeIntel Sandy Bridge微架構

是的,由英特爾的奧勒岡團隊負責研發,用以取代和微架構。和Ivy Bridge微架構一樣,Haswell採用22納米製程。根據英特爾的“”策略和產品路線圖,基於Intel Haswell微架構的處理器定於2013年6月發布。Intel曾於2011年的上展示出基於Haswell微架構的。2012年的上,英特爾公佈了更多關於Haswell架構的工程樣品處理器和技術說明。在2013年6月4日至6月8日的上,英特爾正式推出Haswell微架構以及其處理器產品。

880

Hyper-V and “Sandy Bridge” processors from Intel

http://blogs.technet.com/b/blauge/archive/2011/05/02/hyper-v-and-sandy-bridge-processors-from-intel.aspx Intel has recently released their new “Sandy Bridge” processors which is the second generation...

weixin_34072637的博客 148

Intel i5 Sandy Bridge 很是强劲啊!

<br /> 从刚刚新发布的苹果入门笔记本可以看出, intel i5真是很快。<br /><br /> 对比型号:<br /> 1)MC374LL/A DUO 2.4 / 250G 5400rpm hdd/nvidia<br /> 2) MC700LL/A I5 2.3 (duo) / 320 5400rpm hdd/ intel<br /> 咋一看配置除了CPU其他都差不多, 当然video card不一样,但应该对benchmark影响不是非常大, 其次都是5400的HDD. 如果SSD

svmtracking的专栏 530

Intel芯片架构演进史:从Sandy Bridge到Sapphire Rapids的十年技术变革

本文回顾了Intel芯片架构从Sandy Bridge到Sapphire Rapids的十年演进历程。从奠定基础的环形总线设计,到客户端与服务器架构的分化,再到以大小核混合架构和Chiplet芯粒技术为代表的异构集成时代,展现了Intel为应对不同计算需求,在模块化、互连技术和专用加速器方面的持续创新。

weixin_29233333的博客 143

Intel Sandy-Bridge H264 encoder GOP setting

Intel Sandy-bridge HW H264 encoder GOP(Group of Pictures)settings参考Intel Media SDK提供的sample code,可以设置H264 Encoder的相关参数: Intel(R) Media SDK Encoding SampleUsage: sample_encode.exe h264|mpeg

jtujtujtu的专栏 5445

Intel CPU 历代微架构名称

1 本文由来前段时间网上买了金士顿的系统指定内存(DDR3 1600 低电压版本1.35V), 8G x 2 = 16GB。顺利安装到了Mac Mini上,运行稳定快速。今天觉得这么大内存用在家用的Mac Mini上实在是浪费,于是把它们转移到了ThinkPad T410S笔记本上。于是各种问题来了,首先是使用超过600MB内存时,Linux系统自动重启;然后是好好的Windows7系统无法启动。于

smstong的成长轨迹 2万+

IntelSandy Bridge Xeon路线图:全新编号体系

德国网站ComputerBase.de今天曝光了一份Intel Xeon处理器的路线图,显示了Sandy Bridge架构在服务器领域的前景。 首先看一下Intel即将启用全新的Xeon处理器编号体系:Xeon Ea-bcdef vg。 Xeon E这种命名方式有些类似桌面上的Core i,之后紧跟的“a”也代表性能级别,同样有3、5、7三种,对应好、更好、最好。 连字符后跟着四个数...

weixin_30270889的博客 212

【Microarchitecture of Intel and AMD CPU】 9 Sandy Bridge and Ivy Bridge pipeline 【9.1~9.3】

Intel命名Sandy Bridge 的微架构是基于Core 2 和Nehalem的第二代设计。在解码器后面加入了新的uop cache,并且浮点执行单元从128bit扩展到256bit。 Sandy Bridge 有2-8 个core,其中的一些版本可以在每个core上运行双线程。 支持新的AVX 指令。将16个128bit的XMM寄存器扩展到256bit的YMM寄存器用于支持浮点向量运算...

Keep Fighting! 504

Intel Sandy Bridge/Ivy Bridge架构/微架构/流水线 (1) - 特性概述

Intel Sandy Bridge/Ivy Bridge Microarchitecture Intel Sandy Bridge微架构继承了Intel Core微架构与Nehalem微架构的成功之处,同时还提供了如下的创新特性: Intel 高级向量扩展(Intel AVX) 将128位的Intel SSE指令集扩展为256位的浮点指令集,相对于128位的代码,AVX具有两倍的性能优势 ...

一凡stkeke 3710

【Microarchitecture of Intel and AMD CPU】 9 Sandy Bridge and Ivy Bridge pipeline 【9.7】

9.7 Stack Engine Sandy Bridge 设计了独立的stack engine,工作方式与之前的处理器中的Stack Engine相同。 引入7.7 Stack Engine对stack的介绍 栈指令,比如push,pop,call 和ret都会修改栈指针。例如,指令push EAX将会在P3 处理器上产生3条uop,两条用于存储EAX,一条用于将ESP减4。在PM中,相同的指令只会产生一条uop。两条存储uops通过uop fusion的方式合并为一条,ESP-4则是通过一个专门用

Keep Fighting! 728

Intel Sandy Bridge/Ivy Bridge架构/微架构/流水线 (15) - L1数据缓存/读&写&地址转换

L1 DCache (L1D) L1D指的是一级数据缓存,通过缓存内部的数据结构(即硬件逻辑),管理所有类型的读存与访存请求: 允许投机式,乱序发射读存与写存请求 确保退役的读存与写存指令在退役时具有正确的数据 确保读存与写存操作遵循IA32与Intel 64指令集架构定义的访存顺序规则 表:L1D的构件 Component Sandy Bridge ...

一凡stkeke 1210

Sandy Bridge上安装Snow Leopard

把家里的主机从AMD平台转到Intel平台之后,就一直想在上面装一个Snow Leopard来使用,虽然曾经拥有过一台最早的Intel MacBook,不过已经有一段时间没有使用Mac OS了。坦白说,三大操作系统(Windows、Linux、Mac OS)里面,Mac OS同时拥有对程序员良好的*NIX内核,比美Windows的操作界面(甚至更好),可能是最好的开发平台。 Mac的笔记本不算...

weixin_30764771的博客 135
上一篇: version `GLIBC_2.14' not found 解决方法.
下一篇: Linux UIO 驱动模型
功名半纸
功名半纸 领域专家: 操作系统技术领域 领域专家: 操作系统技术领域
博客等级 码龄26年 1137粉丝 282原创
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值