http://pc.watch.impress.co.jp/docs/2008/0321/kaigai427.htm
■後藤弘茂のWeekly海外ニュース■
モバイルにもL3キャッシュをもたらすNehalem
所以每個core都是I-Cache 32KB、D-Cache 32KB、256KB L2,然後所有core共享一個L3 cache,被共享的也只有這層。
L1/L2規模固定,L3的size則與core數量成正比。Dual-Core是兩個core共享4MB L3、Quad-Core是4個core共享8MB,Oct-Core則是準備了24MB讓8個core使用。
主要是為了cache的擴大、延遲的增加,所以在中間加一層L2來吸收擴大的延遲,一方面也使得變成L3的大容量cache可以進一步擴充….
所以從這個觀點的話,對Intel來說”L2是新增的”。
但是AMD的觀點,就變成L3才是新增的….但是即使觀點不同,最後階層卻非常相似(L1/L2獨佔、L3共享)的理由,或許單單就是因為「這樣比較好」吧?
http://pc.watch.impress.co.jp/…326/kaigai428.htm
Thread都爆增,若分支預測失敗,效能不會驟降嗎??
GPU+CPU都出現了,AMD手上的王牌大概只剩Hybrid的Crossfire了…(笑)
Thread 不管多或寡碰到 branch 的問題都是一樣的,pipeline 深度或是 OOO 的設計跟這比較有關