PCinLife的Larrabee相關討論

http://we.pcinlife.com/thread-828668-1-1.html

裡面RacingPHT兄提到一點很有趣:Larrabee看起來像是把Xenon(PPE + VMX128)堆起來的樣子。

x86 vs PPC
512bit SIMD vs VMX128
2 threads vs 4 threads
双方的单线程通用指令性能都很烂(~1/3于该指令集的最高水准)
两边的基础指令集都不怎么样

所以根据这个惯性推论的是, 同样的Peak的前提下, Larrabee的实际性能不如SPE
(by RacingPHT)

實話是PPE在CELL相關slide裡面被拿來當挨打對象的次數幾乎僅次於P4/Netburst….性能上是的確有點落差。
而且論die size的話,PPE的空間足足可以塞兩顆SPE,PPE+512KB L2的空間幾乎就是4顆SPE。(其實扣掉XDR和FlexIO之後Xenos和CELL的die size就沒差多少了)
所以如果來個裝到32core的PPE,考慮需要配置的Cache,同樣的空間只怕裝到64個SPE都還有剩。

不過至少PPE和PPX到目前為止使用率已經很高了,但是SPE的使用率還是低得讓人掬一把同情的淚水…._A_

發佈留言

發佈留言必須填寫的電子郵件地址不會公開。 必填欄位標示為 *

這個網站採用 Akismet 服務減少垃圾留言。進一步了解 Akismet 如何處理網站訪客的留言資料