http://vr-zone.com/articles/-rumour-geforce-gtx-400-series-details-performance-pricing-etc.-/8487.html
[Rumour] Geforce GTX 400 Series details (Performance, pricing, etc.)
—-
http://developer.download.nvidia.com/compute/cuda/3_0/docs/NVIDIA_FermiCompatibilityGuide.pdf
Fermi Compatability Guide
http://developer.download.nvidia.com/compute/cuda/3_0/docs/NVIDIA_FermiTuningGuide.pdf
Fermi Tuning Guide
http://developer.download.nvidia.com/compute/cuda/3_0/toolkit/docs/NVIDIA_CUDA_ProgrammingGuide_3.0.pdf
CUDA Programming Guide for CUDA Toolkit 3.0
http://developer.download.nvidia.com/compute/cuda/docs/CUDA_Developer_Guide_for_Optimus_Platforms.pdf
CUDA Developer Guide for Optimus Platforms
On devices of compute capability 1.x, some kernels can achieve a speedup when using (cached) texture fetches rather than regular global memory loads (e.g., when the regular loads do not coalesce well).
Unless texture fetches provide other benefits such as address calculations or texture filtering (Section 5.3.2.5), this optimization can be counter-productive on devices of compute capability 2.0, however, since global memory loads are cached in L1 and the L1 cache has higher bandwidth than the texture cache.
The shared memory hardware is improved on devices of compute capability 2.0 to support multiple broadcast words and to generate fewer bank conflicts for accesses of 8-bits, 16-bits, 64-bits, or 128-bits per thread (Section G.4.3).
——-
目前來說,GF100初期的產品性能應該是會很悽慘,只是悽慘歸悽慘,之後的產品還是以這個東西為基礎….
現在問題是當初NV30在中低階一路崩盤到NV4x才挽回,Fermi的中低階會如何?
所以讓人很想思考Fermi「架構」上會有多少劣勢。
當初NV30的主要性能以FX12提供、FP32單元數量很少,面對犧牲精確度用FP24的R300有很大的性能劣勢,需要廠商主動針對FX12/FP16去做optimize….
而Fermi的架構上維持G80時代shader數量上的設計觀念,基本上還是累積與加強,雖說某種意味上帳面上還是128sp的G92、256sp的GT200b,細部的tune up則相當多,ROP性能也有提昇。
反過來說ATI的SIMD unit數量還是堆在那邊….XD
well,聽說GF104(256sp)還是比65nm G92的die size大就是了。那幾乎就和RV870一樣大了…._A_)a
ROP、TMU有很大改進的話
至少不會像8800GS對4670那樣被更小的顯存位寬打敗
光柵化畢竟就是吃靠顯存的,384bit總能發光發熱,當然被5800搶了先對于開發優化來說不怎么好,不過NV的廠商公關還是比較出名的。
GF100的頻寬,固定管線都約比RV870多1.5倍.
我想性能是不會輸,只是可能贏太少,而成本太高.
相對性價比不太好看.
以Wafer一片4~5000USD算,用謠傳NV良率20%來算
大概20顆良品.每顆成本200~250USD….
這做顯卡的成本可能比5970還貴不少.
畢竟ATI良率聽說有60%.
ATI比較小的Die,在40nm良率拉高的過程中,會比較早
得到好處. 也就是當Fermi良率高到終於可以量產時,
RV870生產成本已經先大幅降低.
GF100的競爭劣勢可能只在低良率大型晶片這個市場.
中低階由於繪圖面有所強化,良率應也不會輸人,
應該不會重演NV30中低階崩盤的情形.
畢竟NV30是繪圖架構本身有缺點,不符合當時市場趨勢.
…..不過也要GF100中低階能及時出來才行.
中低階DX11在NV眼裡似乎不太重要.
去年中應該就知道GF100短期不可能量產了,
也沒打算先出Fermi中階版.
搞不好打算用DX10.1中低階版撐場到下半年.
to afxif:
TMU和ROP回到同等實力的話,NVIDIA大概就是同級產品多裝一點去和人家磨吧….
至於optimize的部份,其實我覺得最近這幾代shader結構沒什麼大變化,optimize可能還是集中在過去的一些小point上,那麼就又會回到過去佔有率決定的狀況。
比方說最近A列車9好像就有這種NVIDIA怎麼跑都跑不快ATI卻很順手的感覺。
to WaffenSS:
抓經濟生產的臨界點很重要這點一直沒有改變….
而完全不管這些部份衝HPC,NVIDIA是不是覺得PC遊戲市場會整個垮掉啊。
姑且先不論ARM,NVIDIA的未來還是在GPGPU,但太過重視HPC市場,缺乏被大眾使用的普及化GPGPU應用程式,反而沒辦法讓大多數的消費者感受到「啊,原來GPGPU可以帶給我這麼多的好處」。
當然,NVIDIA也不是笨蛋,Optimus的出現,除了是被Intel逼出來以外,背後其實暗藏企圖降低Intel產品線ASP的意圖(如搭配便宜的dGPU,連Atom D510都可以玩大多數的遊戲等),但要怎麼讓dGPU更像是一顆不可或缺的「Co-Processor」,如今日的80×87,NVIDIA和一般應用軟體廠商的合作,還得更努力點,而不是等微軟出手,那時也來不及了。
所以我常常跟人開玩笑,NVIDIA的作風和思維,真的很有那種「待在學校」的感覺,研發技術團隊像教授,業務行銷團隊像學生。
to 水球:
D510是不行的吧,配套芯片NM10只有4條PCI-E X1,實際ION2只是用到了1條.
而Optimus又是從獨顯傳輸無壓縮圖像到集顯輸出的技術,掛在PCI-E X1上真的能提供足夠的游戲性能么?
>>Optimus又是從獨顯傳輸無壓縮圖像到集顯輸出的技術
原來如此.難怪可以即時無縫切換…
所以ION2應該沒有Optimus? 畢竟只是ION1昇級版.
不透過PCIEx1傳輸畫面的話,低階卡用這頻寬傳3D資料還ok.
之前Asus有出NB外接顯示套件也是跑1x,
似乎跑到GF8600以上才有瓶頸. 低階32SP以內1x應該還堪用.
Optimus只是為了NB省電,外接顯示只是偶而高負載時啟動.
平常大多讓內顯來跑,省略切換的不便.
Optimus的效率,就我自己看過demo的感想,其實效率已經算很不錯了,NVIDIA應該在driver下了不少的功夫。
不過前面講「D510」算是不正確的說法,NVIDIA應該不會讓desktop平台支援Optimus。當然,在Pine Trail-D,扣掉該有的PCIe device,discrete GPU也只有x1可以用。
不管是Intel的加強型內顯, 還是NV的NB獨顯技術.
都只是延續現有的產品線.
真正讓人心動的大概是明年的AMD FUSION的Liano.
4核K10 + DX11 240SP….
Intel: 多核CPU整合內顯才是電腦的唯一主角
NVidia: 泛用GPGPU + 小嫩嫩CPU最有運算效率’
AMD/ATI: 吵什麼,CPU/GPU攙在一起做不就好了…..
>>NVIDIA是不是覺得PC遊戲市場會整個垮掉啊。
應該不是怕遊戲市場垮掉,而是怕獨顯市場逐漸萎縮.
畢竟Intel/AMD未來都想玩強力內顯.
所以NV先分散投資到其他地方.ARM和HPC都是其方向.
如果NB是用Liano 240SP大概也不需要再配獨顯.
Larrabee雖然失敗,但是Intel也不會放棄.
NV要擔心以後NB市場都是這種情形.
> 所以ION2應該沒有Optimus? 畢竟只是ION1昇級版.
應該有Optimus啦,說起來ION只是個sku、marketing name,實際上並不是一個新的chipset產品線,基本上ION1除了關sp之外就是個9400M而已、ION2其實只是用PCIe 1x連接的GT218。
昨天水球這么說
>>NVIDIA應該不會讓desktop平台支援Optimus。
今天就有了Barebone XS35
嗯… 啊… 我該怎麼講,你真的確定「Ion 2」一定都會有Optimus嗎…?XD
>>聽說GF104(256sp)還是比65nm G92的die size大
GF104若只是半個GF100,但面積卻等同RV870就太大了.
畢竟這兩個不完全算是同級產品.
照規模來看GF104不該高於300mm2.
問題還是時機,GF104最快也要第二季,比GF100更晚.
而其對手Juniper/Cypress都早在去年下半就上場了.
(ATI當時是兩種產品800SP/1600SP一起投產)
相對於超高階的5970, GF100只落後一季上市.
但是其他低中高階SKU, NV可能都會落後2季以上.
現在NV也該把1GPC/2GPC中低階也和GF100同時量產才對.
中低階的良率風險應該比較低.
Desktop平台用Optimus不知道有什麼好處.
比較環保? 如果不在乎省電救地球的話,
Desktop全程用獨顯就好了.
雙256的話比GF100的512/384的一半還是要大的。
再加上本來規模砍半,面積也只是小40%而已。GF104砍了還不到一半,330mm完全可能。