AMD第三代的APU- Kaveri帶來的啟示

丸子兄 wrote:
是誰說PS4是賠本在賣呢?問題是現在就沒有賠本賣啊...(恕刪)

還請舉出數字,那PS4淨利是多少?如何證實媒體「估算」的元件價格就是Sony真正付出的價格?


Whistle Blow wrote:
請舉出數字,那淨利是...(恕刪)

您不是可以從財報上看出來嗎?請開示一下嘍~我都說了這些都是經過拆解推估出來的硬體成本~你想知道直接上網看不就得了~
Whistle Blow wrote:
是呀!「推估」......(恕刪)

那些網站都有寫是推估耶~原來您之前看的時候都不知道喔
...上面的爭什麼我就不參一腳了.

財報的確是各國會計師簽證認過的.
裡面就算不會告訴你一台 PS4 成本多少淨利多少
但是只要去看子公司, 部門, 等等的營利數字
不用推估都知道是賺還是虧.
因為財報上面只會告訴你 "賺多少" 或 "虧多少"

財經的相關可以去研究研究

不然 AMD 也不會老是弄出許多 "新願景" 促使投資人對它們公司看好而不是看壞.
免得投資人跟金融機構對它們抽銀根

不這樣保持人家投資者的信心, 各位看看失去投資信心的公司們它們後來怎麼了

AMD 也是很辛苦的.



---

很前面很前面的串已經有人點過 HSA 要面對的記憶體技術問題
那位板兄名叫 cupidchen

經由他, 這幾天在資料整理, 與總公司連續開會地獄的微妙空閒下

我重新翻書找資料查找我心中的疑慮



我只很概略的說明一下我重新整理出來的一些概略.

技術方面.

DRAM (主記憶體, Main Memory) 跟 SRAM (快取, Cache) 的決定性差距造就下面的問題.





1. 電耗

眾所皆知DRAM 要一直通電刷新, 否則資料會消失.
因此它在待機狀態下其實相當耗電
但是 SRAM 不用一直刷新資料所以不用額外消費那些電力.

所以光看特性就知道誰比較適合對能效, 電耗(電池待命時間) 斤斤計較的移動裝置.





2. 佔據面積與設計問題

SRAM 雖然有那麼優的特點, 卻也有個問題.

DRAM的優勢在於結構簡單——
每一個位元的資料都只需一個電容跟一個電晶體來處理
相比之下在 SRAM 上一個位元通常需要六個電晶體.

正因這緣故, DRAM 擁有非常高的密度單位, 體積的容量較高因此成本較 SRAM 低.
所以 Main Memory 使用 DRAM 以符合成本.

也因為 SRAM 的構造實在複雜, 它的佔據晶片面積會比 DARM 要大
所以製程相對落後不少的 AMD.為了控制他可憐的 CPU 晶片面積
使用 SRAM 的 L2 / L3 cache 必須因此被 割愛, 省略, 無視
所以市售量產品 L2 / L3 通常沒辦法弄到超越或同等 Intel 的大小
是有這個非常單純原因的.

不要忘記當 Intel 還在 FSB 的年代,
AMD 已經開始推出具有 L3 的改良版 K8 家族

誰不曉得 L3 cache 的用處?
沒用處的話 AMD 弄那堆 L3 來做啥?

別忘了 Intel 初代 Core 2 Duo E6k/E8k 甚至 E4K / E5k / E2k 系列都只有 L2 便能讓 AMD 哇哇叫了
原因? Athlon x2 6400+, Windsor (90nm SOI)那些傢伙們的 L2 多半是 1MB x2

而到了後面 65nm 的 Brisbane 更慘. 512KB x2.

一直到同為 65nm 的 Kuma 核心, 才加入 L3 共用一個 2MB
(x2 7550 那些 7K 牌)

仔細看看 AMD 在高端一點的 x4 , Phenom.
初期推出時的 9K 系列 (4核) , x3 的 8k 系列
L3 是小小的 2MB

直到 08 Q4 (正確說是 09 Q1) 以後推出新版的 9百系, 才加到 6MB 總算是有了看頭.

對比同期
Intel 的 C2D / C2Q 始終只在 L2 上面兜
卻已經兜到能出 12MB 的巨獸 (即便 C2Q 飽受它非常明顯是 C2D x2 黏起來的批判.)
L3 這玩意兒更是等到 i系列面世才開始全面丟進個人 CP 上.
最早的還是看得到吃不到的 i7 920 系列, 那也是 09 Q3 (正確的說是 09 Q4) 的事
等到 i3 i5 這些普通人比較買的起的東西出來時
也早是 10 Q2 的事情了
(害我等到天荒地老才換 i5 3550 )

Intel 晚了一年才丟 L3 但是整個就讓 AMD 的 CPU 落居下風, 非要開始尋求其他幫手
(例如以前的 APU 大合體到現今的 HSA 架構)

製程與設計的優劣勢,
或換個話說我們也可以視做是因為 SRAM 的特性讓 AMD 無法揮霍它的成本來提高量產個人CPU的效能.
也許這是 AMD 在處理器效能上頭始終沒辦理甩開 Intel 甚至被反超的主因之一?






3. 重頭戲, GPU 要的跟 CPU 並不一樣, DRAM 與 SRAM 能給的東西也不一樣

為什麼圖形顯示運算最終從 CPU 裡面被分出去而演變成現今的 GPU ?

很簡單.
因為圖形運算上面, 需要超大量的資料進行計算然後再大量的傳回去.

當 CPU 還在 32bit 頻寬上掙扎時
住在獨立子卡上頭的 GPU
頻寬已經能弄到 256bit + 比主記憶體還要高時脈的專屬記憶體解渴.


CPU 要的是低延遲與最快速度反應
各位都知道現在如果還拿 Pentium III 那些老古董來跑 XP 系統跟底下的 Flash 遊戲
一定會頓到你哭出來
(我拿公司的 Pnetium 4 530 別說玩網遊, 開個有廣告的網頁都快哭了, 超頓)

這種情況就算你插一張高級顯示卡都無解

以前不是很流行什麼 CPU 有沒有餵飽顯示卡 的問題麼?

並不是餵不餵飽, 而是 CPU 有沒有快到已經不會去卡到顯示卡的運算.

那麼現在 AMD 弄的 HSA 其實也在告訴我們.

遊戲畫面, 軟體效能等等,
CPU 效能只要過了一個門檻之後, 接下來全看 GPU 的表現





好了, 回主題.

那這跟這一題的起頭有什麼關聯?

為什麼 GPU 不乾脆淦掉 CPU 裡面的 FPU 取而代之? 明明浮點運算超強?
為什麼 GPU 還是必須跟 CPU 的功能切開, 然後要有溝通管道?



身為發號施令的 CPU 他每個方面的計算能力可以不是最快的, 但是他下指令喊口號做動作的反應必須是整個系統裡面最快的

所以他需要 低搜索時間, 指令簡單, 等待時間最短的記憶體空間, SRAM 正是首選

SRAM 比起 DRAM 更為容易控制, 也更是隨機訪問.
SRAM 只要三個基本信號就能去裡面挖出資料, 頂多再加一個時鐘訊號.

DRAM 可不. 你看看那堆參數是怎麼回事?


讓我們複習一下... DRAM 是這麼運作的:

為了要讀出或寫入某筆資料,
記憶體控制晶片會先傳送列的位址,
接下來RAS訊號就會被啟動
但是, 在存取行的資料前, 還需要幾個執行週期才行
這就是所謂的RAS-to-CAS延遲時間.
同樣的, 在CAS訊號被執行後. 也同樣需要幾個週期.
這跟 DRAM 本身需要刷新以及讀取資料的方式有關
而SRAM 不需要這麼麻煩, 所以他的 CL 相當低

SRAM 是六個晶體當一個資料格用, 彼此獨立所以可以快速找到
但是 DRAM 是一個 BANK , 一個區塊 (也可以當作是 1T) 來運作資料讀寫

所以. 嗯, 講到這裡, 應該知道為什麼 DRAM 跟 SRAM 哪裡不同了?

除非 DRAM 能做到跟 SRAM 一樣的地步, 或者 CPU 不再是那個反應速度最快的處理元件
不然 DRAM 要做掉 SRAM , 有困難.




那麼 GPU 要的是什麼?

上面已經提到.

GPU 要的是一口氣能用上的海量資料吞吐容量.

既然 GPU 要的是頻寬資料吞吐量
一次出去進來的數據資料可以很大宗
所以外部記憶體比起延遲時間, 他可以更專注的只在一次可交換的資料量大小

而在 DRAM 上面本來的高延遲問題對 GPU 來說反而不重要, 因為:
GPU 需要發生同時讀取大量資料的情形,
在這種情形下,相鄰的記憶體資料會一次被讀取出來.
而 CAS 延遲時間只會發生一次


是的, 所以目前 GDDR5 最低也要 CL15 ~ 20 以上, GPU 也沒在怕 (當然能越低越好)
它只要有高頻率, 弄出多通道榨出高頻寬 (256 bit up)
效能就會水漲船高.

各位買顯卡注意 GPU 內部繪圖單元數量多寡外, 是不是也注意它的核心頻率

還有它的 頻寬


像是現在的 nVIDIA 頂級顯卡 GeForce GTX Titan 號稱一次能交換的頻寬是 288.4 GiB/s
對比它幾年前的作品 GeForce 6800 Ultra 的 33.6 GiB/s

嗯. 我相信大家都懂.



-----

所以異質運算大夢是可以的
但是用途應該可能偏向限定方向的應用
例如上面提到的影音辨識啦, 什麼有的沒的.

沒錯, HSA 會很強
但是只要 GPU 要的跟 CPU 不一樣
那麼他就會有資料傳輸上的瓶頸.
因為 SRAM 跟 DRAM 給的東西, CPU 跟 GPU 要的東西並不一樣.

AMD 在這邊的優勢是 CPU + GPU 整合方案看起來較 Intel 完整
圖形處理器的效能也明顯高過對方 (感傷的中央處理器就不討論了)


不過 AMD 往年以來的問題上面也是有人提到過

"驅動程式的支援"

不是單純的驅動沒事就好
看看 AMD 歷來的案底
其實 AMD 推的點子都很不錯
但是為什麼推到最後都進了人家的口袋 (像 Havok)

因為 AMD 在韌體 的支援與解決問題的能力方面
一直不 OK.

像是暴雪的WOW打上 ATi 的 Mark , 結果拿 ATi 的卡跑該遊戲會在裡面破圖的逸聞等等.







AMD 本身, 就連 ATi 也常常靠閒著沒事做的軟體程式團體免費做義工幫它們 DeBug

這種只淦地表最強硬體卻無法弄出正常一點的控制介面好好駕馭的情況

不正是他老兄推廣推半天推不起來的主因之一嗎?

AMD 只做硬體本體, 卻給不出技術支援

像推土機的最優化不是靠 AMD 開發修正檔去給 OS 商完成
卻反過來希望 M$ 等 OS廠 能針對推土機開發最優化應用.

結果呢?
它號稱的最佳運作狀態有沒有出來?

如果 HSA 還是淦這種事情, 原本美麗的大好前景, 堪慮





所以我只想以這些總結來表達我一開始就想表達的幾點.




A. 請不要過度把 GPU 的浮點效能無限上綱成 CPU 吃了大力金剛丸從此突破天際

再怎麼說那都是 GPU 的浮點運算, 不是 CPU 的


HSA 的功用指日可待我絕對樂觀,
但是 HSA 架構下 不可能徹底根除處理器本身設計好壞問題

因此 AMD 據有這個技術將會在某些應用上成功打到 Intel 頭抬不起來 (歐耶!)

可是不代表 AMD 的處理器會在整體效能上做掉 Intel

革命尚未成功, AMD 仍須努力



B. 透過 GPU 可進行記憶體直接定址會讓 CPU 效能大增? 不, 那是幻覺

的確 HSA 的功用我們非常歡迎也滿心期待
但這 不代表 AMD 從此不用面對 CPU 效能不佳的問題

況且這還牽涉到主記憶體人人都要用的問題
什麼時候 Main Memory 能推出 DDR5 甚至更快的?
那什麼時候 AMD 能弄出雙通道以上等級?
Intel 都玩起四通道了, 雖然只在高端機種
要比頻寬, 極限著玩似乎 Intel 還保有優勢?

前面已經提過 CPU 發號施令要夠快才不會卡到 GPU
要是哪天 AMD 弄得太高興把 GPU 做到比 CPU 下指令還快 的程度時.

哎.
會不會我選高通, 三星, 英特爾的處理器去外搭個 nVIDIA 的 GPU 會反過來勝過它?

不過, 這很難說,
到底是 AMD 能撐到底下的 ATi 能把 GPU 做到比他家的 CPU 還快
還是 Intel 會先被 AMD 扳倒 ...



C. AMD 快把你的硬體配套用軟體完善到最佳程度! 不要老是慢很多拍甚至從來沒搞好就要出下一代硬體了!

這種事情已經不是非戰不非戰之罪了

歷史教訓都擺明這會嚴重影響到產品推廣了 AMD 還不認真點
(AMD 表示 : 我沒錢請人才啊, 不然哪需要讓外面的義工幫我 DeBug!)



Intel 雖然沒加入 HSA , 但不代表他不會加入,
也不保證他不會起笑再來一次類似 RD RAM 的玩法再度獨斷效能市場
(當然也不保證不會跟 RD RAM 一樣最終輸到脫褲, 但那個問題核心其實是因為 RD RAM 成本太高, 外加光榮的 VIA 推出了個晶片把 DDR 雙通道!)


Intel 的動向, AMD 的開發腳步, 都是左右戰局的關鍵.

到底小蝦米農企能不能再次翻倒大鯨魚? 就讓我們繼續看下去.





---

忘了補充.

PS4 , Xbox 那些用 HSA 會效能超強.
別忘了這些機子本來就是 "遊戲影音方面專用"
它裡面也不會裝一大堆 BT 程式通訊程式轉檔程式防毒程式文書程式有的沒的程式
還有最該死的常駐程式分掉整個硬體資源


個人 PC 可不.





enm wrote:
...上面的爭什麼我...(恕刪)

你的論點完全錯誤了你用桌電的邏輯去看這一場戰爭根本就錯了~目前桌電市場每年都衰退5~10%的幅度眼看著已經面臨崩解~親密戰友MS已經自身難保也向ARM平台伸出橄欖枝~所以不管AMD或是英特爾早就不是把最大的資源放在PC了啦~在成長率最高的移動市場英特爾完全插不上手只能看著高通等ARM廠商吃香喝辣~最根本的原因是英特爾沒有高效能的GPU跟對手競爭~加上整合通訊基帶也不如對手~今天就算英特爾也為SONY和MS客製化一套遊戲機它的效能也不可能和AMD的方案抗衡~因為英特爾根本就沒有高效能的GPU技術~至於常駐軟體X1的常駐軟體可是多到會讓你嚇到呢~因為MS給X1的定位也不是單純的遊戲機~還有英特爾最後會不會加入HSA對於整個大局已經無關緊要了~HSA已經有ARM.高通.三星.MTK.SONY.德儀等巨頭加入~還有人會在意它的動向嗎?在成長率最高的移動市場它連個咖都算不上~它目前只是抱著桌電市場等著船沉罷了~連英特爾的董事長都自己說他們迷失了方向了~如果不是沒招了英特爾怎麼可能去考慮代工這個選項~不就是因為自己的工廠產能利用率已經降到了60%了~如果明年PC再衰退個10%那英特爾最引以為傲的晶圓廠反而是它最沉重的負擔~而它想跨入晶圓代工但是它自己的品牌CPU卻又變成它爭取客戶的最大阻礙.....
http://technews.tw/2013/11/23/intel-lost-foundry/
丸子兄 wrote:
你的論點完全錯誤了你用桌電的邏輯去看這一場戰爭根本就錯了~目前桌電市場每年都衰退5~10%的幅度眼看著已經面臨崩解~親密戰友MS已經自身難保也向ARM平台伸出橄欖枝~所以不管AMD或是英特爾早就不是把最大的資源放在PC了啦~在成長率最高的移動市場英特爾完全插不上手只能看著高通等ARM廠商吃香喝辣~最根本的原因是英特爾沒有高效能的GPU跟對手競爭~加上整合通訊基帶也不如對手~今天就算英特爾也為SONY和MS客製化一套遊戲機它的效能也不可能和AMD的方案抗衡~因為英特爾根本就沒有高效能的GPU技術~至於常駐軟體X1的常駐軟體可是多到會讓你嚇到呢~因為MS給X1的定位也不是單純的遊戲機~還有英特爾最後會不會加入HSA對於整個大局已經無關緊要了~HSA已經有ARM.高通.三星.MTK.SONY.德儀等巨頭加入~還有人會在意它的動向嗎?在成長率最高的移動市場它連個咖都算不上~它目前只是抱著桌電市場等著船沉罷了~連英特爾的董事長都自己說他們迷失了方向了~如果不是沒招了英特爾怎麼可能去考慮代工這個選項~不就是因為自己的工廠產能利用率已經降到了60%了~如果明年PC再衰退個10%那英特爾最引以為傲的晶圓廠反而是它最沉重的負擔~而它想跨入晶圓代工但是它自己的品牌CPU卻又變成它爭取客戶的最大阻礙.....
http://technews.tw/2013/11/23/intel-lost-foundry/


我不知道你為了什麼要一直引我的文講 Intel 的不是

我的文章裡面從來沒提到 Intel 很好很強大.
更何況 Intel 的 GPU 效能到目前為止 仍然是桌機上三大廠裡的末位

我也沒說到任何 Intel 在行動市場上面很好很強大.

請不要自行腦補 ok?



誰管 Intel 怎樣.
他到時產品出不來, 倒店也是他的事情

問題是, 就算再怎麼貶低 Intel 是個廢物,
也不會因此就讓 AMD 飛黃騰達.

3C 產品的效能一翻兩瞪眼, 有多少料說多少話.

那麼忙著貶 Intel 捧 AMD , HSA 方案就會一飛沖天?



---



事實上我在討論 HSA 必須要面對的各種問題
以及在這串文裡面過度被宣染的效能.

AMD 不要只有願景, 要有本事突破才是重點
而他突破的重點目前還有很多未解決的地方
(例如我提到的DDR世代問題)

GPU 的浮點可以比 CPU 的 FPU 強大五倍以上
但是 GPU 的浮點使用場合仍然有很多限制
所以 GPU 的浮點效能不等於 CPU 的浮點效能.
DRAM 與 SRAM 在這短期可見的未來也不可能彼此取代

還沒解決的東西就直接喊他很好很強大
整個就是莫名其妙.
那不就跟推土機號稱好強結果被龍二哥打到臉一樣了嗎.

造神要有限度.



---

HSA 要對上的問題仍然是效率/耗能.

而上面的文章我已經把問題檢討出來了.

重點是.

PS4 / Xbox 即使用了 HSA 方案
它的電耗量仍然有一定

能不能把這技術縮到 PS Vita 等級能用, 手機能用
還要低功耗, 並推出實際可量產產品
這才是需要被觀望的指標.


AMD 的 HSA 要擴展的領域不是只有遊戲機.
現在的情況是他手機市佔也還沒起來.

HSA 頂多只能在平板或較大的筆電上面起頭.
但是這個市場現今連 Intel 都沒戲唱(出貨銷量都在跌)
AMD 要分到肉仍然有困難.

而回到手機市場, AMD 還有高通, 三星等對手要拼
況且對方用的是基本架構上就能較低電耗的 ARM (RISC)
短期內 AMD 如果還是 x86, CISC 先天不良本來就會是問題.

還是那句話.

對於 AMD , 實際產品出來才討論才是正道.

在他真實產品出來前我的看法就是不要過度誇大其詞.

AMD 使用者被呼巄多少次了?

HSA 的手機方案出來我怕是 ATi 晶片搭三星與高通的產品搶先出哩.

雖然這樣完全不壞就是了





enm wrote:
眾所皆知DRAM 要一直通電刷新, 否則資料會消失.
因此它在待機狀態下其實相當耗電
但是 SRAM 不用一直刷新資料所以不用額外消費那些電力.


好長一篇文章,可惜一開頭就錯了。6 device SRAM 的一些電晶體是在on state 下工作,需要有電流通過,耗電才兇咧
lafish wrote:
好長一篇文章,可惜一開頭就錯了。6 device SRAM 的一些電晶體是在on state 下工作,需要有電流通過,耗電才兇咧


SRAM 要保持通電才能保持資料
這跟斷電後的 ROM 以及快閃記憶體不同.
但跟 DRAM 一樣.
嗯, 可是還沒有 DRAM 的持續刷新要兇.

SRAM在全運作情況下的電耗會跟DRAM相當.

但是標示在空閒狀態下的電耗比 DRAM 低, 這點沒問題
手機的待機時間長短也是重點, 難道這些特點都不用考慮?

低延遲的特性也不用考慮?
那處理器不需要 cache 直接 Main Memory 就好了

如果這些事情都不用考慮
連 x86 身為 CISC 造成的電路累贅都不用考慮
AMD 跟 Intel 就不用為了開發專用的行動裝置處理器焦頭爛額
甚至 AMD 想去跟 ARM 學怎麼做 ARM 了
事情就是因為沒有那麼簡單所以我才說不要過度宣染.

我可沒說 HSA 不好, 我也很期待用上的一天.


丸子兄 wrote:
怎麼不敢貼一下英特爾的產能利用率呢?
不知道60%的利用率算是高還是低呢?


我發現你還真的可以幫我,基本上我沒甚麼敢不敢的問題,只是單純的查證一下你的陳述罷了.結果呢

丸子兄 wrote:
在3年內我認為台積電極有可能開始蓋18吋晶圓廠~屆時英特爾是要跟還是不跟呢?
這句話你真正的意思是
丸子兄 wrote:
友達光電的10代廠也破土好幾年了結果現在裝機運轉了沒?如果桌上市場繼續衰退你確定英特爾能讓它裝機運轉
真慚愧,我誤解了你的意思是3年內台積電極有可能開始蓋18吋晶圓廠,而英特爾是要跟還是不跟都不知道...

然後呢
丸子兄 wrote:
台積電幾乎是被所有的合作夥伴逼著它一直提高產能喔
這句話你真正的意思是
丸子兄 wrote:
怎麼不敢貼一下英特爾的產能利用率呢?
不知道60%的利用率算是高還是低呢?
我沒慧根,讀不出您文章中的微言大義.不曉得板上諸君有誰了悟的了
唉~沒錯 ,每次說到軟體跟驅動這兩塊區域
是AMD/ATI的硬傷
大大的硬傷
文章分享
評分
評分
複製連結
請輸入您要前往的頁數(1 ~ 25)

今日熱門文章 網友點擊推薦!