作者查詢 / DrStein
作者 DrStein 在 PTT [ C_and_CPP ] 看板的留言(推文), 共204則
限定看板:C_and_CPP
看板排序:
15F→:直接用原生編譯器不好嗎? windows: VC,linux : gcc04/04 15:40
11F→:http://www.verycd.com/topics/201911/04/04 00:58
12F→:上面這三本書很棒,值得精讀 對編程語言有更深層的理解04/04 00:59
3F推:我以前發過使用心德文03/21 19:01
4F→:請查 "ICC的OpenMP" 這文03/21 19:01
5F→:數組-> Array, matrix-> 矩陣(專指二維)03/20 03:20
2F→:xcode也是gcc03/16 14:12
6F→:謝謝stupid0319,那網站是有些用03/09 02:22
2F→:買一張勘用中最低檔次的9500gt不就好了?03/05 03:12
3F→:不要買更爛的9400gt或 gt210 那個練習都不夠03/05 03:13
3F→:樓讓你誤會了,我不是要自己去寫codec02/26 10:41
4F→:我意思是去調用驅動的硬解api來幫我解02/26 10:41
7F→:謝樓上 我之前有查到這,但我是想說這些硬解api02/26 10:50
8F→:該是與GPGPU無關的東西吧,在還沒有CUDA前的顯卡就能硬解02/26 10:50
9F→:了,該是有個硬解專用的api可以調用 而不用透過cuda吧02/26 10:51
3F→:我意思是整個project的call graph。。。請問有這功能嗎?02/14 21:31
8F→:最終使用環境不是x86平台 不能用SSE02/14 01:54
9F→:分析過hot spot,就是在這些if上。02/14 01:56
12F→:arm的cpu + 機器人操作系統。。。02/14 01:59
14F→:增加緩存命中率這方法試過,不過不同手機緩存大小不同02/14 02:00
15F→:很難有統一的優化法02/14 02:00
20F→:U & 0xFF00 不行吧,最後一個bit是正負號,該是0x7f00吧02/14 02:14
22F→:以前試過在x86上,if用mask(and)來做會比用cmp來快約5趴02/14 02:20
23F→:但分析過主要開銷還是在branch上(緩存不命中)02/14 02:21
24F→:所以想有沒辦法根本不用if02/14 02:21
28F→:是YUV to RGB。。轉換時可能會暴表 所以要用if02/14 02:26
31F→:ARM確定是沒有 x86也沒有 :)02/14 02:28
35F→:http://sites.google.com/site/rgbbones2/yuv2rgb02/14 02:30
39F→:想過,因為暴出來就從256~251之間 所以理論上只要檢查第02/14 02:41
40F→:9個bit是否為0或1即可02/14 02:41
41F→:"若"是0就對第一到第八個bit做 bit and 0xff02/14 02:42
42F→:反之設為 0xff02/14 02:43
43F→:但這樣等於沒優化 因為用了個 if02/14 02:43
50F→:了解了 用or_map[2] = {0x00, 0xff};02/14 02:54
51F→:在將節果與這個表bit or即可02/14 02:55
52F→:剛一直想到包絡線問題(另個類似的問題),兩個搞混,。。02/14 02:55
53F→:謝謝VictorTom :)02/14 02:56
58F→:非x86,只有少數的平板電腦能用CUDA02/14 13:37