Re: [新聞] GPT-6 Astra來了!AI推理得分99.9%、還能自己操作電腦做事

看板Stock作者 (あさひ)時間3天前 (2026/09/05 10:07), 編輯推噓16(16021)
留言37則, 17人參與, 2天前最新討論串2/2 (看更多)
現在看Anthropic 評分最高,今天凌晨上線後測試了一下,五小時的額度我半小時內用掉。模型是GPT-6 Astra 高。 內容是整理報表,我已經弄好了,只是做接續優化問看看有沒有什麼問題,後面另外生一份摘要 製作了兩個表單就用完了 選模型時裡面多了一個預設,一開始是預設Astra 快思。對話的話還是只能用Sol 高而已 要省還是用5.6 Sol 期待明年IPO上市 ※ 引述《arsl400 (dark hatter)》之銘言: : 文章標題 請使用 原新聞標題 勿刪減或自創標題,違者4-1處分 : GPT-6 Astra來了!AI推理得分99.9%、還能自己操作電腦做事 : 原文連結: 網址超過一行,請用縮網址,連結不能點擊者板規 1-2-2 處分。 : https://ai.ettoday.net/news/3231279 : 發布時間: 請勿張貼超過3天新聞 : 2026年09月04日 06:46 : 記者署名: : 吳立言 : 原文內容: : OpenAI 宣布推出新一代 AI 模型 GPT-6 Astra,這次升級的重點不只是「回答問題更準 : 」,而是讓 AI 能直接操作電腦、使用軟體並完成一連串工作。 : AI 開始直接替你做事 : GPT-6 Astra 可以處理填寫網路表單、更新客戶資料、整理行事曆、搜尋網路資料等工作 : ,也能製作文件、簡報與試算表。 例如使用者只要交代任務,Astra 就能自行操作相關 : A也能製作文件、簡報與試算表。 例如使用者只要交代任務,Astra 就能自行操作相 : 關 : 工具完成多個步驟,不用再每完成一步就等待使用者下指令。 : 電腦操作速度更快 : 在 OSWorld 2.0 測試中,GPT-6 Astra 得分 72.6%,高於 GPT-5.6 Sol 的 65.7%。 : OpenAI 表示,Astra 完成這類電腦操作任務所需時間約 40 分鐘,GPT-5.6 Sol 則約 : 75 分鐘。 搭配更新後的 Codex 執行環境,在 Mind2Web 測試中,整體任務完成速度約 : 提升至目前 GPT-5.6 Sol 體驗的 1.9 倍。 : 寫程式與研究能力同步提升 : Astra 也針對程式開發、數學與科學工作進行強化。它能協助除錯、修改大型程式,也能 : 使用專業軟體分析科學資料。 在 FrontierMath Tier 4 測試中,Astra 得分 97.6%, : GPT-5.6 Sol 為 83.0%;ARC-AGI-3 則達到 99.9%。 : 資安能力更強也更危險 : 心得/評論: : 歪梯下方留言酸到爆:可以幫我把Claude做掉嗎?你的額度已經用光,請加價 : 看起來又是劃時代一個新科技,買進囉 ----- Sent from JPTT on my iPhone -- https://i.imgur.com/Kc4llBM.jpeg
-- ※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 203.222.16.55 (臺灣) ※ 文章網址: https://www.ptt.cc/bbs/Stock/M.1788574035.A.4FF.html

09/05 10:11, 3天前 , 1F
廢寶5.1評測只有一個AAII贏astra其它全輸齁
09/05 10:11, 1F

09/05 10:13, 3天前 , 2F
然後AAII這個評測明顯有問題 Meta muse 1.3評分跟
09/05 10:13, 2F

09/05 10:13, 3天前 , 3F
廢寶5.0一樣?這你敢信?跟實際體驗差太多了
09/05 10:13, 3F

09/05 10:29, 3天前 , 4F
五小時限制真的有夠煩
09/05 10:29, 4F

09/05 10:39, 3天前 , 5F
5小時限制就是逼20美去升100美用的
09/05 10:39, 5F

09/05 10:40, 3天前 , 6F
100美就沒這限制 隨便你燒 預設是Astra medium
09/05 10:40, 6F

09/05 10:43, 3天前 , 7F

09/05 10:43, 3天前 , 8F
這個成本支出線看了就毛毛的 還會倒退嚕
09/05 10:43, 8F

09/05 10:44, 3天前 , 9F
如果都這樣真的有大事要發生惹
09/05 10:44, 9F

09/05 10:45, 3天前 , 10F
開源模型跟企業的長尾效應得要帶得出來
09/05 10:45, 10F

09/05 11:04, 3天前 , 11F
Astra第一 但人類最終測試HLE Fable系列都在前面
09/05 11:04, 11F

09/05 11:05, 3天前 , 12F
agi!!
09/05 11:05, 12F

09/05 11:06, 3天前 , 13F
奇異點來了 AI要脫離人類了
09/05 11:06, 13F

09/05 11:06, 3天前 , 14F
黃仁勳才說 2年後AGI
09/05 11:06, 14F

09/05 11:07, 3天前 , 15F
這個疊代速度 人類面臨抉擇 要不要繼續放手AI
09/05 11:07, 15F

09/05 11:11, 3天前 , 16F
早就過奇點了
09/05 11:11, 16F

09/05 11:14, 3天前 , 17F
你竟然叫astra整理報表
09/05 11:14, 17F

09/05 11:33, 3天前 , 18F
試試cursor pro,額度是月計,沒有5h,1w限制
09/05 11:33, 18F

09/05 11:38, 3天前 , 19F
看成GTA6得99分
09/05 11:38, 19F

09/05 11:44, 3天前 , 20F
我也看成GTA6
09/05 11:44, 20F

09/05 11:46, 3天前 , 21F
歐噴醬已經跟cursor協議11月分手了,應該是快點搬
09/05 11:46, 21F

09/05 11:46, 3天前 , 22F
家不是去用他
09/05 11:46, 22F

09/05 12:08, 3天前 , 23F
超燒TOKEN的只是"類"AGI 真AGI功耗應該和人腦差不多
09/05 12:08, 23F

09/05 12:16, 3天前 , 24F
現在是人類強迫 疊代的時候留下CoT
09/05 12:16, 24F

09/05 12:16, 3天前 , 25F
不然早就脫離人類 理解範圍
09/05 12:16, 25F

09/05 12:17, 3天前 , 26F
為了能修正AI 所以強迫CoT 不然可以省很多token
09/05 12:17, 26F

09/05 12:23, 3天前 , 27F
人類自己幻覺 願景一大堆 這樣算AGI?
09/05 12:23, 27F

09/05 12:26, 3天前 , 28F
吸引力法則顯化那一套 也許對AI同樣可高提升效率
09/05 12:26, 28F

09/05 13:14, 3天前 , 29F
很期待openai的新模型 好像真的很有料,我在想是不
09/05 13:14, 29F

09/05 13:14, 3天前 , 30F
是開始使用星際之門的伺服器跑模型了,星際之門的gp
09/05 13:14, 30F

09/05 13:14, 3天前 , 31F
u全是最新的rubin
09/05 13:14, 31F

09/05 13:29, 3天前 , 32F
我現在都DPH和Codex交互用 反正都走openai訂閱方便
09/05 13:29, 32F

09/05 15:08, 3天前 , 33F
它們有說是用星際之門去重新訓練
09/05 15:08, 33F

09/05 15:09, 3天前 , 34F
"並使用超過10萬塊GPU在德州Stargate基地完成訓練"
09/05 15:09, 34F

09/05 18:02, 3天前 , 35F
看成GTA-6
09/05 18:02, 35F

09/05 18:37, 3天前 , 36F
用沒幾次就限流,爛死了
09/05 18:37, 36F

09/07 08:29, 2天前 , 37F
殺雞牛刀
09/07 08:29, 37F
文章代碼(AID): #1gctbJJ_ (Stock)
文章代碼(AID): #1gctbJJ_ (Stock)