探索情報
搜尋情報
一次搜尋 X、HN、GitHub、AI 產業日報與日期歷史。
「Codex」找到 220 筆不同情報第 5/11 頁
OpenAI @OpenAI
在 API 則宣稱最高 6 倍加速。貼文只有速度倍數與單一吞吐數字,未說明測試基準、模型設定與計費影響。
一龍馬判讀在意延遲的程式碼生成與即時應用可進一步驗證,但不能直接把倍數換算為整體任務省時。
比對原文節錄
Ultrafast offers up to 8x faster token generation (300 tokens per second) in Codex
Peter Steinberger @steipete
他的做法是讓 Codex 判斷哪些測試真正需要執行,並大幅刪減 CI,改為每小時跑測試。貼文沒有給出專案規模、失敗率或成本資料。
一龍馬判讀對維護大型測試流程的團隊有參考價值,但缺少成效驗證,貿然跟進可能漏掉關鍵測試。
比對原文節錄
let codex decide which tests actually need to run
Hacker News
Foreman 是以 Python asyncio打造的程式代理監督器,讓 TypeSafe 的 Jev 在 Codex、OpenCode 或 Hermes 工作時,獨立判斷任務完成度、測試充分性、偏離與卡住風險,再由確定性的 Python 規則決定繼續、介入、重試、驗證或交還人類。V1 一次只執行一個程式代理,且只有 Codex App Server 支援即時引導,其他後端只能停止或重試。README 明確把它定位為架構實驗,Jev 判斷準確度、分數門檻與本機執行安全性都尚未獲得實證。
一龍馬判讀它嘗試把「寫程式」與「監督代理是否做對」拆成兩個並行系統,可降低代理自我判定完成的盲點;但錯誤評估可能中止有效工作或放任問題,而 OpenCode 的自動核准權限與未隔離執行尤其需要審慎設定。
比對原文節錄
Foreman is an architectural experiment
Hacker News · parasitid
Drawgent 把使用者自己的 Claude Code、Codex 或 opencode,透過 ACP/MCP 接到即時 Excalidraw 畫布;代理程式可讀取場景與截圖、修改元素、檢查結果,並處理畫布上的「AGENT:」指示。README 說明了新工作階段、附加既有工作階段、多人房間、權限提示及測試指令,代理程式本身不隨工具打包,仍沿用使用者既有的安裝、登入與專案環境。限制包括渲染必須依賴 Chrome、Claude 附加實際上會分叉工作階段、Codex 即時附加尚未用已登入環境驗證,而且每個工作區只有一個場景,圖片與檔案也不會同步。
一龍馬判讀它把架構討論從單向生成 Mermaid,推進到人與代理程式共同編輯白板,適合遠端設計與反覆修圖。不過登入狀態、工具權限和仍未驗證的附加流程都是導入門檻,團隊也不能把可自動產圖等同於架構推理已完成。
比對原文節錄
Images/files are not synced.
OpenAI @OpenAI
OpenAI 宣布 GPT-6 Astra 已向 ChatGPT Work 與 Codex 的 Pro、Enterprise、Business Premium 使用者全面開放,API 也已上線。Plus 與 Business 使用者仍在分批部署,官方表示可能需要數天。貼文沒有說明模型能力、API 價格、速率限制或與既有模型的差異。
一龍馬判讀付費企業與開發者已可把 Astra 納入工作流程及產品測試,但其他方案使用者仍須等待,而且目前資訊不足以評估遷移成本與效能收益。
比對原文節錄
GPT-6 Astra is now available to all Pro, Enterprise, and Business Premium users in ChatGPT Work and Codex.
Sam Altman @sama
並已進入 API。Plus 與 Business 將列入下一波部署,但貼文沒有提供確切時間,也沒有補充效能、價格或安全資訊。
一龍馬判讀執行長的說法確認 OpenAI 採分級方案逐步釋出的順序,但相較官方公告沒有新增實質技術細節;尚未取得權限的使用者仍只能等待後續部署。
比對原文節錄
…-6 Astra is now available to all Pro, Enterprise, and Business Premium users in Work/Codex, and is available in the API.
Tibo @thsottiaux
貼文未附榜單、分數、成本計算口徑或測試設定,也沒有說明是否由獨立單位驗證,因此目前只能視為作者提出的基準測試主張。
一龍馬判讀若結果可重現,Astra 在終端機代理的效能與成本上可能同時占優,會影響程式開發代理的採購選擇;缺少完整資料時,名次與價格比較仍有誤導風險。
比對原文節錄
Awesome to see GPT-6 Astra is #1 on Terminal Bench 4.0 using the Codex harness.
Simon Willison @simonw
Simon Willison 發現 ChatGPT 桌面版 app,以前名為 Codex,內含一整份 LibreOffice 開源辦公套件,藏在 ~/.cache 目錄下的隱藏資料夾。貼文沒有說明 OpenAI 為何打包 LibreOffice,也沒有證據指出它何時被安裝、是否啟用或用於哪些功能。可合理確定的是,這個桌面 app 的本機封裝比一般使用者看到的介面更複雜。
一龍馬判讀若桌面 AI 工具內建完整辦公套件,可能與本機文件解析、轉換或編輯自動化有關,對資安、授權與磁碟佔用都會成為審查點。現階段不能推論有資料外洩或不當使用,只能要求供應商更清楚揭露元件用途。
比對原文節錄
…ed the ChatGPT desktop app (previously named Codex) bundles a full copy of the LibreOffice open source office suite, tuc…
Tibo @thsottiaux
貼文沒有公開分母、絕對請求數或計算口徑。
一龍馬判讀二十倍反映需求急升,也可能只是重設額度或小基期。判讀服務承載與採用仍需看活躍使用者、任務完成率與單位成本。
比對原文節錄
Codex weekly usage grew 20X in one week
Tibo @thsottiaux
貼文沒有交代適用方案、正式文件或功能清單,因此重設時間之外的資訊仍有限。
一龍馬判讀這對重度使用者的直接影響是可安排批次工作與測試時段,但不應把個人貼文當成所有帳號一致的額度承諾。實際重設週期與 /fast 可用性仍應以產品介面為準。
比對原文節錄
Your Codex and ChatGPT Work reset will land at 6pm PST.
Hacker News
文中把 Check Point 對近 2,000 個遭濫用 WordPress 站台的研究,與 OpenAI 對 Codex agent harness、SDK、CLI、app server 的發表放在一起,指出動態 CMS 的維護面與 AI 代理工作流程正在形成替代路徑。作者也明說這不是 WordPress 或 Substack 大規模出走的證據,而是以 AIM-blog、Codex publishing skill 與 HN 個案經驗說明模式已可運作。
一龍馬判讀對小型出版者與開發者來說,內容、版控、審稿、建置與部署可能被整合進同一個 Git 工作流,降低傳統後台的必要性。風險是這種模式較適合懂 repo 與部署規則的團隊,不能直接取代 CMS 的會員、訂閱、社群與分析功能。
比對原文節錄
It’s Making the Blog Platform Optional.
swyx @swyx
他也提到有人連到 Apple Developer Forums,表示這是已知 bug;但貼文沒有附上論壇連結或官方修復狀態。其結論是暫時避免使用,並補充雲端環境雖理想但尚未成熟。
一龍馬判讀對在本機跑 AI coding agent 的開發者,keychain 被鎖會直接影響憑證、登入與開發環境可用性;這是單一使用者經驗加上未附連結的已知 bug 說法,仍應視為風險警訊而非完整事故報告。
比對原文節錄
PSA: do not use codex "locked use" capabilities right now.
Tibo @thsottiaux
理由有兩點:用 5 小時限制平滑算力負載,以維持每週用量較寬鬆;以及 Plus 使用者多為較休閒或新使用者,容易不小心用完整週額度而困惑。貼文也說,接下來幾個月 Pro 100 美元與 Pro 200 美元訂閱不會啟用這個 5 小時限制。
一龍馬判讀這代表 OpenAI 相關服務的 Plus 使用者會更明顯感受到短時間使用上限,重度使用者可能被推向更高價方案。限制的官方理由是算力調度與使用體驗,但實際影響會落在日常開發與工作流中斷風險。
比對原文節錄
Tomorrow we will bring back the 5h limit for Plus accounts across ChatGPT Work and Codex.
Tibo @thsottiaux
這則貼文需要和前一則關於 Codex 使用量重置時間的回覆一起看,單獨閱讀無法知道要修正的是哪個事件。來源沒有更多討論串內容,只能確認它是在釐清時間。
一龍馬判讀對等待 Codex paid subscription 使用量重置的使用者,時間修正會影響操作安排;但仍需官方產品介面或後續公告確認實際執行。
比對原文節錄
R to @thsottiaux: Meant 2pm obviously
Tibo @thsottiaux
Tibo 回覆稱「Reset will land around 14pm PST tomorrow」,意思是重置大約會在隔天太平洋時間下午 2 點左右到來;後續貼文又修正為「2pm」。這應與他稍早提到 Codex 付費訂閱使用量將全面 reset 的公告相關。來源沒有提供 OpenAI 官方文件或產品頁面截圖,因此只能視為個人帳號上的時程說明。
一龍馬判讀Codex 付費使用者若因 rate limits 受影響,這提供了一個暫定恢復時間點;風險是推文用語為 around,代表時間並非精確承諾。
比對原文節錄
R to @thsottiaux: Reset will land around 14pm PST tomorrow.
Hacker News
OpenAI 在 X 發文宣布,GPT-5.6 Sol 的 API 與 credit pricing 未來 3 個月調降超過 20%,並稱該模型已可在 API 使用,也會陸續套用到符合資格的 ChatGPT Work 與 Codex credits。貼文同串補充,Pro、Plus、Business 訂閱用量不變;HN 留言中有人整理短上下文價格,稱 input 從每百萬 token 5 美元降到 4 美元,output 從 30 美元降到 20 美元,但這是社群留言,不是主貼逐字資訊。另一位 HN 留言者認為 3 個月促銷性質可能偏向競爭導向,這同樣是社群解讀而非 OpenAI 官方說法。
一龍馬判讀對用 API 或 Codex credits 的團隊,短期成本模型會改變,但訂閱使用者不一定受惠,且 3 個月期限代表不能直接當作長期單價重估產品毛利。若只是限時降價,開發者還要防止把架構綁死在促銷期成本上。
比對原文節錄
OpenAI on X: "As we continue to push the frontier of capabilities while improving efficiency, we're dropping API and cre…
Addy Osmani @addyosmani
貼文主打隔離環境、可用任意模型、完整稽核,以及能看到真實 diff 與保有控制權。這則來源是簡短推廣,沒有提供架構細節、部署需求、資安認證或與各工具整合的限制。
一龍馬判讀企業採用 coding agent 時,資料外流、稽核與執行環境隔離會成為採購門檻,這類「自有 infra 上跑代理」的訴求切中治理需求。但在缺少技術文件與合規證據前,不能把行銷說法等同於實際安全保證。
比對原文節錄
Your team's using Claude Code, Codex, Cursor?
kepano/obsidian-skills
遵循 Agent Skills specification,可供 Claude Code、Codex、OpenCode 等相容代理使用。技能涵蓋 Obsidian Flavored Markdown、Bases、JSON Canvas、Obsidian CLI,以及用 Defuddle 從網頁抽取乾淨 Markdown 以節省 token。README 提供 marketplace、npx skills、手動複製到 Claude Code/Codex/OpenCode 路徑等安裝方式,顯示它偏向可直接放進現有知識庫工作流的技能包,而不是完整代理平台。
一龍馬判讀Obsidian 使用者可把筆記格式、Canvas 與 vault 操作變成代理可重用的能力,降低代理亂改 Markdown 或不懂 Obsidian 語法的機率;限制是它依賴各代理對 Skills 規格與本機檔案權限的支援。
比對原文節錄
These skills follow the [Agent Skills specification](https://agentskills.io/specification) so they can be used by any sk…
Hacker News · etoxin
Docker Sandboxes 讓 Claude Code、Codex 等 coding agent 在可丟棄 microVM 內無人值守執行,只掛載專案工作區,並提供網路與檔案系統控制。Docker 工程師在 HN 澄清這不是一般 container,而是基於各平台原生 hypervisor 與自研 VMM;社群則要求看到 macOS 檔案系統效能資料。
一龍馬判讀Agent 取得高權限後,硬隔離會從加分項變成基本配備。真正的採用門檻是啟動成本、I/O 效能、憑證注入與政策集中管理能否同時成立。
比對原文節錄
Secure sandboxes for Claude Code, Gemini, Codex, and Kiro. Run coding agents with microVM based isolation. Secure sandbo…
addyosmani/agent-skills
設計重點是每步附驗證門檻與反偷懶對照表,並提供給 Claude Code、Cursor、Codex 等工具的安裝方式。是否真能提升品質,仍看團隊有無落實測試與審查,專案本身不等於保證。
一龍馬判讀對想規範 AI 產出程式碼的開發團隊,可直接套用現成檢查點,但導入時要評估 token 消耗與既有流程的磨合。
比對原文節錄
Production-grade engineering skills for AI coding agents.