OpenAI、Anthropic 與 Meta 接連確認 AI Agent 在資安測試中接觸真實網路,並入侵 Hugging Face 與其他公司的正式環境。本文拆解 GPT-5.6 Sol、Claude Opus 4.7、Mythos 5 與 Meta 模型的事故路徑,釐清哪些案例利用漏洞突破既有隔離、哪些源自測試環境設定錯誤,以及模型自主執行是否等於產生自己的駭客意圖,同時比較一般產品與資安評測的條件差異。
AI Agent 逃出沙盒?ChatGPT、Claude、Meta 模型自主攻擊駭客事故
OpenAI API 安全指南|違規內容算誰的、免費審核模型怎麼用
自己接 OpenAI API 做產品,使用者輸入什麼內容都算在開發者的帳號上。OpenAI 提供免費的 omni-moderation-latest 模型判斷文字與圖片是否違反安全規範,這篇說明內容審核為什麼是開發者的義務而不只是選配、模型的兩種呼叫方式(獨立呼叫 moderations 端點與跟生成請求一起送出)、flagged 與 category_scores 該怎麼判讀、safety_identifier 如何讓封鎖落在個別使用者而不是整個組織,以及資料保留與速率限制的實務注意事項。
GPT-5.6 Luna 降價 80%|與 nano 同價,mini 失去價格優勢
OpenAI 在 2026 年 7 月 30 日調降 GPT-5.6 的 API 價格,Luna 降 80%、Terra 降 20%,Sol 維持原價。降完之後 Luna 的 input 單價與 GPT-5.4 nano 相同,output 還更低一點,能力卻是完全不同的等級。這篇整理降價幅度與生效範圍、OpenAI 給的降價理由與能不能當成長期價格、mini 與 nano 剩下的使用情境,以及 Codex 與 API 兩種使用方式各自該怎麼調整模型選擇。
GPT-5.6 發表|Sol、Terra、Luna 三階齊發,中階價格砍半
OpenAI 在 2026 年 7 月 9 日推出 GPT-5.6,一次發表 Sol、Terra、Luna 三個階層,取代過去的 mini 與 nano 命名,中階的 Terra 用 GPT-5.5 一半的價格提供相當的表現。這篇整理三個階層的價格與規格差異、太陽地球月亮命名背後的邏輯、GPT-5.5 世代為什麼只有單一模型,以及從 Codex、ChatGPT、API 三種使用情境各自要注意的地方。
Codex 額度重置新制|可儲存的 rate limit reset 與官方額外重置時機
用 Codex 寫程式常遇到額度用到一半被卡住。OpenAI 推出可儲存的 rate limit reset:官方重置額度時不再強制立刻生效,使用者可以把這次重置存起來,30 天內挑自己需要的時機手動觸發,不必擔心才剛重置又被重置、白白浪費優惠。本文整理新制怎麼運作、哪些 ChatGPT 方案適用、30 天效期怎麼算,以及除了固定的定期重置,官方還會在慶祝、產品上線、推薦好友等什麼時機額外重置,順帶釐清重置與付費 credits 的差別。
Codex 與 Claude Code 快取機制比較|prompt cache 計價、TTL 與觸發方式差異
用過 Claude Code 也用過 OpenAI Codex 的開發者常會好奇,兩邊的 prompt cache 是不是同一套。快取骨架幾乎一樣——都走前綴比對、動到前綴就整段失效、閒置就清掉。真正影響荷包與操作習慣的是三個差異:觸發要不要手動、計價結構怎麼算(尤其寫入要不要付溢價)、TTL 能撐多久。本文延續先前的 Claude Code 快取指南,把重複原理快速帶過,聚焦 Codex 與 Claude Code 在計價結構、自動化程度與可控旋鈕上的不同。
GPT Image 2 介紹|OpenAI 第一個會思考的生圖模型,文字渲染與多語支援大進化
OpenAI 在 2026-04-22 正式發表 GPT Image 2(ChatGPT Images 2.0),是 DALL-E 3 與 GPT Image 1.5 的繼任者。最大特點是把 o 系列的「思考」帶進生圖流程,先計畫再下筆,加上原生 2K 解析度、網路搜尋整合、與多語言文字渲染(中日韓、Hindi、Bengali 等都能寫對)。本文整理發表脈絡、跟前代差在哪、API 模型名稱與價格、ChatGPT 端可用方案,並附上幾組可以直接複製使用的提示詞範例。
OpenAI GPT-5.5 發表|Benchmark 提升、三種入口與 API 價格解析
OpenAI 在 2026-04-23 發表 GPT-5.5,距前代 GPT-5.4 只有七週,代號 Spud。這代主打 agentic coding、computer use 與長上下文理解,Terminal-Bench 2.0 達 82.7%、MRCR v2 長上下文從 36.6% 跳到 74.0%。本文整理發表脈絡、NVIDIA 硬體合作、各項 benchmark 提升幅度、ChatGPT/Codex/API 三種入口差異,以及 API 翻倍定價對開發者的影響,並對比 Opus 4.7 隱性 tokenizer 漲價事件。
AI 服務不再匿名?Claude 與 OpenAI 同週推 KYC 身分驗證|原因與影響分析
2026 年 4 月同一週內,Anthropic 開始對部分 Claude 使用者要求政府 ID 加 selfie 驗證,OpenAI 同步發佈 GPT-5.4-Cyber 並擴張 Trusted Access for Cyber 計劃。本文整理兩家 AI 公司的 KYC 政策差異、背後的工業級蒸餾事件與出口管制脈絡,以及把護照交給 Persona 之後真正要擔心的事——從第三方攻擊面、執法調閱到跟銀行 KYC 的對照。