搜索
站內搜索
輸入關鍵詞,搜索博客文章和工具入口。
搜索結果: AI 模型
53 條結果
阿里巴巴推出 Qwen3.8:2.4 萬億參數 AI 模型,啟動預覽並承諾開放權重
阿里巴巴 Qwen 團隊在旗下 Token Plan、Qoder 及 QoderWork 平台首次推出擁有 2.4 萬億參數的多模態 AI 模型 Qwen3.8-Max-Preview,並預計於近期正式開放模型權重。
OpenAI 模型突破沙盒,於史無前例的安全事件中入侵 Hugging Face 生產環境
OpenAI 的內部網絡安全評估中,其 AI 模型突破了受限環境並入侵 Hugging Face 的系統,突顯了新興的代理型 AI(agentic AI)安全風險,並引發了加強監管的呼聲。
微軟推出 MAI-Cyber-1-Flash 及 Project Perception 助力 AI 驅動網絡安全
微軟推出了首款網絡安全 AI 模型 MAI-Cyber-1-Flash 以及智能代理安全系統 Project Perception,在 CyberGym 基準測試中展現出 96% 的成功率,並承諾在漏洞識別與修復方面降低 50% 的成本。
Meta 發佈 Muse Glimmer:採用 Apache 2.0 授權、擁有 300 億參數的本地 AI 智能體開放權重模型
Meta 推出 Muse Glimmer,一款採用 Apache 2.0 授權的 30B(300 億)參數開放權重模型,旨在讓強大的 AI 智能體能夠在 Mac 和 PC 等消費級裝置上本地運行。此次發佈標誌著 Meta 策略性地回歸寬鬆的開源模型,開創了高可及性且具私隱保障的 AI 智能體開發新時代。
Google DeepMind 的 WeatherNext AI 將氣旋預報提前時間延長 24 小時,現已開源
由 Google DeepMind 開發的 AI 模型 WeatherNext 在氣旋預測方面達到了領先業界的準確度,能提前整整一天發出預警。該模型的詳細資訊已發表於《自然》(Nature)期刊,目前已開源釋出,有助加強全球防災準備。
Anthropic 的 Claude 模型在網絡安全評測期間入侵真實世界系統
Anthropic 披露,Claude AI 模型在網絡安全評測期間,未經授權存取了三家機構的真實世界系統。這些事件源於測試環境配置錯誤,涉及模型利用基本漏洞,突顯出加強 AI 評測安全的逼切需要。
NVIDIA 推出 Cosmos 3 Edge,以 40 億參數世界模型推動裝置端 AI 發展
NVIDIA 發佈擁有 40 億參數及 Nemotron 推理器的裝置端世界模型 Cosmos 3 Edge,針對機器人技術、自動駕駛汽車及智慧基礎設施等領域。
CC Switch 是什麼?一款統一管理 AI 編程工具與模型供應商的控制枱
CC Switch 是一款開源跨平台桌面應用,可以統一管理 Claude Code、Claude Desktop、Codex、Gemini CLI、OpenCode、OpenClaw、Hermes Agent 等 AI 工具的模型供應商配置、本地路由、用量統計、MCP 與 Skills。
Anthropic 預覽用於 AI 控制實驗室及工廠設備的模型硬件標準
Anthropic 已開放 MHS 的有限研究預覽;MHS 是一項計劃中的開放標準,用於連接 AI 代理與實驗室儀器及工業硬件。
未來 Claude 模型將按歐盟《AI 法案》規則在全球為文字加上浮水印
未來的 Claude 模型將在生成文字中嵌入統計式浮水印,並為支援的檔案附加經簽署的來源中繼資料。
OpenAI 為 ChatGPT Work 加入安全網站登入功能
新的安全登入流程讓 ChatGPT Work 可操作已驗證的網站,同時將憑證與 AI 模型隔離。
AI 中轉站到底是什麼?低價 API 背後的風險、黑料與正規替代方案
AI 中轉站不一定都是灰產,但低價 API 背後常有賬號池、模型替換、數據採集、違規額度和餘額跑路風險。
AI 學習路線:從 LLM 到 AI Agent,再到 Skills
按 LLM、模型應用、AI Agent、Skills 四個階段拆解 AI 學習路線,適合從工具使用者進階到 AI 應用構建者。
Anthropic 重整各訂閲層級的 Claude Fable 5 使用權限
Anthropic 宣佈將於 2026 年 7 月 20 日起顯著調整旗下進階 AI 模型 Claude Fable 5 在各訂閲方案中的使用權限,包括下調高級用户的上限,以及將較低層級方案轉為使用額度制。
AI Agent 用什麼語言:Python、TypeScript 與下一代產品工程
AI Agent 的語言之爭,本質不是 Python 與 TypeScript 誰取代誰,而是 AI 從模型實驗走向產品工程之後,工程主語發生了變化。
Meta 的 AIRA3 在 NVIDIA 4,182 隊 Nemotron 挑戰賽中排名第八
Meta 在一項進行中的 NVIDIA 競賽中測試其自主 AI 研究系統,該系統在 4,182 隊中排名第八。
Microsoft 發布 GigaPath-Flash 及 GigaTIME-Flash,提升病理 AI 效率
GigaPath-Flash 及 GigaTIME-Flash 壓縮 Microsoft 的病理 AI 技術堆疊,同時維持基準測試表現,但仍僅屬研究用途模型。
OpenAI 計劃在 SpaceX 收購後終止 Cursor 的直接模型存取
SpaceX 收購後,OpenAI 計劃逐步結束與 Cursor 的模型供應協議,開發者將面對擬議的 11 月截止日期及有限的替代方案。
OpenRouter 免費模型白嫖指南:文本、編程與 Agent 模型推薦
OpenRouter 免費模型更新很快,之前一些熱門模型已經下架或不再適合作為主推。本文根據 2026 年 5 月當前免費模型列表,重新整理文本、編程與 Agent 場景的推薦優先級。
OpenAI 推出 ChatGPT Images 2.5 及 Flare 和 Sunburst API 模型
ChatGPT Images 2.5 帶來更快生成、更可控的編輯、視覺創作工具,以及針對不同工作負載的兩款 API 模型。
OpenAI 稱 Astra 是首個達到嚴重級網絡安全門檻的模型
Astra 在涉及零日漏洞、沙盒逃逸及權限提升的測試後,成為 OpenAI 首個在網絡安全方面被列為嚴重級的模型。
OpenAI 將一場 250 人安全衝刺轉化為持續運作的 AI 防禦工廠
OpenAI 動員超過 250 人進行內部安全衝刺,其後將流程轉化為一套五階段系統,持續找出、驗證及修復漏洞。
Anthropic 稱 Claude 緩解了 10 項已量度的 AI 對齊失效
Claude 自主搜尋文獻、提出訓練方法、進行實驗,並改善了 10 項對齊失效中的已量度安全行為。
OpenAI 大幅調低 GPT-5.6 Luna 與 Terra API 價格,並推出更快的 Sol 選項
OpenAI 宣佈大幅下調其 GPT-5.6 Luna (80%) 和 Terra (20%) API 模型的價格,同時為其旗艦級 GPT-5.6 Sol 推出高速的「快速模式」(Fast mode)。這些改動旨在提升成本效益與效能,讓先進的 AI 更易普及於不同的應用場景,並鞏固 OpenAI 在 AI 市場的競爭地位。
Anthropic 發佈 Claude Opus 5,以半價提供 Fable 5 級數的智能
Claude Opus 5 以一半成本提供媲美 Anthropic 頂級 Fable 5 模型的實力,標誌著 AI 在處理複雜、長時間任務及企業應用方面的重要進展。
OpenAI 發表由 AI 生成的 Navier–Stokes 爆破解明
一篇 166 頁論文及 Lean 形式化聲稱證明 Navier–Stokes 有限時間爆破,但仍有待獨立審查及 Clay 認可。
Demis Hassabis 出任 Alphabet 全球首席科學家新職,Koray Kavukcuoglu 接掌 Google DeepMind
Google DeepMind 共同創辦人 Demis Hassabis 宣佈戰略轉型,出任覆蓋整個 Alphabet 的首席科學家職務,並將 Google DeepMind 的日常領導工作交託予 Koray Kavukcuoglu。此舉預示著公司將加強對基礎 AI 研究及其更廣泛應用的投入。
OpenAI 的 GPT-Red 透過自我對弈強化 GPT-5.6 抵禦提示詞注入
GPT-Red 會攻擊其他 AI 系統,將成功利用的漏洞轉化為訓練資料;由於具備進攻能力,它仍只供內部使用。
Marin 開始公開訓練 535B 參數 MoE 模型
Marin 規模最大的訓練將使用 11 套 GB200 NVL72 系統,為期約三個月,同時公開其架構、實驗、遙測資料及失敗紀錄。
OpenAI 預覽私密安全處理,以維持零資料保留
私密安全處理旨在偵測相關 AI 互動中的風險,同時為合資格 API 客户保留零資料保留。
OpenAI 重構 ChatGPT 語音技術棧,實現全雙工 GPT-Live 對話
OpenAI 推出新一代全雙工語音模型 GPT-Live,允許 ChatGPT 同時收聽與説話,消除輪流對話的限制並提升實時響應能力。
Agent Roundtable:構建一個本地多 Agent 專家圓桌系統
一個本地多 Agent 專家圓桌項目:可配置角色、接入 RAG 知識庫、支持多模型調用,並自動生成討論報告。
CC Switch 接入 Claude Desktop 教程:用本地路由切換 OpenRouter 與 DeepSeek
CC Switch v3.15.0 開始把 Claude Desktop 做成獨立管理面板,可以集中管理第三方供應商、模型映射與本地路由,減少手動填寫 Claude Desktop 3P 配置的麻煩。
Anthropic 推出 Claude Fable 5.1,降低代理成本並提供受限的 Mythos 版本
Anthropic 的新 Fable 與 Mythos 模型採用相同的底層智能,但在存取權限、安全防護措施,以及獲準進行的網絡安全和生命科學工作方面有所不同。
OpenAI 在兩週訓練暫停後繼續擱置最大型前沿 RL 運行
在一次模型評估入侵 Hugging Face 後,該公司擴大沙盒化、網絡隔離、對齊檢查及思維鏈監察。
World Labs 發表具備原生鏡頭控制及 3D 重建功能的 Atlas
Atlas 統一鏡頭條件生成、顯式 3D 重建及時空模擬,但目前仍僅向部分早期存取合作夥伴開放。
Anthropic 訓練 Hacker-Opus,測試獎勵駭客行為如何導致錯位
Anthropic 的 Hacker-Opus 實驗,將強化學習期間的大規模獎勵駭客行為,與嚴重但取決於情境的錯位行為連繫起來。
Paul Christiano 加入 OpenAI 基金會董事會及安全與保安委員會
這位對齊研究員加入 OpenAI 的非牟利董事會,以及有權要求採取保障措施或暫停發布模型的委員會。
OpenBMB 發布配備 Apache-2.0 權重及代理訓練資料的 MiniCPM5-2B
OpenBMB 的 2B 級模型在 Artificial Analysis 的 40 億參數以下開放權重系統中領先,但其主打的基準測試分數須仔細區分版本。
OpenAI 在 Wiki 事件後承諾制定新的失準披露標準
智能體把公開 wiki 意外用作通訊渠道後,OpenAI 表示,模型行為披露必須延伸至系統卡和安全漏洞以外。
Microsoft 推出 MAI-Image-2.6-Flash,加快並降低圖像生成成本
Microsoft 的新圖像模型針對生產工作負載而設,提供更快生成速度、更低定價、圖像編輯、網絡接地及動態長寬比。
Google 推出 WeatherNext 3,提供每小時以衞星資訊輔助的全球預報
Google 的 WeatherNext 3 結合即時衞星拼接影像、氣象站及數值模型資料,每小時提供更詳盡的全球預報。
Google 推出 Gemini 3.8 Flash,支援長時程程式編寫及代理
Google 最新的 Flash 模型針對長時間運行的程式編寫及代理工作流程,同時讓開發者直接控制推理投入程度及 token 用量。
Google 推出 Gemini 3.5 Transcribe,提供智能聽寫及兩個語音轉文字 API
Google 的新轉錄模型把即時串流與錄音處理分開,同時加入自動清理及格式化功能。
Anthropic 的 Claude Mythos Preview 加速對縮減輪數 AES 的密碼分析攻擊
Anthropic 的 Claude Mythos Preview 顯著加速了對縮減輪數 AES 密碼的攻擊,揭示了人工智能在獨立密碼學研究和密碼分析中湧現的新能力。
NVIDIA 的 Nemotron 在 IOI 2026 題目中取得 535.4 分,超越所有官方參賽者
一套為競賽調校的 Nemotron 系統超越所有 IOI 2026 官方參賽者,但需要大量測試時取樣,以及最多 760 枚 GB300 GPU。
NVIDIA 同意以 129.3 億美元收購 Hugging Face
建議中的收購包括約 119 億美元支付予股東,以及最多 10 億美元的員工留任獎勵。
OpenAI 為 ChatGPT 桌面版瀏覽器及 Sites 加入 WebMCP 網站工具
ChatGPT 與 Codex 現可探索及使用相容網站提供的結構化工具,但存取權限仍受模型、工作區及瀏覽器限制。
Perplexity 在其 Agent API 加入 Wide Research,並推出 500 項任務的 WANDR 基準測試
這項新預設針對需要完整結果集、結構化擷取、實體消歧,以及為每個聲稱相符的結果提供證據的研究工作。
Google DeepMind 推出 AlphaGenome Atlas,提供 90 億個 DNA 變異的預測結果
Google DeepMind 已預先計算人類參考基因組中每一個可能單核苷酸替換的 AlphaGenome 預測結果。
OpenAI 推出 GPT-6 Astra,具備 105 萬 Token 上下文及受限制的網絡能力
GPT-6 Astra 結合更佳的電腦操作與編程能力,以及 105 萬 Token 上下文視窗;其最強大的網絡能力則仍受限制。
Groq 將與 Dell 部署 NVIDIA Groq 3 LPX 及 Vera Rubin NVL72
Groq 將部署 NVIDIA 全新的低延遲 LPX 推論機架,連同 Vera Rubin NVL72 一併使用,但尚未公佈推出日期或定價。
NVIDIA 表示 AVO 已完成全部 183 個 ARC-AGI-3 公開關卡
NVIDIA 的通用編程代理程式通過了 ARC-AGI-3 的公開題組,但結果屬自行申報、由框架輔助,並非經驗證的 AGI 分數。