2026 年 7 月 27 日,Moonshot AI 在 Hugging Face 釋出 Kimi K3 完整權重,總參數 2.8 兆,為目前可公開下載的最大模型。但官方釋出的權重本身即為 MXFP4 量化版本,一般預期的壓縮空間在下載前已被使用;1.56 TB 的體積、官方建議的 64 顆以上加速器超節點,以及社群在雙卡工作站上實測的每秒 0.41 個 token,共同構成「開放權重」與「可自行執行」之間的實際距離。本文並更正媒體普遍誤植的授權條款,說明台灣企業的合規現況,以及單機真正跑得動的參數區間。
2026 年 7 月 24 日,Anthropic 發布 Claude Opus 5,定價與前代持平;同一天,NVIDIA 執行長黃仁勳以其首則 X 貼文分享一封主張開放權重的企業聯署信,名單在兩日內從 25 家增至約 50 家,Anthropic 與 Amazon 始終未列名。隨後一則「那也請開源 CUDA」的貼文引發討論,但發言者並非 Anthropic 執行長,而是該公司一位技術幕僚。本文釐清事件經過,並以事實對照 NVIDIA 軟體堆疊的實際開源範圍。
WWDC 2026 為開發者揭示了 Apple 在裝置端與雲端推論的整體布局。Foundation Models 框架這一代新增影像輸入、可在同一套 Swift API 下切換模型供應商、導入 Dynamic Profiles 代理式基礎,並向小型開發者開放 Private Cloud Compute 免費額度、宣布框架核心將於今年夏天稍晚開源。本文從開發者平台角度整理這些變化,並分析其對企業「AI 導入」實務的意義。
NVIDIA 官方公布 DGX Spark 針對自主式 AI 代理的實測數據,其中最容易被誤讀的一點是:效能表中的「提示處理吞吐」與「token 生成吞吐」相差約兩個數量級。Nemotron 3 Super 120B 的提示處理達每秒 2,855 個 token,實際產出文字則為每秒 18 個。本文完整呈現原表五欄數據、說明 120B 模型得以放入 128GB 的真正原因(NVFP4 四位元量化,而非 MoE 架構),並整理多節點擴充在微調與推論上的差異,藉此釐清這台機器適合與不適合的用途。
資安機構 Group-IB 公布 macOS 竊資木馬 ClickLock Stealer:使用者若取消偽造的密碼視窗,惡意程式會寫入開機啟動項,並於下次登入後以每 210 毫秒一次的頻率反覆終止 Finder、Dock 與終端機,使電腦僅剩單一對話框可供操作。惟其攻擊鏈並未利用任何 macOS 漏洞,亦未取得系統管理權限,而是始於使用者將一段指令貼入終端機。本文整理 Group-IB 的實測數據、竊取範圍、不會自我刪除的後門模組,以及正確的應變順序,包含何以必須以安全模式開機。
探討 ERP 導入 AI 的內容多出自 ERP 廠商,結論一致指向「無須汰換系統、串接 API 即可」,卻略過了成本最高的另一半:這些資料最終在哪一台機器上運算。本文銜接軟體與硬體兩端,說明四種資料接法的取捨(唯讀檢視表、固定工具、RAG、Text-to-SQL)、ERP 場景九成不宜採用微調的原因、雲端與地端的分流原則,以及各情境對應的顯示記憶體與機型。內容源自 MAQ 自身 ERP 導入 AI 的實作經驗,並說明過程中的三項限制。
Gamers Nexus 以 32 分鐘逐一檢視一份反壟斷訴狀:三星、SK 海力士與 Micron 被指控自 2022 年起協同限制傳統 DRAM 供給,將產能移轉至 AI 所需的 HBM。本文解析該片的實際內容(含標題所稱 600% 的真正口徑)、訴狀所列四項指控與 Gamers Nexus 本身的保留立場,並說明採購端最直接的三項變化:報價效期壓縮至 72 小時、交期達 30 週以上,以及未簽長約的買家承受較高漲幅,最後提出 AI 工作站採購的具體建議。
Apple 官方 WWDC26 影片示範:不連雲端、不用訂閱,用 MLX 讓完整的 AI 代理工作流全程跑在 Mac 上——OpenCode 接本機模型、Xcode 直接內建、還能擴展到多台 Mac。我們解析影片,並誠實對照 MAQ 的 Mac 工作站線。
Anthropic 把 Claude Cowork 擴展到手機與網頁:桌機開始的任務可在手機查看、取回成果,排程任務不需任何裝置在線也能照跑。我們解析影片與 MAQ 的自建路線。
雲端與地端怎麼算才划算、跑某個模型要買幾張卡、RAG 知識庫地端化怎麼選——MAQ 技術團隊把採購會遇到的難處與評比一次說清楚。完整選機邏輯見 AI 硬體選購指南 →