產業動態

Kimi K3 釋出 2.8 兆參數權重:原生 MXFP4 已無壓縮餘裕,頂規工作站實測每秒 0.41 個 token

2026 年 7 月 27 日,Moonshot AI 在 Hugging Face 釋出 Kimi K3 完整權重,總參數 2.8 兆,為目前可公開下載的最大模型。但官方釋出的權重本身即為 MXFP4 量化版本,一般預期的壓縮空間在下載前已被使用;1.56 TB 的體積、官方建議的 64 顆以上加速器超節點,以及社群在雙卡工作站上實測的每秒 0.41 個 token,共同構成「開放權重」與「可自行執行」之間的實際距離。本文並更正媒體普遍誤植的授權條款,說明台灣企業的合規現況,以及單機真正跑得動的參數區間。

2026-07-29 | 約 12 分鐘
產業動態

Claude Opus 5 發布,與同日的開放權重聯署信:NVIDIA 已開源驅動程式,CUDA 工具鏈仍為封閉

2026 年 7 月 24 日,Anthropic 發布 Claude Opus 5,定價與前代持平;同一天,NVIDIA 執行長黃仁勳以其首則 X 貼文分享一封主張開放權重的企業聯署信,名單在兩日內從 25 家增至約 50 家,Anthropic 與 Amazon 始終未列名。隨後一則「那也請開源 CUDA」的貼文引發討論,但發言者並非 Anthropic 執行長,而是該公司一位技術幕僚。本文釐清事件經過,並以事實對照 NVIDIA 軟體堆疊的實際開源範圍。

2026-07-27 | 約 9 分鐘
產業觀察

WWDC 2026 開發者平台總覽:Foundation Models 框架的轉向,與其對 AI 導入的意義

WWDC 2026 為開發者揭示了 Apple 在裝置端與雲端推論的整體布局。Foundation Models 框架這一代新增影像輸入、可在同一套 Swift API 下切換模型供應商、導入 Dynamic Profiles 代理式基礎,並向小型開發者開放 Private Cloud Compute 免費額度、宣布框架核心將於今年夏天稍晚開源。本文從開發者平台角度整理這些變化,並分析其對企業「AI 導入」實務的意義。

2026-07-24 | 約 8 分鐘
AI 應用

NVIDIA DGX Spark 自主式 AI 代理實測解析:兩種吞吐量的差別,以及它不適合做什麼

NVIDIA 官方公布 DGX Spark 針對自主式 AI 代理的實測數據,其中最容易被誤讀的一點是:效能表中的「提示處理吞吐」與「token 生成吞吐」相差約兩個數量級。Nemotron 3 Super 120B 的提示處理達每秒 2,855 個 token,實際產出文字則為每秒 18 個。本文完整呈現原表五欄數據、說明 120B 模型得以放入 128GB 的真正原因(NVFP4 四位元量化,而非 MoE 架構),並整理多節點擴充在微調與推論上的差異,藉此釐清這台機器適合與不適合的用途。

2026-07-22 | 約 10 分鐘
產業動態

ClickLock Stealer:反覆關閉程式逼取密碼的 macOS 竊資木馬,以及它為何不算 macOS 漏洞

資安機構 Group-IB 公布 macOS 竊資木馬 ClickLock Stealer:使用者若取消偽造的密碼視窗,惡意程式會寫入開機啟動項,並於下次登入後以每 210 毫秒一次的頻率反覆終止 Finder、Dock 與終端機,使電腦僅剩單一對話框可供操作。惟其攻擊鏈並未利用任何 macOS 漏洞,亦未取得系統管理權限,而是始於使用者將一段指令貼入終端機。本文整理 Group-IB 的實測數據、竊取範圍、不會自我刪除的後門模組,以及正確的應變順序,包含何以必須以安全模式開機。

2026-07-22 | 約 9 分鐘
AI 應用

ERP 導入 AI:四種資料接法、雲端與地端的分流原則,以及對應的硬體規格

探討 ERP 導入 AI 的內容多出自 ERP 廠商,結論一致指向「無須汰換系統、串接 API 即可」,卻略過了成本最高的另一半:這些資料最終在哪一台機器上運算。本文銜接軟體與硬體兩端,說明四種資料接法的取捨(唯讀檢視表、固定工具、RAG、Text-to-SQL)、ERP 場景九成不宜採用微調的原因、雲端與地端的分流原則,以及各情境對應的顯示記憶體與機型。內容源自 MAQ 自身 ERP 導入 AI 的實作經驗,並說明過程中的三項限制。

2026-07-21 | 約 9 分鐘
產業動態

DRAM 危機:Gamers Nexus 點名的 600% 漲價與三大廠遭控協同縮供——影片解析與 AI 工作站採購對策

Gamers Nexus 以 32 分鐘逐一檢視一份反壟斷訴狀:三星、SK 海力士與 Micron 被指控自 2022 年起協同限制傳統 DRAM 供給,將產能移轉至 AI 所需的 HBM。本文解析該片的實際內容(含標題所稱 600% 的真正口徑)、訴狀所列四項指控與 Gamers Nexus 本身的保留立場,並說明採購端最直接的三項變化:報價效期壓縮至 72 小時、交期達 30 週以上,以及未簽長約的買家承受較高漲幅,最後提出 AI 工作站採購的具體建議。

2026-07-21 | 約 10 分鐘
AI 應用

WWDC26:在 Mac 上用 MLX 跑本地代理式 AI——Apple 把 on-device Agent 當一級公民

Apple 官方 WWDC26 影片示範:不連雲端、不用訂閱,用 MLX 讓完整的 AI 代理工作流全程跑在 Mac 上——OpenCode 接本機模型、Xcode 直接內建、還能擴展到多台 Mac。我們解析影片,並誠實對照 MAQ 的 Mac 工作站線。

2026-07-18 | 約 9 分鐘
AI 工具

Claude Cowork 登陸手機與網頁:AI 從「聊天」變成「會自己把工作做完的同事」

Anthropic 把 Claude Cowork 擴展到手機與網頁:桌機開始的任務可在手機查看、取回成果,排程任務不需任何裝置在線也能照跑。我們解析影片與 MAQ 的自建路線。

2026-07-12 | 約 6 分鐘
MAQ 部落格

2026 企業地端 AI 採購評比與選購指南

雲端與地端怎麼算才划算、跑某個模型要買幾張卡、RAG 知識庫地端化怎麼選——MAQ 技術團隊把採購會遇到的難處與評比一次說清楚。完整選機邏輯見 AI 硬體選購指南 →

看完整選機對照表 →