工具情報 · 2026 年第 34 週
本機巡檢 · 覆蓋 08-14 ~ 08-21 · 承重項經 GPT/Gemini 雙源自動校驗(DeepSeek 聯網失效不計票)· Perplexity 本週未執行
🔧 版本更新(可升級)
- MinerU 3.4.5 · 4.0.0a6(08-14 同日發布)— 3.4.x 穩定線與 4.0 alpha 預發布線並行;4.0 仍屬 alpha,生產環境不建議跟進,穩定線有新版建議升級。release ⚠單源(一手):GPT 一路回「査無」,但 releases.atom 一手抓取明確帶兩個 08-14 條目與 tag 頁;判一手源勝過搜索未命中,非分歧。
- mlx-vlm v0.6.14 · v0.6.15(08-17/08-18)— 本機視覺語言模型推理層連發兩版,落後幅度已較大,建議升級。release
- Ollama v0.32.15(08-20,含 MLX 更新)— 本機模型服務層,有新版建議升級。release
- yt-dlp 2026.08.19 — 落後一個多月,建議升級。release
- llama-cpp-python v0.3.35(08-17,含 metal 輪子)— release
- sherpa-onnx v1.13.6(08-18)— 語音推理框架。release
- mlx-audio v0.5.0(08-17)— Apple Silicon 統一語音棧(TTS 語音合成/STT 語音轉文字/STS 語音轉語音),上週列為候選,本週首次發布 0.5 主線版。release
- fail2ban 1.1.1(08-15)— 基建側安全組件。release
- pinyin-pro 3.29.2 · 3.29.3(08-15/08-19)— release
- 次要/不建議跟進:Syncthing v2.1.4-rc.1(rc(release candidate,發布候選)預發布)、goldendict-ng 每日構建、3x-ui dev build、chroma 滾動 Latest 標籤。
☁️ 雲端 AI / API 動態
- DeepSeek — 漲價正式生效,V4-Pro 轉 GA:峰谷分時計價已於 08-16 16:00 UTC 生效(峰時 01:00–04:00、06:00–10:00 UTC,谷時為峰時半價);08-13 DeepSeek-V4-Pro 轉正式版(GA,General Availability,正式公開可用),新增 low/high/max 三級思考強度與原生 OpenAI Responses API 格式支持。連續五週「已宣告未生效」的懸案本週結案。官方更新日誌 ✓兩源證實(官方一手+GPT 聯網覆核)
- 🔴 OpenRouter GPT 三檔位定價:上週「未決」結案,且發現長上下文加倍條款。一手 endpoints API 顯示每個檔位同時掛着三個價位:標準價、半價檔、以及提示詞超過 272,000 token 時自動翻倍的長上下文檔。標準價現為 terra $2/$12、sol $2.5/$15、luna $0.20/$1.20(每百萬 token 輸入/輸出),半價檔各為其一半。上週記錄的「terra $1/$6、sol $5/$30」並非降價或漲價,而是讀到了不同 endpoint —— 兩邊數字都眞實。⚠ 272K 加倍條款對長文本批量調度是實質成本陷阱,估算成本時必須單列。模型頁 ⚠分歧已由一手解決:GPT 讀網頁得 $1/$6(標 50% off)判「不屬實」,Gemini 讀得 $2/$12 判「屬實」,兩者各讀一個 endpoint,端點級 API 顯示二者並存。
- Google Gemini 3.7 Flash(08-13 發布,導入價 $0.75/$3.75 至 2026 年底)已進入終端 Gemini 通道,可用顯示名新增 High/Medium/Low 三檔(一手探測)。Pro 檔仍停在 3.1 Pro,Gemini 3.5 Pro 至今未發布。+補遺:3.6 Flash 同步套用相同導入價至年底,對成本盤點有實質影響。changelog ✓兩源證實
- Anthropic 水印 — 原草稿日期須更正:機器可讀水印的生效切線是 08-02 起發布的新模型,而 08-11 是對外説明/文檔更新日;且 GPT 指出官方表述限定於歐盟推出的模型,並非無條件全球全量。✓兩源一致更正(GPT/Gemini 獨立指出同一問題,採納)
- Z.ai GLM-5.3(08-14 發布,08-18 上架 OpenRouter,1M 上下文 $1.4/$4.4)— 定位為複雜編碼與長程代理任務強化版;⚠ 開放權重據稱因安全審査延後,不應視為本週已可本地跑的開源權重。OpenRouter 目錄一手 +GPT 補遺
- Modal:傳「Shared API 自 08-14 起限縮為 Team/Enterprise 方案」——⚠未證實,本週不採信為事實。GPT 聯網稱官方文檔仍將 Shared API 描述為可直接使用且明示免費額度可用;官方定價頁一手査核完全未提及 Shared API 分層。原始説法來自聚合式二手摘要,按回一手核原則降級處理。免費 $30/月額度未變則各源一致。官方定價頁 ⚠分歧+一手證否
- Kaggle 免費 GPU 配額 · Azure Document Intelligence:本週未見變動公告,維持每週 30 小時量級浮動配額/v4.0 GA 與現行費率。⚠ 誠實標註:GPT 正確指出「本週無變動」是難以用公開資料證明的否定命題,此處僅能記為「未見變動公告」,不等同已證實無變動。
🆕 新模型雷達(査證/深度研究 + 特別亮眼)
- Qwen3.8-27B(Qwen,08 月中旬)— 27B 原生視覺語言模型(VLM,Vision-Language Model),社群已有 MLX(Apple 機器學習框架)與 GGUF(llama.cpp 量化權重格式)量化版;本週對本地部署最有實際意義的一個。⚠ 規格須修正:官方模型卡為原生 262,144 token、可擴展至 1,000,000,不宜籠統稱「1M 本地上下文」。HF|GGUF 一手核 08-14 建庫 ✓兩源證實+一手核
- dots3-note-prev(dots-studio,08 月中旬)— 280B 總參數/16B 激活的 MoE(Mixture of Experts,混合專家)多模態開放權重模型(原模型支持音視頻理解),OpenRouter 免費檔至 09-30。⚠ 本地部署門檻極高(官方示例 8×H100),對 24GB 統一內存機器不具可行性,僅作 API 側候選。參數量原記「約 288B」應更正為 280B。HF ✓兩源一致更正
- NVIDIA Nemotron-3.5-Lightning-30B-A3B(08 月中旬)— 30B MoE,主打消費級硬件低延遲常駐運行,官方已出 NVFP4/BF16/社群 GGUF。HF 一手核 +Gemini 補遺,HF API 一手核實存在
- Meta Muse-Glimmer-30B(08-09 建庫)— 原生多模態,針對本地終端工具調用優化;47.8 萬下載/1718 讚,熱度硬指標充分。HF 一手核 +Gemini 補遺,HF API 一手核實
- Tencent Hy-MT2 系列上架 OpenRouter(08-20,1.8B/30B-A3B)— 33 語種翻譯專用模型,1.8B 極致量化後約 440MB 可移動端離線跑。⚠ 33 語種清單未含梵語、藏語、巴利語,與核心語種需求不對版,僅泰語/中英向可能有用。OpenRouter 目錄一手|GitHub
- 不收錄:本週 HuggingFace 熱榜前 30 幾乎被 Qwen3.8-27B 的各家去限制/量化衍生版佔滿,非獨立新模型,按門檻排除。
⭐ 更優替代掃描
- 梵語 OCR/天城體 VLM/吠陀天城體:本週無更優替代。GPT 聯網明確確認 08-14 ~ 08-21 期間無梵語、天城體或藏文 OCR 的重大官方模型/API 發布。此前的 VedOCR(吠陀寫本專家標註集)仍是該向最新一手成果,非本週新事。
- 通用文檔 OCR:NaviDC-OCR(arXiv 2608.12898,08-12)— 針對「數字原生文檔 vs 相機拍攝文檔」兩種來源的統一解析導航。⚠待驗:僅論文一源,無開源權重入口與獨立複現,未達推薦門檻。arXiv
- 梵語/巴利/藏語 TTS · 梵語 ASR · 梵語 NLP/MT:本週無更優替代。所監看的相關模型倉庫本週均無新提交(見下節層一)。
- 音源分離/去噪/強制對齊:本週無更優替代,相關倉庫本週無發行。
- ⚠ 取源缺口:arXiv 官方 API 本週對本機出口 IP 持續返回 429 限流,多次重試與串行降速均未恢復,該向的論文掃描改由 HuggingFace daily_papers 與定向搜索代償,覆蓋度低於常週,屬本週已知盲區。
🖥 本機 AI 模型全景監看
- 層一·別落後:本週無變化。所監看的模型倉庫(吠陀天城體 OCR、藏文 Tesseract 包、梵英翻譯底模、梵語 TTS 兩個候選、梵語 ASR 微調、印地語 Parler-TTS、泰文 TrOCR、dots.ocr、Qwen3-VL、Qwen2-Audio)本週均無新提交;PaddleOCR-VL 最後更新停在 08-08,屬上一窗口。所屬底模家族本週亦無面向這些專項的新版本。
- 層二·別停滯:本週開拓面集中在本地多模態與語音棧兩處——
- 三款 27B~30B 級新開源模型同期落地(Qwen3.8-27B/Nemotron-3.5-Lightning-30B-A3B/Muse-Glimmer-30B),均已有社群量化版,這一尺寸段在 24GB 統一內存機器上是可跑區間,是本週最値得關注的方向性變化:本地可跑的原生多模態基座正在從 8B 級上探到 30B 級。
- mlx-audio v0.5.0 發布,Apple Silicon 上 TTS/STT/STS 的統一整合層走出 0.4.x,該項上週已列候選,本週進入可評估狀態。
- 未發現「本機清單上根本沒有這一類」的全新類別;量化技術與推理框架側本週無斷層級進展。
🏛 IE 文獻學新工具/資源(更廣範圍)
- 本週無可核驗的重大新發布。跨梵語/天城體/藏文以及更廣 IE(Indo-European,印歐語系)範圍(古希臘、拉丁、古伊朗、楔形文字、比較語言學數據庫)的定向掃描與 GPT 獨立聯網覆核均未命中 08-14 ~ 08-21 窗口內的新工具、新數據集或新平台版本。
- 唯一沾邊的新論文為上節已列的 NaviDC-OCR(通用文檔解析,非 IE 專項)。
- ⚠ 本節結論的可信度受上述 arXiv 限流影響而下降,屬低置信「無」,非已窮盡確認。
📋 清單變動
- ✅ 上週取源異常結案:CosyVoice 的 releases.atom 上週返回 0 字節,本週重抓正常(2 個條目,最新 v2.0),確認繫單次取源失敗而非倉庫變更或倉庫無發行,無需調整清單。
- ⚠ 新方法坑(本週實測):arXiv 官方 API 對並發請求的限流極嚴,四路並發即觸發 429,且觸發後串行降速重試亦持續被拒(冷卻期跨越數十分鐘)。後續該向掃描應改為單線程、請求間隔 ≥5 秒,或直接改走 HuggingFace daily_papers 代償,不要並發打。
- 📌 積壓未處理(沿用上週):清單第 3 節仍缺 pandoc(每週實際都在核對,建議正式補入);LMArena 已改名 arena.ai,清單與各處引用需同步更新。
- 本週工作區掃描未發現第 3 節之外的新在用工具。
🔎 第二源校驗小結
- GPT/Gemini 雙源自動校驗:證實 4 條、分歧 3
條(其中 2 條已由一手源解決)、更正 3 條、補充 4 條。
- ✓ 證實:DeepSeek 漲價生效與 V4-Pro GA、Gemini 3.7 Flash 發布與定價、Qwen3.8-27B 發布、dots3-note-prev 上架。
- ⚠ 分歧:① GPT 檔位定價——已由 endpoints API 一手解決(雙方各讀一個 endpoint,均眞實);② Modal Shared API 限縮——一手定價頁證否,降級為未證實;③ MinerU 雙版本發布——GPT 査無,但一手 releases.atom 確鑿,判一手勝出。
- ✏️ 更正並採納:Anthropic 水印生效日應為 08-02(08-11 繫公告日)且限定歐盟;dots3-note-prev 參數量 280B 非 288B;Qwen3.8-27B 原生上下文 262K 而非 1M。
- + 補遺:GLM-5.3、Gemini 3.6 Flash 同步降價、Nemotron-3.5-Lightning、Muse-Glimmer-30B(後兩者已 HuggingFace API 一手核實存在)。
- 🔴 DeepSeek 聯網通道本週不計票,且上週懸案結案:經
OpenRouter 呼叫
deepseek-v4-pro:online,響應 usage 中server_tool_use_details為空、web_search_requests 為 0,證實:online外掛對該模型確實不生效(上週標記的「疑似未生效」本週確認)。該路實際以離線知識作答,卻仍輸出了數個看似具體的來源鏈接——這正是最危險的形態:零檢索卻附帶可點擊引註。其肯定與否定答覆本週一律不計入共識。後續該路應直接改用不掛:online的離線模式並明確標註,或整體改走官方直連通道。 - ⚠ Gemini 單源孤證一則已證否:Gemini 聲稱天城體 OCR 業界現傾向使用「4 月發布的 ARVA 多模態模型」——HuggingFace 模型檢索返回空結果,GPT 亦明確稱本週該向無發布。判無可核證據,疑為編造,不予收錄。同批次中 Gemini 提出的另兩個候選(Nemotron-3.5-Lightning、Muse-Glimmer-30B)則經一手核實存在——同一次回答裏眞假並存,逐條核而非整體採信是必要的。
- Perplexity:本週未執行(三路自動校驗已覆蓋全部承重項,且 GPT 一路實際發起 13 次聯網檢索,覆蓋充分)。承重項少,人工核査清單從略。
- 🔬 本地模型參考(Gemma,離線·不計入共識):全部九條均答「査無/未來事件」——該模型知識截止為 2025 年 1 月且自述當前日期為 2024 年 5 月,對 2026 年 8 月事件無任何判別能力。本週無參考價値,屬離線模型的預期行為,非異常。
成本備註:本週按量 API 實付合計約
$0.45(GPT 一路 $0.437、DeepSeek 一路 $0.012;Gemini
走終端通道、Gemma 走本地,均零邊際成本)。⚠ GPT
一路顯著高於規格書預估的「幾分錢到三五毛」上緣,主因有二::online
觸發 13 次檢索使提示詞膨脹至 11.3 萬 token,且該檔位標準價本週恰為
$2/$12(見上文長上下文與檔位定價一節)。若後續持續偏高,應收窄單批問題數或改用半價檔
endpoint。