工具情報 · 2026 年第 32 週(補充巡檢)
本機巡檢 · 本次窗口僅 08-07 → 08-08 一日(同週前一份 W32 報告於 08-07 生成,本篇為增量補充,不覆蓋原檔)· 承重項經 GPT/Gemini/DeepSeek 三源自動校驗 + Perplexity 本次自動査證成功
🔧 版本更新(可升級)
- 本日窗口內無新的可升級項。 全部 49 個受監看倉庫的
releases.atom已重掃一輪,08-05 以後的發行條目(sherpa-onnx v1.13.4、Syncthing v2.1.3、Ollama v0.32.6、GoldenDict-ng v26.8.0 正式版、3x-ui dev build)均已在同週前一份報告中報過,去重游標命中,不重複列出。 - 唯一新增條目屬噪音:GoldenDict-ng 掛出 v26.9.0 每日構建(08-07)——daily build 非正式發行,不建議跟進。release
- 延續未清的升級積壓(承上週結論,本日無變化):本地 VLM 推理庫與 Surya OCR 兩條線仍落後於當前發行線,建議一併補升;MinerU 穩定線本週未動,4.0 仍在 alpha,不建議上生產。
- 取源異常一則:CosyVoice 的
releases.atom本次返回 0 字節(非「倉庫無發行」,而是取源失敗)。單源失敗只記不中斷,下週覆核。
☁️ 雲端 AI / API 動態
- 🔴 DeepSeek 漲價預告仍未落地費率與生效日 — 官方定價頁至今只掛「計劃近期顯著上調 API 整體價格」的文字通知,既無新費率、也無生效日。目前公佈的正價(每百萬 token,USD)為:V4-Flash 緩存命中 $0.0028/未命中 $0.14/輸出 $0.28;V4-Pro $0.003625/$0.435/$0.87。官方定價頁 ✓四源證實(官方頁一手 + GPT + Gemini + Perplexity;另 Bloomberg 08-06 亦報導未給數字)
- ⚠ 「峰谷分時計價」連續第五週分歧,且分歧形態已穩定 — 一手讀官方定價頁:只有 cache hit/miss 兩列,無峰時/谷時費率表;而第三方(TechNode 系、Pandaily、The Standard(HK)、Perplexity 綜述)持續描述峰時(北京時間 09:00–12:00、14:00–18:00)為正價 2 倍、且用「已推出」的語氣。判斷:屬已宣告但未反映在公佈費率表上,不是取消,也不是已生效。此條連續五週同形態,建議以官方費率表為唯一依據排期批量作業。官方定價頁
- ⚠ 「V4-Flash 單日 8 兆 token」是一個站不住的數字——已由一手數據推翻 — 該說法在 08-06 前後的聚合報導與社群貼文中流傳(並被加上「5 兆免費試用 + 3 兆付費」的精確拆分)。四路査證後裁定 UNVERIFIED:OpenCode 自家 Model Data 儀表板顯示 08-01 全平台所有模型合計 3.8 兆 token,並非 V4-Flash 單獨 8 兆;接近 8–9 兆的單日總量實際出現在 08-06(8.9 兆)與 08-07(9.1 兆),且係全模型合計。所謂 5 兆/3 兆拆分在任何可追溯來源中都不存在。OpenCode 數據頁 ⚠分歧已裁決:GPT/DeepSeek 兩路均答「無法核實、只見社群傳言」,Gemini 一路答「確有其事」並給出 5兆/3兆拆分但只引「網絡報導」泛稱——升級 sol 裁決後由一手儀表板推翻。這正是「精確到小數點是危險信號」與「聚合站洗稿→假數字複利」的又一個實例。
- +補遺(同週前一份報告漏記):Claude Opus 4.1 已於 08-05
正式退役 —
claude-opus-4-1-20250805的請求現直接返回錯誤,官方建議遷移至 Opus 5;研究者可經 External Researcher Access Program 申請延續訪問。凡有腳本硬編碼該模型名者需改。 前一份報告「Anthropic 本週無新基礎模型發佈」只覆蓋了「新發布」,漏了同窗口的「退役」。官方 release notes ✓官方頁一手 - Anthropic 08-07 API 變更(均屬 Managed Agents
面,與現行用法弱相關) — 會話級預算硬上限(達額以
budget_reached暫停)、會話可配「顧問」模型中途諮詢、inference_geo可指定推理地理位置、會話可自 GitHub 倉庫.claude/skills自動發現技能。官方 release notes ✓官方頁一手 - ✅ 更正上週「目錄約 1,031 個計價模型(單源待核)」——實際約 400 — 直接査 OpenRouter 模型目錄 API(一手)得 400 個條目;官方自述為「400+ 模型、70+ 供應商」。三源一致認定「接近 1,000 不可信」。上週那個四位數係單源,現判為錯誤,已從游標中修正。OpenRouter 模型 API ✓三源證實
- OpenRouter 本日窗口新上架兩項(目錄 API 一手核
created
時間戳):
inclusionai/ling-3.0-tiny:free(08-06,262K 上下文,免費檔)、meta/muse-spark-1.2(08-05,1M 上下文,$1.25/$4.25 每百萬)。OpenRouter - 査證用三檔位(terra/sol/luna)本日無變動 —
目錄價一手核:terra $1/$6、sol $5/$30、luna
$0.10/$0.60(每百萬,輸入/輸出)。另記一則有用的一手事實:
-pro字尾變體與基礎檔目錄單價完全相同,故現行禁用-pro的理由純繫於實測 token 消耗高 5–11 倍,與價格無關——該禁令依據不受本次核査影響。 - Azure Document Intelligence/Kaggle/Modal/百度 AI Studio — 一日窗口內無公告或定價變動。
🆕 新模型雷達(査證/深度研究 + 特別亮眼)
- 本日窗口無符合門檻的新模型。 一日窗口內 OpenRouter 僅上架前述兩項(一個免費小模型、一個既有系列的小版本迭代),排行/跑分均無突破,不足以進入雷達。
- 記一則觀察(不構成推薦):HuggingFace 近三日 trending 幾乎被 MiniMax-H3 及其衍生(LoRA/ComfyUI 封裝/量化)佔滿,係文生視頻/音頻向模型,與現行文獻學棧無關,僅記錄以免下週誤判為「新發現」。
⭐ 更優替代掃描
- 本週無更優替代。 ★ 標記的六個類別(梵語 OCR、天城體 VLM、梵語/巴利/藏語 TTS、梵語 ASR、梵語 NLP/MT、音源分離/去噪/對齊)本次逐一重掃:arXiv 三組檢索式(梵語/天城體/巴利/吠陀;古希臘/中世紀拉丁/HTR;文檔 OCR/VLM-OCR)自 08-05 起均無新條目;HF 新模型流無相關類別新權重。窗口僅一日,且 08-08 為週六,arXiv 本身亦有週末空檔,屬正常。
🖥 本機 AI 模型全景監看
- 層一·別落後:清單內各模型倉庫與底模家族本日窗口無更新。特別追蹤項
gemma4架構的圖像輸入支持:Ollama 本日無新發行(最近一版 v0.32.6 於 08-05,已在前一份報告記錄,其內容為 Qwen3.5 的 MTP 投機解碼加速,與 gemma4 視覺無關),該缺陷仍未修復。 - 層二·別停滯:本日窗口無值得納入的新候選。掃到的相關動向僅兩類,均未達收錄門檻:①Gemma 4 12B 的 AWQ/MLX 量化版本持續有第三方上傳(屬既有模型的量化流通,非新架構);②Inkling/Inkling-Small 出現 NVFP4 量化(NVFP4 面向 NVIDIA 硬件,與 Apple Silicon 統一內存路線無關)。
- 本地離線模型參考(Gemma,不計入共識):本次未執行——本地推理服務未在運行,按既定流程跳過,不影響其餘校驗。
🏛 IE 文獻學新工具/資源(更廣範圍)
- 本週無顯著動態。 古希臘/中世紀拉丁/HTR 方向的 arXiv 檢索自 08-05 起無新條目;語料平台(GRETIL/TITUS/DSAL/SARIT/Logeion/DCS)與 OCR 平台(Transkribus/eScriptorium)本日窗口無版本或功能公告。一日窗口對本節(原設計為 2–3 個月窗口)本就幾乎不可能有增量,此處僅作留痕。
📋 清單變動
- 無新發現在用工具。
- 延續未辦事項(承上週,本日無進展):建議補入 §3 監看清單的候選仍未入檔——mlx-audio、Qwen3-ASR/Qwen3-TTS 系列、VedOCR,以及更早積壓的 F5-TTS-THAI、indic-parler-tts、Unlimited-OCR 基座及其 MLX 移植、vagdhenu。這批已連續多週停留在「建議補入」狀態,規格書 §3 本體未動;若不落檔,每週的替代掃描與版本巡檢都繞不到它們。
🔎 第二源校驗小結
- GPT/Gemini/DeepSeek 三源自動校驗:證實 3 條(DeepSeek 無費率無生效日/OpenRouter 目錄約 400 而非千級/漲價僅屬模糊預告)、分歧 1 條(V4-Flash 單日 8 兆 token——已升級 sol 裁決,由 OpenCode 一手儀表板推翻,見上)、補充 1 條(Opus 4.1 於 08-05 退役,補前一份報告之遺)。
- Perplexity:本次自動査證成功(Deep Research 未啓用,用 Search 檔)。返回結果與一手定價頁完全吻合(正價數字逐項對上),並獨立佐證「無最終費率、無生效日」。查完即關閉分頁。
- 🔬 本地模型參考(Gemma,離線·不計入共識):本次未跑(本地推理服務未啓動),按流程跳過。
- ⚠
方法坑更正——上週歸因錯了:游標中記載「三家網頁輸入框靜默吞掉超長提示,閾値約
>400 字符,眞正變量是長度」。本次實測推翻該歸因:148
字符與 47 字符的提示同樣被靜默吞掉,而同一個 47
字符提示改用座標點擊輸入框後一次成功。眞正變量是點擊方式,不是提示長度——用
find返回的ref點擊 Perplexity 的 contenteditable 輸入框不會真正取得焦點(無報錯、無回顯,最易誤判為「站點改版」或「提示太長」);改用座標直接點擊即正常。此坑已寫回游標。 - 成本備註:本次按量支出約 $0.53,高於常態的「幾分錢到三五毛」區間,單一驅動因素是那條分歧的 sol 裁決($0.45,觸發 8 次聯網搜索)。terra $0.076(5 次搜索)、DeepSeek $0.008。判斷:為推翻一個已在聚合媒體流傳的假數字,這 $0.45 花得値;但若某週分歧條目增多,應先壓縮裁決問題的範圍,而非逐條升級 sol。
- 一則工具契約觀察:DeepSeek 走
:online時,響應usage中的server_tool_use_details.web_search_requests欄位缺失(GPT 兩路均正常返回 5/8)。但其回答帶有時效性一手引註(引到 08-02 的文章),故判定實際有聯網、僅計數欄位未回填。此路本次計入共識,但該欄位不可作為 DeepSeek 是否聯網的判據——下週覆核是否穩定如此。