工具情報 · 2026 年第 33 週
本機巡檢 · 覆蓋 08-07 → 08-14 · 承重項經 GPT/Gemini/DeepSeek 三源自動校驗 + Perplexity 自動査證 + 官方頁一手覆核
本週頭條:DeepSeek 連續五週懸而未決的漲價,終於有了費率表與生效日——08-16 16:00 UTC。且真正的漲幅重心不在輸出,在緩存命中價(Pro 檔最高 12 倍)。
🔧 版本更新(可升級)
- pandoc 3.10.2(08-12 發行)— 本機安裝落後於當前發行線,建議升級。✓雙源證實(GitHub 發行 API + 本機 CLI 版本核對,兩邊一致)release
- mlx-vlm v0.6.13(08-12,另有 v0.6.12 於 08-10)— 本地視覺語言推理庫一週連發兩版;本機安裝仍停在較舊發行線,建議補升。✓雙源證實(releases.atom + 本機 pip 核對)release
- Ollama v0.32.7 → v0.32.11(08-10 至 08-13,一週五個正式版)— 其中 v0.32.10 修正「本機缺 MLX 時仍去拉取 MLX 模型」的行為,對純 Apple Silicon 環境有實際意義。release
- sherpa-onnx v1.13.5(08-11)— 語音推理框架小版本迭代(同期的 v1.13.4 已在前次報告記錄,去重命中不重列)。release
- llama.cpp b10411–b10423(08-13 批次)— 逐次提交式自動發行,無獨立的量化格式或蘋果晶片優化公告,屬常規流水,不必逐個跟進。releases
- pinyin-pro 3.29.0 / 3.29.1(08-13)、esbuild v0.28.2(08-08)— 前端與漢語拼音工具鏈常規更新。pinyin-pro / esbuild
延續未清的升級積壓:Surya OCR 本機安裝仍落後當前發行線(最新 v0.22.1,發行於 07-20),本週該倉庫無新發行,積壓狀態不變,建議與上面兩項一併補升。
兩則需要克制的噪音:GoldenDict-ng 與 3x-ui 本週的新增條目分別是每日構建與 dev build,非正式發行,不建議跟進。MinerU 穩定線本週未動——當前最新穩定發行仍是 07-10 的 3.4.4,4.0 線自 07-14 起連出五個 alpha 但一個都未轉正,不建議上生產。
取源覆核:前次報告記錄的 CosyVoice
releases.atom 取源失敗(返回 0
字節),本次重抓正常,屬瞬時故障,已排除。
☁️ 雲端 AI / API 動態
🔴 DeepSeek 漲價落地:08-16 16:00 UTC 生效,費率表已公佈 — 連續五週「已宣告但費率表上看不到」的分歧形態,本週終結。官方定價頁現已直接掛出峰谷雙軌費率:峰時 01:00–04:00、06:00–10:00 UTC(UTC+7 時區對應 08:00–11:00、13:00–17:00),其餘為谷時,谷時價為峰時價的一半。官方定價頁 ✓四源證實(官方頁一手 + GPT + Gemini + Perplexity,四者數字逐項對上)
每百萬 token 現行 谷時(漲幅) 峰時(漲幅) V4-Flash 緩存命中 $0.0028 $0.007(2.5×) $0.014(5×) V4-Flash 未命中 $0.14 $0.22(1.6×) $0.44(3.1×) V4-Flash 輸出 $0.28 $0.66(2.4×) $1.32(4.7×) V4-Pro 緩存命中 $0.003625 $0.022(6.1×) $0.044(12.1×) V4-Pro 未命中 $0.435 $0.66(1.5×) $1.32(3.0×) V4-Pro 輸出 $0.87 $1.98(2.3×) $3.96(4.6×) 兩個容易被忽略的要點:①谷時也是漲價,不是維持原價——輸出價即使避開峰時仍為現行的 2.3–2.4 倍,「排到谷時跑就沒事」是錯誤理解;②漲幅最大的是緩存命中價,不是輸出價——Pro 檔緩存命中漲 6.1(谷時)到 12.1 倍(峰時),遠超輸出的 2.3–4.6 倍。凡是靠提示緩存反覆重跑同一批前綴的批量管線(詞典逐條翻譯、校對重跑),成本結構會被這一項改寫得最厲害,重排期程時應優先算這一格而非輸出格。
✅ Anthropic:Sonnet 5 的 $2/$10 促銷價轉為永久定價,原定 09-01 調漲至 $3/$15 的計劃取消 — 官方定價頁現載明該調漲「will not occur」。官方定價頁 ✓四源證實
✅ 更正前次報告:Opus 4.1 的官方遷移目標是
claude-opus-4-8,不是 Opus 5 — 直接査官方停用文檔的遷移對照表,「Recommended replacement」欄明確寫claude-opus-4-8。前次報告寫「官方建議遷移至 Opus 5」係誤記,凡據此改過腳本硬編碼模型名者需覆核。官方停用文檔 ✓官方頁一手(本條也是三路分歧項:GPT 答 4.8、Gemini 答「兩者皆可」、DeepSeek 答無法核實——由官方頁裁決,Gemini 的「兩者皆可」無據)🆕 Google 發布 Gemini 3.7 Flash(08-13) — 導入價 $0.75/$3.75(每百萬,輸入/輸出,promo 至 2026 年底),約為上代腰斬;距 3.6 Flash 僅三週。Gemini 3.5 Pro 仍延遲未發布——Pro 檔連續數週無新代,Flash 檔卻已迭代兩輪。官方博客 ✓三源證實(官方博客 + Perplexity + GPT)
DeepSeek 悄悄換了 Pro 檔的模型版本:
DeepSeek-V4-Pro-0813— 官方定價頁的「MODEL VERSION」欄現列 V4-Pro-0813、V4-Flash-0731。這是模型修訂版更替,非新產品線;但 Gemini 一路把它報成「08-13 全新發布 V4-Pro 旗艦模型」,屬過度解讀,記此以免下週被當成新模型重複收錄。官方定價頁 ✓官方頁一手査證用三檔位(terra/sol/luna)本週無變動 — 直接査目錄 API(一手):terra $1/$6、sol $5/$30、luna $0.10/$0.60,與前次報告完全一致,路由無需改動。⚠一則需留意的分歧:頁面現標「50% off」字樣,而 Gemini 與 DeepSeek 兩路均引述「07-30 官方永久降價後基準價為 terra $2/$12、luna $0.20/$1.20」。若該說法屬實,則目錄現價係折扣態而非常態,促銷結束後實付可能翻倍。三路均查不到促銷起訖日,判定為未決,建議把「目錄價可能非常態」納入成本估算的不確定項。目錄 API
Kaggle / Modal / 百度 AI Studio / Azure Document Intelligence — 本週無顯著動態。 Azure DI 的 v2.0 API 將於 08-31 終止支援,但該公告發於 2023-09,只是到期日恰落在月底,非本週新事件。百度 AI Studio 2026 年 8 月的公告原文本次未能取得(搜索僅回 2019–2024 舊資料),標未能査證。
🆕 新模型雷達(査證/深度研究 + 特別亮眼)
- Grok 4.6(xAI)— Artificial Analysis 質量指數 60.9 排第三,緊追 Claude Opus 5(63.0)與 Fable 5(62.1);Agentic 指數與 Opus 5 幾乎打平。目錄價 $2/$6。屬「值得知道存在」而非「該立刻換用」——質量檔位夠格但無碾壓級突破。arena.ai 更新日誌 ⚠雙源但有保留:AA 官網為 JS 渲染頁,分數係經兩個第三方鏡像站互相印證,未取得官網原始數字
- Gemini 3.7 Flash(Google)— 見上節。定位快速代理/編程,可能適合作 escalate-on-evidence 管線裡便宜的 Layer A 篩選層候選。⚠具體 Elo/跑分位置未明,僅發布事實為雙源。
- 附帶一則與査證用途直接相關的發現(非新模型):OpenRouter 於 08-11 上線 Live Web Search Benchmarks 跑分頁(BrowseComp / DeepSearchQA / HLE / WideSearch),替「模型 × 搜索引擎 × 輪數」的組合配置打分而非單模型。當前 BrowseComp 最優配置為 Perplexity 引擎 + Claude Opus 5 (high) + 25 輪,準確率 89.0%,單題成本 $0.99。這對現行四路交叉査證陣容的選型有直接參考價值。benchmarks
- 一則需寫回的事實更正:LMArena 已改名
arena.ai,
lmarena.ai現為轉址。監看清單與各處引用該站的記述應同步更新。 - 與「査證/深度研究」門檻直接相關的新模型:本週沒有。 未查到任何本週新上線、專門主打網頁搜尋/agentic search 的模型。DeepSeek、Google、xAI 本週的動作都是通用旗艦更新。
- 未達門檻、明確排除者:ByteDance Seed 2.1 Turbo、Qwen3.8 2.4T A95B、NVIDIA Nemotron 3.5 Lightning、Sakana Namazu、Upstage Solar Pro 4、Meta Muse Glimmer 30B(均僅單一來源、無獨立跑分佐證);Kimi K3、Qwen3.8-Max(發布日落在本週窗口外)。
⭐ 更優替代掃描
- 本週六個類別均無更優替代。 梵語 OCR、天城體 VLM/密集 OCR、梵語/巴利/藏語 TTS、梵語 ASR、梵語 NLP/MT、音源分離/去噪/對齊——逐一重掃 HF daily papers(08-07 至 08-14 逐日)、HF models 搜尋 API(各類關鍵詞)、arXiv 與 GitHub trending,無一符合「有可核證據 + 確為本週新出」的雙重門檻。查到的相關條目要麼是個人微調碎片(無跑分報告),要麼發布日落在窗口外(Vāgdhenu 06-29、Devanagari OCR-VLM 評測論文 06-28、Qwen3-ForcedAligner 06-26、MSST 統一訓練框架 07 月底)。
- ⚠
本次掃描撞到並糾正了一個方法坑,值得寫回:HuggingFace
API 的
lastModified欄位不能當「新發布日期」用——它會被任何檔案微調刷新(加量化版、改 README、補評測元數據)。本次 PaddleOCR-VL-1.6 的lastModified落在 08-08,看起來像本週新品,但進 README 的 News 欄核對,實際首發是 2026-05-28。判「是否本週新出」必須進模型卡正文核首發日,不能只看 API 欄位,否則會把幾個月前的舊模型誤判成新發現。
🖥 本機 AI 模型全景監看
層一·別落後
- 清單內各模型倉庫本週無新權重。 逐一查 HF
lastModified:吠陀 TrOCR、藏文 Tesseract 包、MITRA、Sanskrit_TTS、Indic Parler-TTS、Vāgdhenu、Thai TrOCR、各 whisper 系列、gemma-4 系列、Qwen 系列量化版——全部無本週更新。 - PaddleOCR-VL-1.6 本週有 commits,但不是新權重 — 08-04 至 08-08 的三次提交內容為補上 Real5-OmniDocBench 評測結果元數據。自報分數:整體 93.19,其中掃描件 94.74、彎曲頁面 92.48、屏攝 92.78、光照不均 93.28、傾斜 92.66。⚠ 這是廠商自報、掛在自家榜單上的數字,非獨立測評,且該評測集本身也由同一廠商發布——作為「值得實測一輪」的線索可以,作為選型依據不可。eval 元數據
- 🆕 持續追蹤項有進展:
gemma4架構的圖像輸入支持 — Ollama 倉庫於 08-10 開出 PR「mlx: add Gemma4 image input support」(#17650),目前仍為 open 未合併。相關的 issue #17065(「MLX 視覺模型收不到圖像」,涵蓋 Gemma 4 12B 與 Qwen3.5 4B)亦仍 open。缺陷未修復,但這是連續多週追蹤以來第一次出現針對性的修復提交,下週值得覆核是否合併。PR #17650
層二·別停滯(本週四個新發現,均經 HF API 實測核實存在)
- LiquidAI/LFM2.5-VL-3B(視覺語言)— 31.2 億參數 BF16,官方模型卡實測 Apple M5 Max 上 228 tok/s、內存佔用低於 3.3GB,支持整頁 OCR 加版面標注、32K 上下文;官方已出 MLX 8bit 量化版。比清單上現有的 8B 級解限 VLM 更輕更快,適合作快速篩選/前置層。link
- CohereLabs/North-Micro-Vision-Instruct(視覺語言)—
08-10 至 08-12 發布,Apache 2.0,總參數 24 億(語言 20 億 + SigLIP2
SO400M 視覺編碼器 4 億),原生解析度處理,模型卡列明支持
OCR/圖表/文檔理解;
mlx-community已備齊 4/5/6/8bit 與 mxfp4/mxfp8/nvfp4 量化系列。屬清單上完全空白的「超輕量視覺語言」類別。link - WPS-Qingqiu/Qingqiu-MT-9B(翻譯)— 08-12 發布,基於 Qwen3.5-9B 微調,Apache 2.0,面向 WMT26 通用機器翻譯賽道,模型卡確認支持泰語。清單上翻譯類目前只有梵/巴利向的 MITRA,此模型可補泰語方向一個本機候選。⚠ 模型卡自報「勝過 DeepSeek-v4-flash」係作者用 GLM-5 當裁判的自評,未經獨立測量,不構成結論。link
- zai-org/GLM-OCR(OCR,⚠ 非本週新品)— 基座發布於 2026-01-30,但本週(08-11)社群才出現 GGUF/8bit 量化版。仍值得記一筆的理由:僅 13.25 億參數,OmniDocBench V1.5 官方自報 94.62 分居首,且其管線本身就調用清單上已有的 PP-DocLayout-V3 做版面分析——與現有工具鏈高度契合,屬之前完全不在雷達上的可能性。link
- ASR / TTS / 嵌入三類本週無新發現(最新上傳絕大多數是零讚的方言微調碎片);MLX / llama.cpp 框架層本週亦無重大更新(mlx 最新 v0.32.0 發於 07-07,落在窗口外;llama.cpp 僅有逐次提交的自動發行)。
🏛 IE 文獻學新工具/資源(更廣範圍)
OCR & 寫本數字化
- Kraken 7.1 — 開源 ATR 引擎大版本更新,改用基於 PP-OCRv6 的新識別架構並附多語預訓練基座。Kraken 搭配 eScriptorium 是希臘語、拉丁語及其他歷史非拉丁字體的標準開源管線,換識別骨幹會廣泛影響準確率。link(2026-08-05)
- Interpres-Parallel-Corpus / "When Simpler Is Better" — 1,383 組對齊的寫本圖像+轉錄+專家譯文,首個中世紀拉丁語 OCR+翻譯的同類資源;論文並發現專用 OCR 模型直接餵給 VLM,勝過更複雜的 RAG/後校正管線——這個結論對現行「版面分析→分塊 OCR→校對」的架構取捨有直接參考價值。arXiv:2607.03836(2026-07-04)
- Electronic Babylonian Library 自動符號檢測(Deformable DETR)— 8.7 萬塊泥板碎片、約 290 萬個符號檢測的大規模楔形文字數據集與端到端管線。屬阿卡德/蘇美爾楔形文字,非赫梯語本身,但符號庫與工具鏈重疊,對赫梯學及楔形文字鄰接的 IE 文獻學直接相關。arXiv:2606.22608(2026-06-21)
- ICDAR 2026 HIPE-OCRepair 競賽 — LLM 輔助 OCR 後校正的多語基準與共享任務(英/法/德,17–20 世紀報刊書籍),附數據集與評測工具。對處理舊德文/法文二手學術文獻的 OCR 清理有用。arXiv:2607.08143(2026-07-09)
- Transkribus Text Titan II — 新一代通用轉錄模型,訓練語料逾 2.5 億詞,覆蓋拉丁字母各主要語言的印刷體與手寫體,官方稱較前代平均降低字符錯誤率約 47%。官方同時明言:對特殊書寫體、歷史手寫體及覆蓋範圍外語言,專用模型仍優於通用模型——這一自我限縮的説明本身值得記,凡考慮以通用模型替換專用管線者應據此收斂預期。官方博客(2026-06-25)
- VedOCR — 針對吠陀梵語寫本的專家標注 OCR 數據集加微調 TrOCR 基線:57 頁專家標注寫本、681 行級轉錄、41,286 個字符實例、87 種獨立字形類別;微調後字符錯誤率自 75.74% 降至 48.89%。⚠ 數據集與檢查點均標明「錄用後釋出」(目標為 2026 年 9 月維也納 DALL Workshop @ ICDAR),目前尚未實際可用。但這是窗口內唯一直接針對吠陀天城體寫本的新資源,值得盯後續釋出。GitHub(倉庫建於 2026-06-29,最近更新 2026-07-23)
數據集 & 開放資源
AthDGC(Athens-PROIEL)v0.4.0 — 首個開放授權、跨八個歷時階段(古風期至現代)的希臘語依存樹庫,統一於 PROIEL XML 2.0,並提供與拉丁語(Vulgate)、哥特語(Wulfila)、古教會斯拉夫語、古典亞美尼亞語的逐節對齊——這使它不只是希臘語樹庫,而是一個真正的比較印歐語計算資源。Apache 2.0。arXiv:2606.15510 / Zenodo(2026-05-29 發布,論文 06-13)
Naamah — 大規模合成梵語命名實體識別語料(102,942 句),經 DBpedia 實體播種+LLM 生成構建,以 XLM-RoBERTa/IndicBERTv2 評測。填補古典梵語 NER 標註訓練數據的實際空缺。HF dataset(arXiv:2604.26456,2026-04-29)
DiPiKA 計劃(Hill Museum & Manuscript Library)— 喀拉拉邦中部 10 個私人寫本收藏新數字化上線(100+ 部,梵語/馬拉雅拉姆語/普拉克里特語,貝葉與紙本,涵蓋吠陀儀軌、語法、戲劇、占星)。新的一手寫本材料。link(2026-04-23)
古希臘校勘本結構感知文字識別 — 18.5 萬張 TEI/XML 衍生的合成頁面圖像,加一組真實掃描校勘本的人工基準,供古希臘校勘本 OCR 訓練。arXiv:2603.02803(2026-03-03,v3 於 06-16)
Ericu950/AncientGreek 大型古希臘語語料庫 — 約 3.61 億詞、210 萬條記錄、2.2GB,分「純淨版」(40.8 萬條)與「LLM 修復版」(174 萬條)兩層。製作方式比規模更值得注意:用針對複調希臘語微調的視覺語言模型重新 OCR 原始頁面圖像(不依賴既有文本層),再做去連字、變音符恢復與糾錯,且對不確定內容選擇丟棄而非硬猜——這與「失敗必須可見、產出寧少勿假」的管線設計原則同構,是一個可借鑑的先例。HF dataset(HF lastModified 2026-08-03)
cvalore/ancient-greek-ds-fim — 面向「中間填空」訓練範式的古希臘語數據集(約 36,500 條,prefix/固定 5 字符缺口/suffix 三段式),取材希羅多德、德摩斯梯尼等。用途指向殘缺紙草的缺字復原(同 DeepMind Ithaca 思路)。⚠ 頁面無關聯論文或模型,屬單薄的個人發布,僅記存在。HF dataset(HF lastModified 2026-07-06)
數字人文 & 語料工具
- ⭐ Prasthanatrayi 詞級數字閱讀器(附商羯羅疏) — 面向奧義書三經與商羯羅注疏的詞級點擊式閱讀界面,提供即時詞彙切分、語法信息與釋義;基於 36,881 個詞級標注實例(2,971 個文本單元)與 95,587 詞的注疏詞典,CC-BY-4.0,以單一 HTML 文件離線分發、無需服務器。這是本期與現有 Reader 架構(逐詞語法逆查)最直接可對照的一條:同樣的問題、明顯不同的分發取捨(單文件 vs 服務端查詢),值得作為架構參照讀一遍。arXiv:2607.07282(2026-07-08)
- LatinCy
新增古希臘語依存句法模型組(grc_dep_web:trf/lg/md/sm 四檔) —
LatinCy/CLTK 項目首次跨出拉丁語,基於 UD
古希臘語樹庫(PTNK、PROIEL、Perseus)訓練,骨幹為
PhilBerta,支持分句、詞性標注、形態分析、詞形還原與依存分析。⚠ 依據為 HF
lastModified(2026-08-04),首發日未獨立核實——按本週剛寫回的教訓,該欄位可能只是檔案微調,標待核。HF - Perseus Digital Library(Scaife Viewer) — 新增詞典掛件(希臘語自動選 LSJ、拉丁語選 Lewis & Short)、初步整合評註(Jebb 注索福克勒斯)、界面改版預覽,並遷移至 Tufts IT 基礎設施。link(2026-04-27)
IE 比較語言學工具
- "Beyond cognacy"(Gerhard Jäger)v3 — 系統發生學中以自動同源詞聚類替代專家編碼同源詞集的方法(跨 974 種語言、15 個語系)。v3 是實質性修訂:修掉了零模型目標函數的符號錯誤、T-Coffee 實現缺陷,以及一個已退化成「符號同一性匹配」的 pair-HMM 驗證目標。arXiv:2507.03005(v3 於 2026-08-07;原 v1 為 2025-07-02,僅修訂版屬新)
- A Pāṇinian Foundation for Indic Language Processing — 立場/基準提案論文(非可用工具,無代碼與數據集),主張以《八篇書》作為印度語言 NLP 的統一計算架構,提出四部分基準套件。作為研究方向記錄。arXiv:2606.24172(2026-06-23)
明確查空、不列入者:GRETIL、TITUS、SARIT、Logeion 均無可核實的 2026 年更新(「Logeion」的 2026 命中實為同名語言學習應用與一份荷蘭公關業趨勢報告,非芝加哥大學的希臘/拉丁詞典工具);eScriptorium 最近發行為 2026 年 2 月與 4 月,窗口內無新版;Fraktur/哥特體無新模型;阿維斯陀/古波斯楔形文字 OCR 僅見無日期的業餘 GitHub 項目;無新的萊頓印歐詞源詞典分冊,LIV 亦無更新;無確認的赫梯語/古伊朗語 NLP 工具在窗口內發布(TLHdig 最近版本可追至 2025 年秋,1.0 仍僅為「預期」)。
一則值得記下的窗口外資源(因早於窗口不計入本期,但此前各期均未報過,恐永久漏掉):IE-CoR(Indo-European Cognate Relationships)——涵蓋 160 種印歐語言、4,981 個同源詞集的關係型數據庫,89 位歷史語言學家參與編纂,發布於 2025 年 9 月。這是比較印歐語言學方向規模最大的公開數據庫之一,比本期任何一條都更值得一看。
📋 清單變動
- 無新發現在用工具。
- 一則清單本身需要修訂:監看清單記載的 LMArena 已改名 arena.ai,舊域名現為轉址;另 pandoc 未列入規格書 §3,但每週實際都在核對其本機版本,建議正式補入清單以免記述與實作脫節。
- 延續未辦事項(連續多週停留在「建議補入」狀態,§3 本體仍未動):mlx-audio、Qwen3-ASR/Qwen3-TTS 系列、VedOCR、F5-TTS-THAI、indic-parler-tts、Unlimited-OCR 基座及其 MLX 移植、Vāgdhenu。本週又新增四個層二候選(LFM2.5-VL-3B、North-Micro-Vision-Instruct、Qingqiu-MT-9B、GLM-OCR)。積壓已達十餘項;不落檔,每週的替代掃描與版本巡檢都繞不到它們,這個缺口正在逐週擴大。
🔎 第二源校驗小結
- GPT/Gemini/DeepSeek 三源自動校驗:證實
3 條(DeepSeek 峰谷費率與生效日/Sonnet 5
定價永久化/Gemini 3.7 Flash 發布)、分歧 2 條、補充
1 條(DeepSeek Pro 檔模型版本更替為
0813)。三路均正常返回,無需降級。
- 分歧一(已裁決):Opus 4.1 的官方遷移目標。 GPT 答
claude-opus-4-8、Gemini 答「4.8 與 Opus 5 皆可」、DeepSeek 答無法核實。由官方停用文檔一手裁決為claude-opus-4-8,Gemini 的「皆可」無據。此條同時更正了前次報告的誤記。 - 分歧二(未決,留作不確定項):OpenRouter 三檔位的「50% off」是折扣態還是常態。 見雲端節。
- 分歧一(已裁決):Opus 4.1 的官方遷移目標。 GPT 答
- ⚠ 一個方法層面的重要發現:DeepSeek 這一路的
:online掛網疑似未生效。 響應的usage對象中完全沒有server_tool_use_details.web_search_requests欄位(GPT 同批請求則正常回報 12 次搜索),且其引用的來源全部停留在 08-03/08-06 的二手聚合站,對 08-13 才更新的官方頁面一無所知——因而在三個實際屬實的條目上答出「CANNOT VERIFY」。這正是規格預設要防的坑:把「搜不到」誤記成一票有效的「查無此事」。 本週因有官方頁一手覆核未受影響,但下週起 DeepSeek 這一路的:online有效性需要單獨確認,在確認前其否定性答覆不應計入共識票。 - Perplexity:本次自動査證成功(Search
檔,Kimi K3
Thinking)。獨立確認三條承重項,費率表數字與官方頁逐格對上,並額外給出峰時的本地時區換算。沿用前次寫回游標的坑位知識——用座標直接點擊輸入框而非
ref點擊——一次成功,未再遇靜默吞提示。查完即關閉分頁。 - 🔬 本地模型參考(Gemma,離線·不計入共識):本次未跑——本地推理服務未在運行,按既定流程跳過,不影響其餘校驗。(連續兩週未跑,若要恢復這一路的觀察價值,需要讓該服務常駐。)
- 承重項覆核方式的一點記錄:本週三路之外,對兩個關鍵分歧項(DeepSeek 費率、Opus 遷移目標)與一個價格項(三檔位目錄價)直接抓取了官方頁面與目錄 API 作一手覆核。三個一手核查全部推翻或收窄了 AI 路的說法(DeepSeek 一路的否定被推翻、Gemini 一路的「皆可」與「V4-Pro 新發布」被推翻、目錄價確認未變)。在有一手源可抓的情況下,直接抓一手仍然比增加 AI 票數更有效。