工具情報 · 2026 年第 27 週
本機巡檢 · 覆蓋過去一週(2026-06-22 — 06-29)· Max 訂閱零計費 · 承重項經 Perplexity 第二源校驗
🔧 版本更新(可升級)
本週對約 45 個 GitHub releases.atom 與 4 個核心 HF
模型卡逐一巡檢。窗口內(過去 7
天)出現的條目均為已報版本或滾動 dev/nightly
標籤,無新穩定版發布:
- Syncthing
v2.1.2-rc.3 / rc.4、3X-UIv3.4.0 / v3.4.1、goldendict-ng 每日構建、sherpa-onnx 的 ASR 模型資產(qnn-2)、pyannote.audio4.0.5—— 均在上週去重游標內,本週無新動作。 - 核心 HF 模型(吠陀 TrOCR、whisper-medium-sanskrit、gemma-2-mitra-it、Sanskrit_TTS)本週均無新 commit。
本週無顯著版本動態,無「可升級」項。
☁️ 雲端 AI / API 動態
- DeepSeek — 本週無新模型;V4 Flash / V4 Pro
定價未變,夜間 off-peak 折扣自 2025-09
取消後未恢復;
deepseek-chat / deepseek-reasoner仍定於 2026-07-24 棄用(沿用已報)。pricing - Anthropic / Claude — 出口管制部分鬆動:6 月底美方批准 Mythos 5 向約 100 家美國關鍵基礎設施機構重新部署,Fable 5 通用開放仍待批;對訂閱模型路由無實際影響(最高仍 Opus 4.8)。news ✓Perplexity 證實(多源 6/26–27)
- OpenRouter — 新增 Z.ai GLM 5.2(約 6/17 上架),被 Artificial Analysis Intelligence Index v4.1 列為開源權重第一(領先 MiniMax-M3、DeepSeek V4 Pro);可作 DeepSeek 之外的廉價開源校驗候選源。openrouter ✓Perplexity 證實
- Google Gemini / Antigravity(僅讀公開新聞,未碰任何 API)— 本週無新模型;Antigravity CLI 6 月起對所有人開放(Gemini CLI 已停服 AI Pro/免費層,沿用已報)。blog
- 免費 GPU 平台 — Kaggle 傳「可綁定 Colab Pro 訂閱提升每週 GPU 配額」一說,⚠Perplexity 未查到官方文檔佐證,列單源待核;Modal($30/月免費額度)、百度 AI Studio(每日 8 張算力卡)本週無顯著政策變動。kaggle
- Azure Document Intelligence — 三個 preview API 按計劃 2026-06-30 退役、遷 v4.0 GA(已報);另傳「DI 併入 Foundry Content Understanding、自定義字段抽取支持 GPT-5.x」,⚠Perplexity 認為缺官方佐證、偏路線圖傳聞,列待核。what's-new
⭐ 更優替代掃描
- 梵語 OCR / 梵語後校:本週無更優替代。
- 天城體 VLM / 密集 OCR:候選 — baidu/Unlimited-OCR(3B MoE,~500M 激活;恆定 KV cache 一次前向解析數十頁長文檔,自稱 OmniDocBench v1.6 達 93.92% SOTA、高 DeepSeek-OCR 約 6 分)。⚠Perplexity 未能佐證該具體分數;賣點在長文檔吞吐而非天城體精度,卡片未列語種,列待驗 —— 須拿密集天城體頁實測連字與變音符(潛在用途:取代「分頁 + 逐塊送 OCR」的長作業)。HF arXiv
- 梵語 ASR / 梵語 NLP·MT / 梵語 TTS / 巴利 TTS / 藏語 TTS:本週均無更優替代。
- 音源分離 / 去噪 / 強制對齊:嚴格窗口內無;兩項窗口外但證據紮實的候選列入後續實測 ——
🏛 IE 文獻學新工具/資源(更廣範圍)
- Chandra 2(Datalab,2026-03) — 4B VLM OCR,olmOCR-bench 85.9%(SOTA);本輪最大增益在南亞婆羅米系文字(Kannada +42.6 / Malayalam +46.2 / Telugu +39.1 / Tamil +26.9 / Bengali +27.2)。相關性:天城體/印度語系掃描件可作第二視覺源。⚠Perplexity 未查到量化基準佐證,列待驗。HF
- Dharmamitra 平台升級(2026-05-11) — 新增 folio 級「Segment View」逐段研究視圖;藏文數據擴至 1400 萬+段(Kangyur/Tengyur 換 Derge/Esukhia);整合日譯大正藏與國訳一切経。相關性:直接惠及梵藏漢巴跨語檢索與翻譯接力鏈。news
- MITRA Explore(2026-04,取代 MITRA Search) — 帶文本摘要與過濾的探索界面,庫擴充藏文(Rinchen Terdzö 等)及經 Kanripo 合作的漢語典籍。相關性:語義檢索的召回審査層改善。同上
- MUDIDI(arXiv:2606.09435,2026-06-08) — 多語詞典數字化兩階段框架(先評字符/標記質量,再切詞條進 SIL Multi-Dictionary Formatter 機讀模式),附 30 部公版詞典數據集。相關性:詞典 MDX 化/結構化的詞條切分 schema 與 OCR 基準可直接對標(須查全文確認是否含 Indic 詞典)。arXiv
- Three Buddhist Vocabularies(arXiv:2606.25372,2026-06) — 英譯巴利三藏(經/律/論)的計算文體學分析。相關性:巴利語料文體量化方法,可借鑒於同源教材與譯本評估。arXiv
- Scaife Viewer 重大更新(Perseus,2026-04-27) — 所有希臘/拉丁文本上線詞典 widget,並落地形態學工具與分作者註疏。相關性:古典 IE 語「逐詞查詞典 + 形態」的對應方案,可參考其閱讀器交互。update
- Transkribus「Titan I bis」通用 HTR 超級模型(2026-04) — 印刷+手寫、歷史+現代平衡訓練,中世紀拉丁寫本評測領先(需訂閱)。相關性:拉丁/希臘古寫本一站式 HTR,可作 eScriptorium 自訓路線的對照基線。transkribus
- IE 比較語言學工具(音變重建/同源詞檢測/詞源庫 Leiden IEED·LIV·TITUS):本窗口無新發現。
📋 清單變動
- 輕掃工作區近期文件,未見監看清單(§3)以外的新在用工具。本週無清單變動(上週新增的 WeNet / 吳語 ASR 工作已在游標內)。
🔎 第二源校驗小結
- 自動校驗經專供瀏覽器執行。Perplexity(Pro)成功取回並逐條核查
6 個承重項:
- 證實 2 條 —— OpenRouter 上 GLM 5.2 為開源權重第一;Anthropic Mythos 5 獲批向約 100 家機構部署。
- 存疑 / 未核 4 條 —— Kaggle×Colab Pro 綁定提配額、Azure DI 併入 Content Understanding、baidu/Unlimited-OCR 的 93.92% 分數、Chandra 2 南亞文字增益(均缺官方或基準佐證,正文已逐條標「待核 / 待驗」)。
- Gemini(Pro)返回空白未取回(疑長 prompt deflect);DeepSeek 本週未跑。三家 AI panel 僅 Perplexity 完成 —— 故承重項以 Perplexity + 抓取階段多源交叉為準,未達三源者已逐條標記,請人工複核時優先盯「待核 / 待驗」四項。