AI·IT·免費資源 · 2026 年第 34 週
本機巡檢 · 免費優惠經 GPT/Gemini/DeepSeek 三源聯網核眞 · Perplexity 優先自動、卡住才附人工清單
💰 免費資源 & 優惠雷達
Cloudflare Workers AI —— 付費牆再吞兩個模型,但新上架的 Qwen3.8-27B 留在免費計劃內 — 官方定價頁「須付費方式」名單由上週的三個增至五個:
kimi-k2.6、kimi-k2.7-code、glm-5.2,本週新增deepseek-v4-flash-0731與deepseek-v4-pro-0813(2026-08-14 上架即列爲付費專屬),須 Workers Paid 計劃(最低 $5/月)或預付 AI Gateway 額度。好消息在另一邊:2026-08-17 上架的@cf/qwen/qwen3.8-27b(27B 視覺語言模型,262,144 token 上下文)不在付費名單上,免費計劃每日 10,000 Neurons 可直接調用一個能讀圖的 27B 模型。白嫖路徑:註冊 Workers 免費計劃即得每日 10,000 Neurons(UTC 00:00 重置),超出按 $0.011/千 Neurons 計費。時效:長期,但免費/付費名單已連續兩週變動,屬高波動項。對 OCR/文獻數字化用途的相關性:可作版面理解與圖文問答的零成本備援通道,惟每日額度有限,不適合走量。綁卡提醒:免費計劃本身不需綁卡;調用付費名單上的模型會被直接拒絕,不會靜默扣費。link ✓三源證實OpenRouter 有 3 個「$0 定價」的嵌入模型,且本週剛添一個新的 — 直讀專用端點
/api/v1/embeddings/models(2026-08-21)得 33 個嵌入模型,其中定價爲 0 的三個是:liquid/lfm-2.5-embedding-350m:free(canonical slug 標註20260818,本週新上架)、nvidia/nemotron-3-embed-1b:free、nvidia/llama-nemotron-embed-vl-1b-v2:free(視覺語言嵌入,可對圖像建索引)。同一目錄下baai/bge-m3定價 $0.00000001/token,即約 $0.01/百萬 token——對照自託管的電費與維護成本,這個價位讓「託管 bge-m3」重新成爲一個値得算賬的選項。白嫖路徑:餘額 $0 即可調用三個:free嵌入模型,不需綁卡。時效:長期,但免費池成員每週增刪,不可寫進生產管線。對向量檢索/語義搜索用途的相關性:直接關係到參考書語義檢索與 RAG 這條線,尤其那個視覺語言嵌入模型,對「掃描頁直接建索引、跳過 OCR」這種思路是個可試的新工具。link ✓三源證實⚠️ 方法論更正(更正的是本週自己,不是上週) — 本週初查時直讀
/api/v1/models端點,搜遍 419 個模型 id 找不到任何含embed/rerank者,一度準備寫成「OpenRouter 根本不提供嵌入模型、上週記載有誤」。交叉查證的兩路(GPT 與 Gemini)同時指出這個測試方法無效:/api/v1/models默認只返回文本輸出模型,嵌入模型在/api/v1/embeddings/models這個獨立端點上。隨後直接請求該端點,證實兩路模型是對的、上週的記載本來就是對的,而本週那條「更正」纔是錯的,已撤回。⚠ 教訓:「在某個端點查無此物」不等於「該物不存在」——查無結果首先是對查詢方法的懷疑,其次纔是對事實的結論。這與既有的「AI 一致查無 ≠ 否證」是同一個坑的兩面。(附註:/api/v1/rerank/models實測返回 404,重排模型的正確入口尚未確定,不作結論。)OpenRouter 文本免費模型池 —— 本週 17 個,GLM-5.2 出現跨平台套利空間 — 直讀
/api/v1/models得全站 419 個模型中 17 個 id 以:free結尾(上週 18 個)。本週最値得注意的一項:z-ai/glm-5.2:free(256K 上下文)在 OpenRouter 是免費的,而同一個模型在 Cloudflare 剛被推進付費牆——同款模型兩個平台兩種價,可據此改道。其餘新增:cohere/north-mini-code:free(256K)、poolside/laguna-s-2.1:free與laguna-xs-2.1:free(各 262K)、dots-studio/dots-3-note-preview:free(512K 上下文且支持圖像輸入,本週免費池中上下文最長者)。持續在池的重點:nvidia/nemotron-3-ultra-550b-a55b:free(1M 上下文)、nvidia/nemotron-3.5-lightning:free(1M)、google/gemma-4-26b-a4b-it:free與gemma-4-31b-it:free(各 262K,支持圖像+視頻)、openai/gpt-oss-20b:free。白嫖路徑:餘額 $0 即可用,不需綁卡;限速約每分鐘 20 次、每日 200 次。時效:長期,但成員每週變動。對長文本文獻處理的相關性:512K/1M 上下文的免費模型適合整書級通讀與交叉比對。link ✓一手 API 實測Hugging Face 免費層的眞實數字 —— 三處與流傳版本不符,全部以官方頁爲準 — 官方文檔本週核出三項與聚合站說法的出入:① ZeroGPU 免費帳號每日配額是 5 分鐘(非流傳的 3.5 分鐘),未登錄 2 分鐘、PRO 40 分鐘(非流傳的 25 分鐘)、Team 40 分鐘、Enterprise 60 分鐘,配額自首次使用起滿 24 小時重置;② 背後硬件已換成 NVIDIA RTX Pro 6000 Blackwell(非此前記錄的 H200),默認
large檔=半張卡 48GB 顯存,xlarge=整張卡 96GB 但消耗雙倍配額;③ Inference Providers 額度免費每月 $0.10(官方原文註明 subject to change)、PRO $2.00、Team/Enterprise 每席位 $2.00——流傳的「每月 10 萬 credits」在官方表格中查無此數。另兩點實用細節:免費個人帳號可託管最多 2 個 ZeroGPU Space(需驗證郵箱且帳號滿 30 天);自帶供應商密鑰的請求不抵扣月度額度,只有經 HF 路由的纔算。白嫖路徑:註冊免費帳號即得,不需綁卡;額度用盡須主動購買纔能續用,不會自動扣費。link ✓三源證實(GPT 與官方頁一致;Gemini 的 3.5 分鐘說法已被官方頁否定)GitHub Copilot 學生版註冊暫停 —— 連續兩週的存疑本週結案:確實仍在暫停 — 官方學生包頁面現寫明「New plan sign-ups are temporarily paused」,官方文檔記載暫停自 2026-04-20 起,至今未宣佈恢復日期。學生包本體不受影響(JetBrains 全家桶、DigitalOcean $200、Azure $100、免費域名、100+ 夥伴工具、有效期約兩年)。⚠ 附一條可靠性觀察:上週某一路曾聲稱「6 月 17 日已恢復註冊」,本週同一路改口稱「仍暫停」——同一通道在兩週內對同一事實給出相反答案,而官方頁面兩週都寫着暫停。這條印證了既有紀律:承重的日期與狀態必須回一手頁面,模型的肯定性陳述本身不構成證據。時效:暫停中,無恢復日期。link ✓兩源證實+一手頁面
Modal $30 免費額度 —— 「$30」是官方的,「$1+$29 綁卡解鎖」不是 — 兩路核査結果分裂:官方定價頁確認 Starter 計劃含每月 $30 免費額度、每月重置不結轉,這部分兩路都認;但「註冊只給 $1、其餘 $29 須添加付款方式解鎖、外加 $0.50 驗證扣款」這一拆分結構,一路稱屬實、另一路明確表示在官方頁面找不到任何佐證。維持 ⚠分歧,按保守方向處理:在親自走一遍註冊流程確認之前,仍當作「拿滿 $30 須綁卡」對待。 時效:長期。綁卡提醒:⚠ 此條屬紅線關注形態——宣傳寫「$30 免費」,實得多少取決於是否留下支付憑證;額度用盡後是否自動轉按量計費本週未查證,綁卡前須自行確認。link ⚠分歧
騰訊雲國際站免費套餐 —— 內容確定,綁卡與 $610 代金券兩項均未證實 — 官方 Free Tier 頁確認的具體內容:Lighthouse(2 核 2G)3 個月、CVM S5(2 核 4G)3 個月、對象存儲 COS 50GB 6 個月、EdgeOne 14 天、Elasticsearch 1 個月、TRTC 每月 10,000 分鐘、彈性伸縮與數據萬象永久免費、騰訊混元 200 credits 一年。限該產品的新,此前買過或試用過同一產品即失去資格。⚠ 兩項未證實:① 綁卡要求——官方頁全文未提,一路稱「完整促銷須經需要綁卡的實名驗證」,另一路稱找不到任何權威頁面能證明全套無需信用卡,兩路都無法給出「不綁卡」的正面證據,故按「可能須綁卡」對待;② 流傳的「新 $610 代金券包」出自促銷頁而非官方 Free Tier 頁,一路稱有並附 180 天有效期、另一路稱查無官方依據,不採信。時效:官方頁未標整體促銷截止日;各產品試用期自開通起算,到期頁面提示「可在控制台續費」,即存在到期轉收費路徑。link ⚠綁卡狀態未證實
⚠️ 闢謠:「OpenAI 把新免費額度從 $300 提到 $1,000」查無官方依據 — 聚合站流傳 OpenAI 於 2026-07-08 將新免費 API 額度提至 $1,000、限企業郵箱域名。兩路聯網核査均否定此說:一路指出 OpenAI 官方的 $1,000 是 Researcher Access Program(研究者訪問計劃)的申請制資助,並非面向一般新的自動發放,且找不到「企業郵箱即得」的官方公告;另一路更直接指出這類「$1,000 免費額度」宣傳通常來自第三方 API 聚合渠道,且往往要求先行充值。結論:不要按此行動。 與 W28 記錄的 FounderPass「須先充值」陷阱是同一形態——同一個 $1,000 數字被從申請制資助挪用到了自動發放的宣傳語上。眞正可申請的官方渠道見下一節的 Researcher Access Program。⚠已闢謠·勿採用
Cerebras 免費層取消無卡使用(部分證實) — 官方定價頁確認新帳號得 $5 試用額度、自助付費充值起步 $10。⚠ 但「須綁定經驗證的付款方式纔能激活」與「30 天過期」兩項細節,一路稱屬實、另一路表示官方頁面未寫明,維持部分證實。無論細節如何,「無需綁卡的常設免費層」已不存在這一點兩路一致。若既有腳本仍指向 Cerebras 免費層需改道。link ⚠部分證實
仍在「無需綁卡」名單上的免費 API(狀態延續,本週未逐一複核) — SambaNova、Groq、Mistral、Deepgram、AssemblyAI 據稱維持無需信用卡。⚠ 未逐一驗證;Cerebras 的先例說明這類名單會靜默失效,採用前應逐家自查註冊流程是否索要付款方式。
🎓 學術雲/API credit 動態(開放古典語言數字化與 AI 輔助教學用途)
Microsoft AARI —— 有變化:官方方向表述中首次明確出現「文化遺產保護」,但仍無公開申請入口 — 官方頁本週複核,三大方向中的「高價値應用」一項現明確列舉教育、文化遺產保護(heritage conservation)、太空三個領域。這是首次在官方文本中看到與古典文獻數字化高度鄰接的用詞——此前只是推測其可能涵蓋。頁面現列出 12 個進行中的學術合作項目,涵蓋機器人、推理、安全驗證、文化適配、多智能體協作、供應鏈與視覺記憶。關鍵未變:沒有面向公衆的申請表,無截止日,無公佈額度,仍以邀請/合作制運作。時效:無公開窗口。相關性:方向表述對「開放古典語言數字化與 AI 輔助教學」這類用途是有利信號,但目前無可操作的申請路徑,只能持續觀察是否轉爲公開徵集。link ✓一手頁面
OpenAI Researcher Access Program —— 無變化,但 9 月審核窗口只剩約十天 — 官方頁複核:全年收件,每季度(3/6/9/12 月)審核一次,最高 $1,000 API credit、12 個月有效、到期不可延期或續期,決定後到賬還需最多 4 週。資格限 API 支持地區,優先照顧資源有限的早期研究者。時效:距 9 月審核批次僅約十天,要趕上這一批須在本月內遞交。相關性:額度規模適合覆蓋單一數字化子項目的 API 開銷;這也是上一節被聚合站挪用的那個 $1,000 的眞正出處。link ✓一手頁面
TPU Research Cloud —— 無變化 — 官方 about 頁複核,狀態與前兩週一致:頁面無任何截止日、等候名單或超額認購字樣,只有一個「Express interest」表單,滾動發放;亦未提及計費要求。link
Google Cloud Research Credits/Gemini 學術計劃 —— 無變化(博士生上限 $1,000、教職與博士後上限 $5,000,滾動收件;仍要求開通綁定付款方式的計費賬號,額度用盡或過期後直接轉按量計費,不屬於「純免費不綁卡」範疇)。
AWS Cloud Credit for Research/AWS Open Data Sponsorship —— 無變化(滾動收件,但 Free Tier 賬號自 2026-02-16 起不再有資格獲得促銷 credit,大中華區無法處理申請)。
Anthropic —— 無適用於人文/低資源語言的新學術 credit 項目 — 本週檢索到的仍偏生命科學方向(含一項已於 8 月 2 日截止的罕見病專項)。⚠ 沿用上週處理:聚合站對 Anthropic 學術項目的金額與截止日連續多週給出互相矛盾卻都「精確到美元與日期」的數字,而官方頁面從未公佈金額,故一律不採信聚合站數字。無適用於古典語言數字化用途的開放窗口。
🛠 AI / IT 實用發展
Qwen3.8-27B(Apache-2.0,2026-08-14 發布)—— 本週最有實用價値的一條 — 27B 稠密原生視覺語言模型,原生上下文 262,144 token(經 YaRN 可外推至 100 萬),文本/圖像/視頻三模態,混合架構(Gated DeltaNet+Gated Attention)。官方模型卡報 OmniDocBench 1.5 文檔智能 91.1。可用之處:已有 MLX 原生 4-bit 移植(
mlx-community/Qwen3.8-27B-4bit,約 15.0 GiB 三分片),Ollama 亦已上架qwen3.8:27b-mlx(約 18 GB 下載),需約 16–19 GB 統一內存——24GB 的 Apple Silicon 機器是可行下限。這意味着一個能讀版面、圖表、手寫的 27B 視覺語言模型可完全本地跑,不經雲端、不產生計費;同一個模型也在 Cloudflare 免費計劃上可調(見上節),本地與雲端兩條路都通。⚠ 三點提醒:① 本地跑大模型前須先確認可用內存,24GB 機器留給系統的餘量很薄;② MLX/Metal 推理在此機須繞沙箱,否則會靜默退回 CPU 而慢上數十倍;③ OmniDocBench 91.1 與此前記錄的 PaddleOCR-VL-1.6 的 96.33 分屬不同版本基準,不可直接比大小——這是他方自報數字而非本機實測,選型仍須用自己的頁樣跑一遍。linkDeepSeek-V4-Pro-0813 正式版(MIT 開放權重) — V4 系列旗艦於 8 月 12–13 日離開預覽轉正式發布,權重以 MIT 許可開放(HF 上約 893 GB),稀疏 MoE 架構、49B 每 token 激活、100 萬 token 上下文、最大輸出 384,000 token。可用之處:MIT 是目前前沿級開放權重中許可最寬鬆的一檔,無商用限制;但 893GB 的體量注定不是本地方案,只能經 API 或自建集羣。⚠ 各聚合站對其總參數量給出 1.6T/1.7T 等不同數字,本報告不採信任一具體數字。與既有工作流的直接關聯:DeepSeek 是交叉查證的通道之一,正式版轉正意味該通道的模型基線更新;同時它已上架 Cloudflare Workers AI,但屬付費專屬(見上節)。link
LightOnOCR-2-1B(Apache-2.0)—— 補記,非本週新品(2026-01 發布) — 1B 端到端多語種視覺語言 OCR 模型,直出「乾淨且順序正確」的文本,官方報 OlmOCR-Bench 總分 83.2(Arxiv Math 89.6、Old Scans Math 85.6)、MDPBench 63.9,單張 H100 上 5.71 頁/秒、約 $0.01/千頁,宣稱較 Chandra OCR 快 3.3 倍。官方稱支持 11 種語言——覆蓋面遠窄於 PaddleOCR-VL 的 109 種,天城體/藏文是否在列須自查。可用之處:1B 體量對本地批量預掃很友好,是「小模型先過一遍、只把可疑頁送大模型」這種分層路線的候選。以上均爲官方自報數字,非本機實測。link
🔎 第二源校驗小結
- GPT(OpenRouter
openai/gpt-5.6-terra:online):本週成功落地,且:online確認眞的聯網 —usage.server_tool_use_details.web_search_requests首次調用報 12 次、成功那次報 10 次,檢索確實發生。8 個承重問題全部作答:TRUE 2 條、PARTLY 5 條、FALSE 1 條。本週最有價値的一條來自它:指出「用/api/v1/models找不到嵌入模型」這個測試方法本身無效。 - DeepSeek(
deepseek/deepseek-v4-pro:online):本週失敗,且已知不可修 — 兩次調用皆無輸出:completion_tokens3000 全部計入reasoning_tokens,推理未結束即撞上上限,正文一字未出,計費 $0.022。更關鍵的是usage中完全沒有web_search_requests字段,即:online對 DeepSeek 確實未生效,與既有記錄一致。按既定政策該通道的肯定與否定答覆均不計票,故不再追加預算重試。 - ⚠️ 重要機制更正:上週判定的「額度池耗盡」是誤診 —
上週把 GPT 的失敗歸因於
key_crossverify池耗盡。本週查得該 key 的週上限尚餘 $7.15(每週重置的 $10 上限),額度根本不緊,但同樣的失敗仍然復現,因而定位到眞正的兩個原因:①urllib無法正確重組 OpenRouter 的分塊響應,拋IncompleteRead—— 首次 GPT 調用已讀入 10,012 字節內容纔斷,即模型確實生成了、也確實計費了,只是客戶端組裝不起來;改用curl後此故障消失。②max_tokens被推理 token 全額吃光——max_tokens: 3000配reasoning.effort: high時,3000 全記入reasoning_tokens,正文零輸出;改爲max_tokens: 14000+effort: medium後正常出文。這就是「錢照付、內容空」的眞正機制,是客戶端配置問題,不是供應商故障,也不是餘額問題。 修法已固化:交叉查證一律走 curl、max_tokens給到 12000 以上、effort 不超過 medium。 - 綜計:✓三源證實 3 條(Cloudflare 免費/付費名單變動、OpenRouter 三個免費嵌入模型、HF 免費層三項數字)、✓兩源證實 1 條(GitHub Copilot 學生版仍暫停,兩週存疑結案)、已闢謠 1 條(OpenAI $300→$1,000 傳聞,兩路均否定)、⚠分歧 1 條(Modal 的 $1/$29 拆分)、⚠部分證實 2 條(騰訊雲綁卡要求、Cerebras 30 天與綁卡細節)、無變化 4 條(TRC、OpenAI RAP、AWS、GCP)、自我更正 1 條(本週初對 OpenRouter 嵌入模型的錯誤結論已撤回)。
- Perplexity:本週未執行。三路中兩路完整落地、承重項均已由官方一手頁面補齊,未觸發「三路全失敗才退回人工清單」的條件。
- 🔬本地模型參考(Gemma,離線·不計入共識):Ollama 服務未啓動(11434 端口無響應),本週略過。
本週載重提醒:
- 最値得動手的一條:Qwen3.8-27B。Apache-2.0、27B 視覺語言、MLX 4-bit 約 15GB,24GB 機器跑得動,且同款模型在 Cloudflare 免費計劃上也能調——本地與雲端兩條零成本路徑同時打開。跑之前先確認內存餘量,並記得 Metal 推理須繞沙箱。
- 時效最緊:OpenAI Researcher Access Program 的 9 月審核批次,距今約十天,且通過後到賬還要再等最多 4 週。
- 變壞的:Cloudflare Workers AI 免費計劃的付費專屬名單兩週內由 3 個增至 5 個(新增兩個 DeepSeek V4)。這條名單正在持續收窄,任何依賴它的管線都應假設「今天免費的下週可能不免費」。
- 紅線相關:Modal「$30 免費」實得多少取決於是否綁卡,維持保守處理;騰訊雲免費套餐無法取得「不綁卡」的正面證據,按可能須綁卡對待;OpenAI 那條 $1,000 傳聞已闢謠,其形態正是把申請制資助的數字挪用到自動發放的宣傳語上,且第三方渠道常要求先充值——遇到這個數字要先問「誰發的、要不要先付錢」。
- 方法論(本週最重要的收穫,且是兩條):其一,「查無此物」首先是對查詢方法的懷疑——本週差點基於一個無效的端點查詢,去「更正」一條本來正確的記載,是交叉查證把它攔下來的。其二,上週的「額度耗盡」是誤診,眞因是 urllib 分塊解碼失敗+推理 token 吃光 max_tokens;一個把錢花掉卻不產出內容的通道,在歸因爲「供應商壞了」或「沒錢了」之前,應先懷疑自己的客戶端配置。這正是既有紀律「有回退路徑時,任何負面結果都先是對管線的懷疑」的又一次應驗。