Skip to content
所有標籤

#deepseek

12 篇文章
daily digest AI Model Tracker

模型卡|DeepSeek-V4-Flash-Vision-Exp

DeepSeek-V4-Flash-Vision-Exp:284B 總參數/13B 啟用參數 MoE,1M context、384K 最大輸出;定價與 V4-Flash 完全一致(Input $0.44/Output $1.32,尖峰;離峰對半);文字 agent benchmark 7 項中贏 6 項(DeepSeek 甚至以 59.3 分超越 Opus-4.8 的 58.0);多模態 agent 貼近 Opus-4.8(ApexBench 落後 2.9 分、ZeroBench 反超);每張圖片壓縮到最多 384 tokens、約 800×800 解析度上限,代價是細節辨識力

daily digest AI Pricing Watch

定價追蹤|DeepSeek 週末全時段降到離峰價,上週漲價的另一半故事

DeepSeek 自 2026-08-23 00:00(北京時間)起,週六、週日全天不再區分尖峰/離峰,一律以離峰價計費——原本週末仍套用平日的尖峰/離峰時段表,尖峰時段 V4-Pro Output 要價 $3.96/1M tokens,現在週末全天都是 $1.98/1M。平日計費規則不變。距 8/16 那次尖峰漲價(Output 漲 355%-371%)僅一週。

ai deep-dive

BytePlus ModelArk Coding Plan:字節跳動的 AI 編碼訂閱方案

BytePlus ModelArk Coding Plan 提供 Lite($10/月)和 Pro($50/月)兩種訂閱,整合 DeepSeek-V4、GLM-5.2、Seed-2.0 等多模型,支援 Claude Code、Cursor 等主流工具,Lite 月配額約 24,000 次請求,Pro 為其 5 倍。

tech deep-dive AI 模型家族

DeepSeek——從 MoE 實驗室到 OpenRouter 用量第一的開源王者

DeepSeek 用 MLA + MoE 兩項架構創新把推論成本壓到業界最低,V4 Flash 以 13B 活躍參數跑出接近前端模型的品質,成為 OpenRouter 用量第一。這篇追蹤從 V1 到 V4 的演化、R1 推理線的分叉、以及每個版本該怎麼選。

2026 下半年 Harness 大戰:八大框架重寫、三家模型商入場,110+ CLI 怎麼看

2026 年 8 月,不只五個框架在動。OMP 2、Pi v2、Opencode 2、dsh、Claude Code 之外,Google(Antigravity CLI)、Meta(Muse Code)、xAI(Grok Build)三家模型商直接下場做 coding agent,加上 Amp、Cline 2.0、Codex CLI Rust 重寫,共八個以上框架同時有架構級變動。再算進 110+ 個 CLI 工具,H2 2026 是 harness 方法論的分裂期。本文從四條架構路線、一個共同方向、一場信任危機拆解。

DeepSeek Harness(dsh):把 Everything is a Plugin 做到底的 coding agent 框架

DeepSeek Harness(dsh)是 DeepSeek 官方的開源 coding agent 框架,2026-08-13 發布 v0.1 開發者預覽版,9 天內累積 184,000+ 星。核心是 Cordis plugin kernel——模型、工具、agent loop、UI 全部都是可抽換的外掛。四種 runtime 模式,能把 Claude Code 和 Codex 當子代理使用。Web UI 優先,目前沒有原生 CLI。

AI Agent GitHub Digest — 2026-08-17

forge 給自架 LLM 的 tool-calling 加一層可靠性 middleware,可直接代理 opencode/aider/Claude Code 免改程式;repo-context-mcp 用 MCP 提供 token 預算化的 repo context 打包,上線 5 天就做進 PR CI;DeepSeek 官方 harness dsh 一週內冒出至少 5 個獨立社群桌面包裝版,合計逼近 1,500 星;微軟研究院的瀏覽器 agent 框架 Webwright 靠 Skill Factory 把解過的任務蒸餾成免模型呼叫的可重跑腳本,在 WebArena 上拉高 15 個百分點的重用準確率;Mastra 1.59.0 把 CostGuardProcessor 更名 TokenCostControl(breaking),Pydantic AI v2.30.0 修了本機 web chat 介面的 DNS rebinding 資安漏洞。

daily digest AI Pricing Watch

定價追蹤|DeepSeek V4 全面調漲,尖峰時段最高漲 1,100%

DeepSeek V4-Pro 尖峰 Output 從 $0.87 漲到 $3.96/1M tokens(↑355%),V4-Flash 從 $0.28 漲到 $1.32(↑371%),2026-08-16 16:00 UTC 生效,同時導入離峰半價機制(01:00-04:00、06:00-10:00 UTC 為尖峰)。漲價後價格仍低於 GPT-5.6/Claude,但低價護城河明顯收窄。

ai deep-dive

DeepSeek-OCR:把長上下文壓成圖片的 10× 壓縮實驗

DeepSeek-OCR 的論文題目是 Contexts Optical Compression — OCR 只是手段,真正驗證的是『把文字渲染成圖片再餵給 VLM』能達到 10× 壓縮且 97% 精度。這對長上下文 LLM 與 RAG 的 token 成本是質變。

ai deep-dive

2026 年 LLM Inference 服務商免費額度與定價:40+ 家分梯整理

個人專案、玩具 demo、做 RAG 原型,不想第一步就掏卡。整理 2026/05 還在運作的 40+ 家 LLM inference 服務商,按免費資源「是持續補充還是一次性」分梯,標註綁卡需求、模型清單、付費起價,數字全部從官方 pricing 頁驗證。中國原廠含智谱 GLM(永久免費)、豆包(每日 200 萬 tokens)、Kimi、百煉、Ollama 本地跑法一併收錄。

ai project

2026 Q1 開源 LLM 全景圖:從前沿大模型到手機端,完整盤點

2026 Q1 開源模型全面爆發:LLM 方面 GLM-5、Kimi K2.5、Qwen3.5 追上閉源;Embedding 和 Reranker 由 Qwen3 和 BGE 主導;語音有 Voxtral TTS 和 Whisper V3;圖像有 FLUX.2;影片有 Wan 2.2 追平 Sora。這篇是完整導覽地圖。

ai guide OpenClaw 文件導讀

OpenClaw 的 60 個供應商:分類地圖,與接本地模型真正會踩的坑

官方 provider 目錄現在有 60 個條目。接本地模型最常見的失敗是把 Ollama 的 base URL 寫成 /v1——那會破壞 tool calling,模型會把 tool JSON 當純文字吐出來。