Code & Chain · Signal Desk

DeepSeek 开源 V4-Flash-0731 模型,支援百万上下文

原始來源DataNorth AI

摘要

DeepSeek 于 7 月 31 日发布 V4-Flash-0731,这是一个 284B 参数的混合专家(MoE)模型,每次启用 13B 参数,支援 1,000,000 token 的上下文视窗。权重以 MIT 许可证发布于 Hugging Face,API 提供公开测试版,定价为每 1M 输入 token 0.14 美元,每 1M 输出 token 0.28 美元。此版本是重新训练后的更新,重点改善编码、代理、推理与工具使用能力,基准测试宣称在所有已发表的代理基准上超越更大的 V4-Pro(预览版)。自架时记忆体需求约 110 GB(vLLM 部署),支援动态 GS/UFG2/8-bit…

重點整理

  • 开发者能使用百万上下文与低成本的模型进行大型程式码处理与代理开发,降低 AI 应用成本。
  • 开发者可获得一个高效、开放的编码与代理模型,以低成本开发 AI 应用。

編輯說明

本頁是 Code & Chain 對公開來源的編輯摘要,可能使用 AI 輔助整理並經自動化流程發布。請以原始來源為準;內容不構成投資、法律或稅務建議。