DeepSeek V4 以 1M 上下文窗口发布;华为 Ascend 与寒武纪芯片实现全面兼容

Gate News 消息,4月24日——DeepSeek V4-Pro 和 DeepSeek V4-Flash 于 4 月 24 日正式发布,并开源发布;上下文处理长度从 128K 大幅扩展至 1M,容量提升接近 10 倍。华为计算宣布其 Ascend 超算节点产品通过芯片与模型技术的紧密协作,全面支持 DeepSeek V4 系列模型。

华为 Ascend 950 通过融合算子内核与多流并行等技术,实现高吞吐、低时延的 DeepSeek V4 模型推理部署,以降低 Attention 计算及内存访问开销。对于输入 8K 的 DeepSeek V4-Pro,Ascend 950 实现约 20ms TPOT,单卡 Decode 吞吐达 4,700 TPS;对于输入低于 8K 的 DeepSeek V4-Flash,吞吐可达约 10ms TPOT、1,600 TPS。Ascend A3 超算节点系列同样实现全面兼容,并提供训练参考实现以便快速微调。基于采用大 EP 模式的 Ascend A3 64 卡超算节点,使用 vLLM 推理引擎,DeepSeek V4-Flash 在 8K/1K 输入输出场景下实现单卡 Decode 吞吐超过 2,000 TPS。华为全线 Ascend A2、A3 和 950 产品均支持 DeepSeek V4-Flash 与 V4-Pro。

华为云宣布与 DeepSeek V4 的“先发兼容”,通过其 MaaS 平台为开发者提供一键式 API Token 服务。华为云优化系统层、算子层和集群层能力,确保模型快速适配与高性能部署。包括金山 WPS 和 360 在内的企业已通过华为云集成了 DeepSeek 的新模型。

寒武纪同样宣布基于 vLLM 推理框架的 DeepSeek V4-Flash 与 V4-Pro Day 0 兼容性,并将适配代码开源至 GitHub 社区。寒武纪此前在去年 DeepSeek V3.2 发布时也实现了“先发适配”,在 DeepSeek 系列模型上开展了深度的软件-硬件协同性能优化。

免责声明:本页面信息可能来自第三方,不代表 Gate 的观点或意见。页面显示的内容仅供参考,不构成任何财务、投资或法律建议。Gate 对信息的准确性、完整性不作保证,对因使用本信息而产生的任何损失不承担责任。虚拟资产投资属高风险行为,价格波动剧烈,您可能损失全部投资本金。请充分了解相关风险,并根据自身财务状况和风险承受能力谨慎决策。具体内容详见声明

相关文章

Google 计划向 Anthropic 投资最高 $40 十亿美元,并承诺 5+ 吉瓦的计算能力

Gate News 消息,4月24日——据市场消息人士称,Google 计划向 Anthropic 投资最高 $40 十亿美元。该投资将以初始 $10 十亿美元现金启动,随后在实现指定里程碑后,最多再追加 $30 十亿美元。 Google 还将向 Anthropic 提供至少 5 吉瓦的计算能力,作为合作的一部分。

GateNews7 分钟前

瑞士监管机构 FINMA 警告:Anthropic 的 Mythos AI 工具存在金融风险

Gate News 消息,4 月 24 日 — 瑞士金融市场监管局 (FINMA) 表示,允许银行快速且方便地采用 Anthropic 的人工智能工具 Mythos 将带来严重风险。该

GateNews30 分钟前

Fere AI 完成由 Ethereal Ventures 牵头的 130 万美元融资

Gate News 消息,4月24日——Fere AI,一家由人工智能驱动的数字资产交易代理平台,宣布完成一轮由 Ethereal Ventures 牵头的 130 万美元融资,Galaxy Vision Hill 和 Kosmos Ventures 参与。 该平台支持跨链网络,包括 Ethereum,

GateNews1小时前

Anthropic在质量下滑后回滚Claude Code变更;所有修复已完成

门罗新闻消息,4月24日——Anthropic已承认最近Claude Code质量下滑,并确认所有相关问题已通过回滚和修复解决。问题源于4月上旬至4月中旬期间进行的三项产品和提示词调整。 在3月4日,

GateNews3小时前

NeoSoul 联合创始人 Kaelan:AI 行业应允许“玩具”存在,创新往往从实验性产品开始

Gate News 消息,4月24日——在最近于香港举办的智能加密金融论坛上,NeoSoul 联合创始人 Kaelan 分享了关于在早期阶段、快速演进的 AI 行业中评估 AI 项目的见解。除了评估当前产品之外,团队还必须展示出能够跟上底层模型能力的能力,他表示。

GateNews3小时前

Meta 将在多年期数十亿美元交易中部署数千万颗 AWS Graviton5 芯片

Gate News 信息,4 月 24 日——Meta 已与亚马逊网络服务(Amazon Web Services)签署一项为期多年的协议,将部署数千万颗 Graviton5 处理器用于其 AI 基础设施,使 Meta 成为全球 AWS 最大的 Graviton 客户之一。该交易为期三到五年,价值数十亿美元,据 AWS 副总裁 Nafea Bshara 称。

GateNews3小时前
评论
0/400
暂无评论