寒武纪今日宣布,已基于 vLLM 推理框架完成对深度求索(DeepSeek)最新开源模型
针对
硬件层面,寒武纪深度挖掘了 MLU 的访存与排序加速特性,有效应对
行业分析指出,DeepSeek-V4凭借百万字(1M)超长上下文及顶尖的逻辑推理性能,对底层算力架构提出了严苛要求。寒武纪在模型发布首日的敏捷适配,不仅展示了国产算力平台对超大规模、复杂结构模型的承载能力,也预示着国产 AI 产业链在软硬协同层面已进入成熟期,为大模型应用普惠提供了高效的算力底座支持。

寒武纪今日宣布,已基于 vLLM 推理框架完成对深度求索(DeepSeek)最新开源模型
针对
硬件层面,寒武纪深度挖掘了 MLU 的访存与排序加速特性,有效应对
行业分析指出,DeepSeek-V4凭借百万字(1M)超长上下文及顶尖的逻辑推理性能,对底层算力架构提出了严苛要求。寒武纪在模型发布首日的敏捷适配,不仅展示了国产算力平台对超大规模、复杂结构模型的承载能力,也预示着国产 AI 产业链在软硬协同层面已进入成熟期,为大模型应用普惠提供了高效的算力底座支持。
DeepSeek-V4系列API新定价今日零点生效,V4-Pro结束测试转正式商用。取消统一计费,改为算力错峰分级计价:每日9:00-12:00、14:00-18:00为高峰时段,收费较空闲时段翻倍;其余为空闲时段,价格仅为高峰一半,计费单位统一。
Deep Code开源终端编程助手因深度适配DeepSeek-V4系列模型受关注,主打高质量推理与代码生成。历经迭代至v0.1.31版,功能趋于成熟,支持VS Code插件模式,为开发者提供新的辅助选择。
AI推理芯片初创公司Etched近日完成融资,估值达50亿美元,年销售额突破10亿美元。该公司专注为特定任务设计的ASIC推理芯片,其成功有力验证了推理芯片的市场潜力和强劲需求,为全球及国内芯片设计行业注入强心针。
腾讯云宣布自2026年6月3日起大幅下调DeepSeek-V4系列模型调用价格,全面与官方售价持平。其中,DeepSeek-V4-Pro缓存命中价格降幅最高达97.5%,推理输入和输出价格均下调75%;DeepSeek-V4-Flash缓存命中价格也下调90%。
DeepSeek在发布V4版五天后,灰度测试多模态识图功能,新增“识图模式”入口,支持图片理解。实测显示,其在基础视觉理解、复杂人物和环境识别上表现优异,标志着从文本向视觉交互的跨越。