当前位置:首页 > 科技  > 手机

安谋科技下代“周易”NPU成功部署DeepSeek-R1:速度高达40 tokens/s

来源: 责编: 时间:2025-02-15 15:50:16 151观看
导读 快科技2月14日消息,安谋科技宣布,搭载新一代“周易”NPU处理器的硬件平台,已经成功在端侧部署并运行DeepSeek-R1系列模型,而且性能卓越、成本优异。新款“周易”NPU采用专为AI大模型特性优

快科技2月14日消息,安谋科技宣布,搭载新一代“周易”NPU处理器的硬件平台,已经成功在端侧部署并运行DeepSeek-R1系列模型,而且性能卓越、成本优异。Dod28资讯网——每日最新资讯28at.com

新款“周易”NPU采用专为AI大模型特性优化的架构设计,Beta测试版本已在2024年底向早期用户开放评估测试,预计今年上半年正式发布亮相。Dod28资讯网——每日最新资讯28at.com

安谋科技下代“周易”NPU成功部署DeepSeek-R1:速度高达40 tokens/sDod28资讯网——每日最新资讯28at.com

DeepSeek-R1 1.5B、7B蒸馏版本推出后,安谋科技新一代“周易”NPU在很短的时间内,就在Emulation平台上完成了部署与优化,并在FPGA平台上成功实现了端到端应用的演示。Dod28资讯网——每日最新资讯28at.com

测试显示,在标准单批次输入、上下文长度为1024的测试环境中,新款“周易”NPU在首字计算阶段的算力利用率突破40%,解码阶段的有效带宽利用率超过80%。Dod28资讯网——每日最新资讯28at.com

带宽利用率呈现高线性特性,能够灵活适配16GB/s至256GB/s的系统带宽需求。Dod28资讯网——每日最新资讯28at.com

7B版本、1024上下文长度的场景下,保障模型应用精度的同时,新款“周易”NPU的高处理速度可达每秒40 tokens,并支持动态长度的模型推理输入。Dod28资讯网——每日最新资讯28at.com

安谋科技下代“周易”NPU成功部署DeepSeek-R1:速度高达40 tokens/sDod28资讯网——每日最新资讯28at.com

这也展现了安谋科技软件栈对大模型的成熟支持、深度优化,包括动态推理优化和硬件算力潜力的挖掘,从而显著提升推理速度和吞吐量。Dod28资讯网——每日最新资讯28at.com

目前,软件栈已支持Llama、Qwen、DeepSeek、ChatGLM、MiniCPM等多种主流大模型,并提供与Hugging Face模型库的对接工具链,方便直接部署主流模型。Dod28资讯网——每日最新资讯28at.com

硬件层面,新一代“周易”NPU采用7nm工艺制造,单Cluster算力高可达80 TOPS(每秒80万亿次计算),能够轻松应对超过16K上下文长度的大模型部署需求,同时对外带宽提高至256GB/s,解决大模型计算的带宽瓶颈问题。Dod28资讯网——每日最新资讯28at.com

它还全面支持FP16数据精度计算,完整支持INT4软硬量化加速,还支持多核算力扩展,满足端侧模型的低首字延迟需求。Dod28资讯网——每日最新资讯28at.com

它还具备强大的多任务并行处理能力,通过细粒度的任务调度和优先级资源分配,实现多任务灵活切换,确保传统语音、视觉业务、大模型应用的高效协同。Dod28资讯网——每日最新资讯28at.com

本文链接:http://www.28at.com/showinfo-22-130640-0.html安谋科技下代“周易”NPU成功部署DeepSeek-R1:速度高达40 tokens/s

声明:本网页内容旨在传播知识,若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。邮件:2376512515@qq.com

上一篇: iPhone 17 Pro渲染图出炉:神似小米11 Ultra 工业设计焕然一新

下一篇: 女生刷同一视频6小时后手机烧屏:画面超崩溃 再也抹不掉了

标签:
  • 热门焦点
  • 鸿蒙OS 4.0公测机型公布:甚至连nova6都支持

    华为全新的HarmonyOS 4.0操作系统将于今天下午正式登场,官方在发布会之前也已经正式给出了可升级的机型产品,这意味着这些机型会率先支持升级享用。这次的HarmonyOS 4.0支持
  • 天猫精灵Sound Pro体验:智能音箱没有音质?来听听我的

    这几年除了手机作为智能生活终端最主要的核心之外,第二个可以成为中心点的产品是什么?——是智能音箱。 手机在执行命令的时候有两种操作方式,手和智能语音助手,而智能音箱只
  • WebRTC.Net库开发进阶,教你实现屏幕共享和多路复用!

    WebRTC.Net库:让你的应用更亲民友好,实现视频通话无痛接入! 除了基本用法外,还有一些进阶用法可以更好地利用该库。自定义 STUN/TURN 服务器配置WebRTC.Net 默认使用 Google 的
  • 使用AIGC工具提升安全工作效率

    在日常工作中,安全人员可能会涉及各种各样的安全任务,包括但不限于:开发某些安全工具的插件,满足自己特定的安全需求;自定义github搜索工具,快速查找所需的安全资料、漏洞poc、exp
  • 自律,给不了Keep自由!

    来源 | 互联网品牌官作者 | 李大为编排 | 又耳 审核 | 谷晓辉自律能不能给用户自由暂时不好说,但大概率不能给Keep自由。近日,全球最大的在线健身平台Keep正式登陆港交所,努力
  • 新电商三兄弟,“抖快红”成团!

    来源:价值研究所作 者:Hernanderz 随着内容电商的概念兴起,抖音、快手、小红书组成的“新电商三兄弟”成为业内一股不可忽视的势力,给阿里、京东、拼多多带去了巨大压
  • 小米汽车电池信息疑似曝光:容量101kWh,支持800V高压快充

    7月14日消息,今日一名博主在社交媒体发布了一张疑似小米汽车电池信息的照片,显示该电池包正是宁德时代麒麟电池,容量为101kWh,电压为726.7V,可以预测小
  • 三星Galaxy Z Fold5今日亮相:厚度缩减但仍略显厚重

    据官方此前宣布,三星将于7月26日也就是今天在韩国首尔举办Unpacked活动,届时将带来带来包括Galaxy Buds 3、Galaxy Watch 6、Galaxy Tab S9、Galaxy
  • 苹果MacBook Pro 2021测试:仍不支持平滑滚动

    据10月30日9to5 Mac 消息报道,苹果新的 14 英寸和 16 英寸 MacBook Pro 2021 上市后获得了不错的评价,亮点包括行业领先的性能,令人印象深刻的电池续航,精美丰
Top