HLS后端示例
HLS后端示例
TVM支持带有SDAccel的Xilinx FPGA板。这是有关如何将TVM部署到AWS F1 FPGA实例的文档。
此功能仍处于试验阶段。暂时无法使用SDAccel部署端到端神经网络。
本文使用两个python脚本。
- build.py-用于合成FPGA位流的脚本。
- import tvm
- from tvm import te
- tgt_host="llvm"
- tgt="sdaccel"
- n = te.var("n")
- A = te.placeholder((n,), name='A')
- B = te.placeholder((n,), name='B')
- C = te.compute(A.shape, lambda i: A[i] + B[i], name="C")
- s = te.create_schedule(C.op)
- px, x = s[C].split(C.op.axis[0], nparts=1)
- s[C].bind(px, tvm.te.thread_axis("pipeline"))
- fadd = tvm.build(s, [A, B, C], tgt, target_host=tgt_host, name="myadd")
- fadd.save("myadd.o")
- fadd.imported_modules[0].save("myadd.xclbin")
- tvm.contrib.cc.create_shared("myadd.so", ["myadd.o"])
- run.py-使用FPGA作为加速器的脚本。
- import tvm
- import numpy as np
- import os
- tgt="sdaccel"
- fadd = tvm.runtime.load_module("myadd.so")
- if os.environ.get("XCL_EMULATION_MODE"):
- fadd_dev = tvm.runtime.load_module("myadd.xclbin")
- else:
- fadd_dev = tvm.runtime.load_module("myadd.awsxclbin")
- fadd.import_module(fadd_dev)
- ctx = tvm.context(tgt, 0)
- n = 1024
- a = tvm.nd.array(np.random.uniform(size=n).astype("float32"), ctx)
- b = tvm.nd.array(np.random.uniform(size=n).astype("float32"), ctx)
- c = tvm.nd.array(np.zeros(n, dtype="float32"), ctx)
- fadd(a, b, c)
- tvm.testing.assert_allclose(c.asnumpy(), a.asnumpy() + b.asnumpy())
设定
- 使用FPGA Developer AMI启动实例。不需要F1实例进行仿真和综合,因此建议使用成本较低的实例。
- 设置AWS FPGA开发套件工具。
- git clone https://github.com/aws/aws-fpga.git
- cd aws-fpga
- source sdaccel_setup.sh
- source ${XILINX_SDX}/settings64.sh
- 在启用OpenCL的情况下设置TVM。
仿真
- 创建emconfig.json进行仿真。
- emconfigutil --platform ${AWS_PLATFORM} --nd 1
- 将emconfig.json复制到python二进制目录。当前的Xilinx工具包假定主机二进制文件和emconfig.json文件都在同一路径中。
- cp emconfig.json $(dirname $(which python))
- 运行软件仿真
- export XCL_EMULATION_MODE=1
- export XCL_TARGET=sw_emu
- python build.py
- python run.py
- 运行硬件仿真
- export XCL_EMULATION_MODE=1
- export XCL_TARGET=hw_emu
- python build.py
- python run.py
Synthesis
- 使用以下脚本运行综合。
- unset XCL_EMULATION_MODE
- export XCL_TARGET=hw
- python build.py
- 创建AWS FPGA映像并将其上传到AWS S3。
- ${SDACCEL_DIR}/tools/create_sdaccel_afi.sh \
- -xclbin=myadd.xclbin -o=myadd \
- -s3_bucket=<bucket-name> -s3_dcp_key=<dcp-folder-name> \
- -s3_logs_key=<logs-folder-name>
生成awsxclbin文件,对于在F1实例上使用AWS FPGA映像是必需的。
运行
- 启动Amazon EC2 F1实例。
- 将myadd.so,myadd.awsxclbin和run.py复制到F1实例。
- 设置AWS FPGA开发套件。
- git clone https://github.com/aws/aws-fpga.git
- cd aws-fpga
- source sdaccel_setup.sh
- 在启用OpenCL的情况下设置TVM。
- 设置root和setup环境变量。
- sudo sh
- source ${INSTALL_ROOT}/setup.sh
- 运行
python run.py
https://tvm.apache.org/docs/deploy/hls.html
HLS后端示例的更多相关文章
- iView学习笔记(一):Table基本操作(包含前后端示例代码)
iView表格操作 1.前端准备工作 首先新建一个项目,然后引入iView插件,配置好router npm安装iView npm install iview --save cnpm install i ...
- HLS playlist典型示例
[时间:2018-06] [状态:Open] [关键词:流媒体,HLS,m3u8,playlist,variant, alternate] 0 引言 本文主要是对apple官网上的echnical N ...
- Sentry 开发者贡献指南 - 后端服务(Python/Go/Rust/NodeJS)
内容整理自官方开发文档 系列 1 分钟快速使用 Docker 上手最新版 Sentry-CLI - 创建版本 快速使用 Docker 上手 Sentry-CLI - 30 秒上手 Source Map ...
- 视频直播点播nginx-rtmp开发手册中文版
2016年8月18日12:42:35 参照官方文档https://github.com/arut/nginx-rtmp-module/wiki/Directives 请注意这个是粗翻译版,仅供参考,不 ...
- 使用Visual Studio 2012 开发 Html5 应用
Visual Studio 一直以来是开发微软旗下应用的利器,只要是开发微软相关的应用无论是Windows程序,WPF,Asp.Net,WinRT Surface,WindowsPhone 等微软旗下 ...
- C#微信公众号学习 - (一)测试账号申请
主要分为两部分: 1.创建C#的项目,并发布, 2.微信填写发布的地址进行开发者验证. 一. VS环境为VS2017,创建项目时,自带的一些东西发布会导致各种错误,无奈,创建了空项目aspx窗体,如下 ...
- ABP入门教程14 - 更新多语言
点这里进入ABP入门教程目录 设置语种 新增语种 数据库操作 打开多语言表AbpLanguages,添加一条记录. 程序操作 在基础设施层(即JD.CRS.EntityFrameworkCore)的\ ...
- Flask-wtf导入Regexp规则库验证手机号码合法性(测试通过)
手机号码在项目有着很重要的地位,保证用户输入的号码准确无误就显得很关键. 废话不多说,现在页面中引入Regexp规则库: from wtforms.validators import Regexp 验 ...
- OpenWrt Web 开发 LuCI框架 lua语言
LuCI作为“FFLuCI”诞生于2008年3月份,目的是为OpenWrt固件从 Whiterussian 到 Kamikaze实现快速配置接口.Lua是一个小巧的脚本语言,很容易嵌入其它语言.轻量级 ...
随机推荐
- 【ElasticSearch】索引重建
ElasticSearch索引重建 ElasticSearch索引一旦建立,便不可修改索引字段类型(允许增加或者删除该字段) 例如从Integer类型修改为long类型,这是不被允许的,错误信息如下: ...
- 提示No input file specified的解决方法
(一)IIS Noinput file specified 方法一:改PHP.ini中的doc_root行,打开ini文件注释掉此行,然后重启IIS 方法二: 请修改php.ini 找到 ; cgi. ...
- 工具tip
1 postman: chrome的插件,模拟http的get.post等各种请求 2 010: 二进制文件查看,支持很多文件格式和强大的脚本:010 Editor体验 3 BeyondCompare ...
- UVA11174村民排队问题
题意: 有n个人要排队,给你一些父子关系,要求儿子不能站在自己的父亲前面,问有多少种排队方式? 思路: 白书上的题目,首先我们可以把关系建成树,这样我们就有可能得到一个森林(或者 ...
- AsSystemRum 系统提权工具 实现思路及其源码
名字: AsSystemRun 功能: 用system权限启动一个进程. 开发语言: C++,C# 作者: Ack-Code 开发时间: 2016.9.15 实现原理: w ...
- 使用Github+Picgo搭建图床
虽然我的大部分博客使用的腾讯云的对象存储(COS)作为图床,但是腾讯云的免费对象存储空间结束了,购买资源西南地区大致存储资源包50元/12月+下行流量9元/3月,价格较为高昂,而使用GitHub或者G ...
- Java并发容器篇
作者:汤圆 个人博客:javalover.cc 前言 断断续续一个多月,也写了十几篇原创文章,感觉真的很不一样: 不能说技术有很大的进步,但是想法确实跟以前有所不同: 还没开始的时候,想着要学的东西太 ...
- 【Unity】实验二 游戏场景搭建
实验要求 实验二 游戏场景搭建 实验目的:掌握游戏场景搭建. 实验要求:能够使用Unity的地形引擎创建地形,熟悉场景中的光照与阴影,掌握天空盒和雾化效果等. 实验内容: 地形的绘制:使用高度图绘制: ...
- 将本地代码上传到云效git存放
前提已开通云效账号,然后进行云效首页的研发---代码 创建git组 创建git库 生成https://code.aliyun.com/test-demo1/v1的git库 准备将本地的test-dem ...
- MySQL中MyISAM为什么比InnoDB查询快
大家都知道在MySQL中,MyISAM比InnoDB查询快,但很多人都不知道其中的原理. 今天我们就来聊聊其中的原理,另外也验证下是否MyISAM比InnoDB真的查询快. 在探索其中原理之前,我们先 ...