CFU Playground: Kerangka Sumber Terbuka Full-Stack untuk Akselerasi TinyML di FPGA
Ingin prosesor ML yang lebih cepat? Lakukan sendiri!
Proyek ini menyediakan kerangka kerja yang dapat digunakan oleh seorang insinyur, magang, atau siswa untuk merancang dan mengevaluasi peningkatan ke FPGA- berbasis prosesor “lunak”, khusus untuk meningkatkan kinerja tugas pembelajaran mesin (ML). Tujuannya adalah untuk mengabstraksikan sebagian besar detail infrastruktur sehingga pengguna dapat mempercepat dengan cepat dan hanya fokus pada penambahan instruksi prosesor baru, mengeksploitasinya dalam komputasi, dan mengukur hasilnya.
Proyek ini memungkinkan iterasi cepat pada peningkatan prosesor — beberapa iterasi per hari.
Begini cara kerjanya:
Pilih model TensorFlow Lite; model deteksi orang terkuantisasi disediakan, atau bawa sendiri.
Jalankan inferensi pada papan Arty FPGA untuk mendapatkan jumlah siklus per lapisan.
Pilih operator TFLite untuk mempercepat, dan gali kode itu.
Desain baru instruksi yang dapat menggantikan beberapa operasi dasar.
Membangun unit fungsi kustom (sejumlah kecil perangkat keras) yang menjalankan instruksi baru .
Modifikasi kernel perpustakaan TFLite/Micro untuk menggunakan instruksi baru, yang tersedia sebagai intrinsik dengan sintaks panggilan fungsi.
Buat ulang Soc FPGA, kompilasi ulang perpustakaan TFLM, dan jalankan kembali untuk mengukur peningkatan.
Fokus di sini adalah performa, bukan demo. Input ke inferensi ML dikalengkan/dipalsukan, dan satu-satunya output adalah jumlah siklus. Perbaikan yang dibuat di sini dapat diekspor ke demo yang sebenarnya, tetapi saat ini tidak ada jalur yang disiapkan untuk melakukannya.
Dengan pengecualian Vivado, semua yang digunakan oleh proyek ini adalah open source.
Penafian: Ini bukan proyek Google yang didukung secara resmi. Dukungan dan/atau rilis baru mungkin terbatas.
Ini adalah prototipe awal kerangka kerja eksplorasi ML; mengharapkan kurangnya dokumentasi dan kerusakan sesekali. Jika Anda ingin berkolaborasi dalam membangun kerangka kerja ini, hubungi tcal@google.com! Lihat “Pedoman kontribusi” di bawah.
Daftar Isi
Perangkat keras/OS yang diperlukan
Salah satu papan yang didukung oleh Papan LiteX. Sebagian besar target Papan LiteX harus berfungsi. Itu telah diuji pada Arty A7-35T/100T, iCEBreaker, Fomu, OrangeCrab
, ULX3S
, dan Nexys Video
boards.
Satu-satunya OS host yang didukung adalah Linux (Debian / Ubuntu).
Anda tidak memerlukan papan apa pun jika ingin menjalankan simulasi Renode atau Verilator.
Perangkat lunak yang diasumsikan
FPGA Toolchain: itu tergantung pada papan yang dipilih. Jika Anda sudah memasang rantai alat untuk papan Anda, Anda dapat menggunakannya.
Untuk papan dengan bagian Xilinx XC7, Anda dapat menggunakan Vivado, yang harus diinstal secara manual (ini panduan kami), atau rantai alat SymbiFlow open-source, yang dapat dengan mudah diinstal menggunakan Conda (lihat Panduan Pemasangan).
Untuk papan dengan Lattice iCE40, ECP5, atau Nexus FPGA, Anda dapat menginstal seperangkat alat sumber terbuka yang sesuai baik melalui Conda (lihat Panduan Penyiapan) atau sendiri dengan membangun dari sumber. Atau, Anda dapat menggunakan toolchain Lattice (Radiant/Diamond).
Jika Anda ingin mencoba berbagai hal menggunakan simulasi Renode, maka Anda tidak memerlukan board atau toolchain. Anda juga dapat melakukan simulasi akurat siklus tingkat Verilog dengan Verilator, tetapi ini jauh lebih lambat. Renode diinstal oleh skrip setup.
Paket lain yang diperlukan akan diperiksa dan, jika pada sistem berbasis Debian, otomatis diinstal oleh skrip setup di bawah.
Mempersiapkan
Klon repo ini, cd ke dalamnya, lalu jalankan:
Gunakan dengan papan
Papan default adalah Arty. Jika Anda ingin menggunakan papan yang berbeda, Anda harus menentukan target, misalnya TARGET=digilent_nexys_video
.
Bangun SoC dan muat bitstream ke Arty:
CD proj/proj_template buat prog
Ini membangun SoC dengan CFU default dari proj/proj_template. Nanti Anda akan menyalin ini dan memodifikasinya untuk membuat proyek Anda sendiri.
Buat program RISC-V dan jalankan di SoC yang baru saja Anda muat ke Arty:
Gunakan tanpa papan
Jika Anda tidak memiliki papan yang didukung oleh Papan LiteX, Anda dapat menggunakan Renode atau Verilator untuk mensimulasikannya.
Untuk menggunakan Renode untuk mengeksekusi pada simulator pada mesin host (tidak diperlukan papan Vivado atau Arty), jalankan:
Untuk menggunakan Verilator untuk mengeksekusi pada simulator tingkat RTL yang akurat siklus ( tidak diperlukan papan Vivado atau Arty), jalankan:
Bendera make paling berguna
Pilihan
Penjelasan
Contoh
Bawaan
PERON
Pilih platform SoC yang Anda inginkan untuk membangun: hps atau sim atau umum_soc
membuat bitstream PLATFORM=hps
common_soc
TARGET
Pilih salah satu dari banyak target dari repositori LiteX Boards, common_soc akan mengambil BaseSoC dari yang ditentukan target.py
buat bitstream TARGET=nexys_video_board
digilent_arty
USE_VIVADO
Gunakan rantai alat Vivado
buat bitstream USE_VIVADO=1
0
USE_SYMBIFLOW
Gunakan rantai alat Symbiflow
buat bitstream USE_SYMBIFLOW=1
0
UART_SPEED
Pilih baudrate UART
membuat bitstream UART_SPEED=115200
3686400
ABAIKAN_TIMING
Abaikan waktu kendala (hanya untuk Vivado)
buat bitstream USE_VIVADO=1 IGNORE_TIMING=1
0
LiteX: Kerangka kerja sumber terbuka untuk merakit SoC (CPU + periferal)
VexRiscv: RISC sumber terbuka- V soft CPU yang dioptimalkan untuk FPGA
nMigen: Python toolbox untuk membangun perangkat keras digital
Berlisensi di bawah lisensi Apache-2.0
Lihat file LISENSI.
Pedoman kontribusi
Jika Anda ingin berkontribusi di CFU Playground, pastikan untuk membaca panduan kontribusi. Proyek ini mematuhi kode etik Google. Dengan berpartisipasi, Anda diharapkan untuk menjunjung tinggi kode ini.
Pachyderm sedang merekrut Pemimpin DevRel untuk… Ingin menjadi bagian dari sekelompok orang yang bersemangat yang menjalankan misi untuk membuat ilmu data dapat dijelaskan, dapat diulang, dan terukur? Bergabunglah dengan “The Pach”! Lihat Posisi Terbuka Mengapa Bekerja…
AMD membidik laptop mainstream dengan Ryzen 6000 Mobile Kami tahu prosesor Ryzen seluler AMD dapat memberikan kinerja tingkat atas. Tujuan AMD untuk prosesor Ryzen 6000 Mobile barunya sedikit berbeda: mengoptimalkannya untuk efisiensi daya, memperluas jangkauannya ke laptop mainstream…
Finlandia pindah ke industri komputasi kuantum Kementerian Ekonomi Finlandia baru-baru ini mendanai proyek inovasi untuk Pusat Penelitian Teknis VTT Finlandia untuk membangun komputer kuantum. VTT meminta IQM, sebuah startup lokal, untuk membantu proyek tersebut, yang dimulai…
Intel secara resmi dalam bisnis penambangan bitcoin sekarang Intel telah mengumumkan rencananya untuk sepenuhnya merangkul teknologi blockchain dan akhirnya memasuki ruang penambangan bitcoin dengan chip baru yang akan tersedia akhir tahun ini.Dalam posting blog baru, chip tersebut raksasa…
Datang ke laptop di dekat Anda: Jenis chip keamanan… AT LONG LAST — AMD menjadi pembuat CPU pertama yang mengintegrasikan chip rancangan Microsoft ke dalam produknya. Dan Goodin - 4 Jan 2022 22:15 UTC Pada November 2020, Microsoft meluncurkan…
Delapan belas kerentanan tingkat tinggi diperbaiki… Kentang panas: Pembaruan driver grafis dari produsen perangkat keras GPU biasanya disambut dengan kegembiraan dan skeptisisme yang sehat. Beberapa pengguna menantikan dukungan game dan aplikasi potensial, fungsionalitas, atau FPS murni…
Acer memperkenalkan laptop Windows 11 untuk para… 4 Oktober 2021 13:00 Acer Nitro adalah laptop Windows 11 baru untuk para gamer. Kredit Gambar: Acer Bergabunglah dengan pemimpin game online di GamesBeat Summit Next 9 November mendatang -10.…
BrainChip Bermitra Dengan MegaChips Untuk… Tanggal publikasi: 21 Nov 2021 18:18 ESTBrainChip Holdings Ltd (ASX: BRN), (OTCQX: BCHPY) penyedia terkemuka kecerdasan buatan kinerja tinggi berdaya sangat rendah teknologi dan produsen chip AI neuromorfik dan IP…
Memindahkan Bank dari Pola Pikir Bata-dan-Mortar mereka Model kafetaria warisan layanan keuangan yang ditawarkan oleh bank -- menggunakan pendekatan origin-to-distribute untuk menyebarkan risiko dan mengurangi biaya pembiayaan -- tidak berfungsi lagi. Pelanggan tidak lagi mencari satu sumber…
Apa yang Terjadi dengan Superkomputer Bisnis? Pernah tampak tak terelakkan -- suatu hal yang pasti -- bahwa superkomputer akan membantu bisnis mengatasi tuntutan yang dipaksakan oleh basis data besar, alat teknik yang kompleks, dan prosesor lainnya…
Membangun masa depan dengan jaringan 5G berbasis… Solusi dan produk generasi berikutnya menghantam dinding dengan wi-fi: itu tidak cukup cepat, dan masalah latensi dan konektivitas berarti itu tidak cukup andal. Apa yang harus dilakukan seorang inovator? Fokus…
2021 adalah tahun terobosan bagi AI 29 Desember 2021 16:40 Kredit Gambar: Andriy Onufriyenko/Getty Images Mendengar dari CIO, CTO, dan eksekutif tingkat C dan senior lainnya tentang data dan strategi AI di Future of Work Summit…
Apple memperkenalkan SoC komputer M1 Pro dan M1 Max 5nm Pada acara Unleashed di Cupertino pada hari Senin, SoC komputer baru Apple yang sangat dinanti diperkenalkan. Dibangun pada proses 5nm canggih dan menampilkan hingga 57 miliar transistor, chip baru, Apple…
Mempercepat Kemajuan dalam Keberlanjutan dengan XaaS Ketika para pemimpin industri mulai menghargai urgensi perubahan iklim dan peran penting yang mereka mainkan dalam menguranginya, mereka mencari cara untuk menggunakan sumber daya dan energi secara lebih efisien. Tekanan…
Mengukur kualitas manajemen proyek konstruksi Kualitas manajemen proyek menentukan seberapa baik proyek dikelola dan seberapa sukses proyek itu nantinya.Tapi bagaimana Anda mengukur kualitas manajemen proyek? Sebenarnya, apa itu manajemen proyek konstruksi? Manajemen proyek konstruksi berarti…
PCIe 6.0 terungkap: Kecepatan super cepat akan… Membuktikan bahwa setiap kali Anda membeli sesuatu yang baru, hal yang lebih baik segera keluar, PCI-Sig Group mengumumkan rilis PCIe 6.0 pada hari Selasa, yang akan menggandakan data mentah kecepatan…
CPU AMD Ryzen 7000 series Zen 4 yang baru dirilis… Baru-baru ini, AMD telah secara resmi mengumumkan peluncuran seri CPU Desktop AMD Ryzen 7000 yang barudidukung oleh arsitektur mikro Zen 4 terbaru dari AMD, didukung oleh node proses N5 5nm…
Penawaran laptop siswa Black Friday terbaik untuk… Penawaran laptop Black Friday adalah waktu yang tepat untuk meningkatkan untuk periode berikutnya. Mahasiswa yang kekurangan uang tunai mendapatkan istirahat finansial yang bagus, dan orang tua yang membeli laptop untuk…
SubQuery: Membuat Kompatibilitas Lintas Rantai… SubQuery adalah agregasi data terdesentralisasi dan lapisan kueri antara blockchain Layer-1 dan aplikasi terdesentralisasi (dApps).Ini dirancang untuk membantu pengembang fokus pada kasus penggunaan inti dan fungsi front-end – sehingga mereka…
Raspberry Pi Zero 2 W seharga $15 siap untuk… Raspberry Pi Perusahaan Raspberry Pi terkenal dengan lini produk eponim utamanya, sekarang dalam inkarnasi keempatnya (dan juga menjadi sedikit lebih mahal, setidaknya untuk sementara). Tetapi ada berbagai macam variasi pada…
Apa itu layanan desktop dan bagaimana cara kerjanya? Desktop sebagai layanan (DaaS) adalah model untuk mengirimkan data melalui Internet. Ini adalah cara untuk menyerahkan pengelolaan dan penyimpanan data kepada pihak ketiga. Dengan DaaS, perusahaan dapat fokus pada kompetensi…
Mengapa IoT adalah landasan dari strategi zero-trust AWS 28 Desember 2021 07:40 Kredit Gambar: Shutterstock Mendengar dari CIO, CTO, dan eksekutif tingkat C dan senior lainnya tentang data dan strategi AI di Future of Work Summit 12 Januari…
Sepasang sampel rekayasa AMD Zen 4 telah muncul… Berwawasan ke depan: AMD mengumumkan Zen 4 awal pekan ini di CES 2022, tetapi mereka tidak merincinya. Jadi, biarkan kebocoran seri Ryzen 7000 dimulai. Sepasang sampel teknik telah ditemukan di…
3 Kesalahan Terbesar yang Dilakukan Perusahaan Saat… Menurut Hosting Tribunal, 94% perusahaan memiliki kehadiran cloud, tetapi hanya 20% yang telah mengalami transformasi cloud. Sebagian, itu karena transformasi cloud adalah inisiatif yang mahal bagi perusahaan, menghasilkan jutaan dolar…
McKinsey menyumbangkan alat pipa pembelajaran mesin… 19 Januari 2022 21:00 Kredit Gambar: Getty Images Apakah Anda melewatkan sesi dari Future of Work Summit? Kunjungi perpustakaan sesuai permintaan Future of Work Summit kami untuk streaming. Biarkan buletin…
Build Windows 11 baru yang tersedia untuk Insiders… Melalui kaca: Rilis Windows 11 terbaru telah mengganggu pengguna AMD dengan beberapa masalah kinerja yang terdokumentasi. Sebuah posting blog dari Tim Program Insider Windows menunjukkan bahwa perbaikan untuk kinerja cache…
Teknologi berbasis ML adalah terobosan berikutnya… 29 November 2021 16:40 Kredit Gambar: kentoh/Shutterstock Mendengar dari CIO, CTO, dan eksekutif tingkat C dan senior lainnya tentang data dan strategi AI di Future of Work Summit 12 Januari…
Survei Steam terbaru menunjukkan keuntungan di… Singkatnya: Ini adalah awal bulan baru, dan itu berarti Survei Uap yang diperbarui. November melihat AMD melanjutkan tren perlahan-lahan memotong keunggulan prosesor Intel. Dan sementara jumlah orang yang membeli kartu…
Motorola dan Verizon membuat '5G Neckband'… Semua orang menginginkan sepotong metaverse. Sejak Facebook mengganti nama dan membaptis dirinya sendiri Meta, minat pada VR dan AR telah melonjak lagi. Kami telah melihat perusahaan seperti Google, Samsung, LG…
5 Alat Manajemen Proyek untuk Pengembang Perangkat Lunak Ketika sebagian besar tim memikirkan perangkat lunak manajemen proyek, mereka berpikir untuk menggunakannya agar tetap teratur dan sesuai tugas. Namun, untuk pengembang perangkat lunak, alat manajemen proyek lebih dari itu.…