Filter
ML
Build an Android chat application with ONNX Runtime API
Kotlin - CPP - ONNX Runtime - Android - Hugging Face
05 Aug 2026 1 hr
ML
Build an Android chat app with Llama, KleidiAI, ExecuTorch, and XNNPACK
Java - CPP - Python - Hugging Face - ExecuTorch
05 Aug 2026 1 hr
ML
Run vLLM inference with INT4 quantization on Arm servers
vLLM - LM Evaluation Harness - LLM - Generative AI - Python
31 Jul 2026 1 hr
ML
Run an LLM chatbot with rtp-llm on Arm-based servers
LLM - Generative AI - Python - Hugging Face - Linux
31 Jul 2026 30 min
ML
Run a Natural Language Processing (NLP) model from Hugging Face on Arm servers
Python - PyTorch - Hugging Face - Linux
31 Jul 2026 20 min
ML
Run a Large Language Model (LLM) chatbot with PyTorch using KleidiAI on Arm servers
LLM - Generative AI - Python - PyTorch - Hugging Face
31 Jul 2026 30 min
ML
Deploy Arcee AFM-4.5B on Arm-based Google Cloud Axion with Llama.cpp
Google Cloud - Hugging Face - Python - llama.cpp - Linux
31 Jul 2026 30 min
ML
Deploy Arcee AFM-4.5B on Arm-based AWS Graviton4 with Llama.cpp
AWS - Hugging Face - Python - llama.cpp - Linux
31 Jul 2026 30 min
ML
Deploy a RAG-based Chatbot with llama-cpp-python using KleidiAI on Google Axion processors
Python - Streamlit - Google Axion - Demo - Hugging Face
31 Jul 2026 45 min
ML
Deploy a Large Language Model (LLM) chatbot with llama.cpp using KleidiAI on Arm servers
LLM - Generative AI - Python - Demo - Hugging Face
31 Jul 2026 30 min
ML
Build and run vLLM on Arm servers
vLLM - LLM - Generative AI - Python - Hugging Face
31 Jul 2026 45 min
ML
Build a RAG application using Zilliz Cloud on Arm servers
Python - Generative AI - RAG - Hugging Face - Linux
31 Jul 2026 20 min
ML
Accelerate Whisper on Arm with Hugging Face Transformers
Python - Whisper - Demo - Hugging Face - Linux
31 Jul 2026 15 min
ML
Accelerate Natural Language Processing (NLP) models from Hugging Face on Arm servers
Python - PyTorch - Hugging Face - Linux
31 Jul 2026 20 min
ML
Fine-tune PyTorch models on DGX Spark
Python - PyTorch - Docker - Hugging Face - Linux
29 Jul 2026 1 hr
ML
Build a RAG pipeline on Arm-based NVIDIA DGX Spark
Python - llama.cpp - Hugging Face - Linux
28 Jul 2026 1 hr
PERFORMANCE AND ARCHITECTURE
Generate audio with Stable Audio Open Small on LiteRT
CPP - Python - Hugging Face - Linux - Android
19 Jun 2026 30 min
ML
Run vLLM inference with quantized models and benchmark on Arm servers
vLLM - Python - PyTorch - Hugging Face - Linux
17 Jun 2026 1 hr
ML
Run LLM inference on Android with KleidiAI, MediaPipe, and XNNPACK
Java - MediaPipe - Android SDK - Android NDK - Bazel
17 Jun 2026 1 hr
ML
Profile the Performance of AI and ML Mobile Applications on Arm
Android Studio - LiteRT - Hugging Face - Android - Linux
17 Jun 2026 1 hr
PERFORMANCE AND ARCHITECTURE
Generate audio with Stable Audio Open Small using ExecuTorch
CPP - Python - Hugging Face - ExecuTorch - Linux
17 Jun 2026 45 min