<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:content="http://purl.org/rss/1.0/modules/content/"><channel><title>On-Device-Ai on Glory Hinody</title><link>https://glory-hinody.pages.dev/tags/on-device-ai/</link><description>Recent content in On-Device-Ai on Glory Hinody</description><generator>Hugo</generator><language>vi</language><lastBuildDate>Tue, 29 Sep 2026 12:00:00 +0700</lastBuildDate><atom:link href="https://glory-hinody.pages.dev/tags/on-device-ai/index.xml" rel="self" type="application/rss+xml"/><item><title>On-Device AI: Chạy Neural Network Offline Với ONNX Trên Mobile</title><link>https://glory-hinody.pages.dev/posts/on-device-ai-onnx-kotlin/</link><pubDate>Tue, 29 Sep 2026 12:00:00 +0700</pubDate><guid>https://glory-hinody.pages.dev/posts/on-device-ai-onnx-kotlin/</guid><description>AI Lingua – ứng dụng học ngoại ngữ đa nền tảng (iOS, Android, Desktop) tích hợp mạng nơ-ron ONNX nhận diện nét viết offline hoàn toàn (0đ chi phí API), thuật toán FSRS và LLM Fallback Chain.</description></item><item><title>Quantization Int8/FP4: Chạy Model AI Lớn Trên GPU Tài Nguyên Giới Hạn</title><link>https://glory-hinody.pages.dev/posts/quantization-int8-fp4-inference/</link><pubDate>Tue, 29 Sep 2026 12:00:00 +0700</pubDate><guid>https://glory-hinody.pages.dev/posts/quantization-int8-fp4-inference/</guid><description>Phân tích toán học và đo đạc thực nghiệm kỹ thuật nén lượng tử hóa Int8 và FP4 giúp chạy các mô hình Diffusion Transformer 13B–30B trên GPU 16GB không bị tràn bộ nhớ (OOM).</description></item></channel></rss>