
Hugging Face Inference Providers: Gọi LLM bằng API với Python
Hướng dẫn dùng Hugging Face Inference Providers để gọi LLM bằng Python, nhận kết quả streaming, chọn provider và theo dõi chi phí mà không cần tự triển khai Model.

Hướng dẫn dùng Hugging Face Inference Providers để gọi LLM bằng Python, nhận kết quả streaming, chọn provider và theo dõi chi phí mà không cần tự triển khai Model.

KRun giúp chạy script, module và notebook Python trên Kaggle từ terminal, theo dõi log và tải kết quả về máy.

MyNotebook là project RAG mình xây dựng với VietRAG-Embed, Qdrant và FastAPI: tìm kiếm tài liệu bằng Hybrid Search, trả lời streaming và mở rộng qua Agent.

VietRAG-Embed là Embedding Model tiếng Việt mình Fine-tune từ multilingual-e5-base trên 937.686 mẫu Retrieval. Bài viết ghi lại quá trình xây dựng dữ liệu, Hard Negative, Training và Benchmark.

Supabase là nền tảng Backend as a Service dựa trên PostgreSQL, tích hợp Database, Auth, Storage, Realtime và Edge Functions. Bài viết này hướng dẫn bạn xây dựng Backend đầu tiên với Supabase.

Giới thiệu VietEmbed-RAG Science: Bộ dữ liệu tiếng Việt cho Embedding và RAG

Prompt Engineering được hiểu đơn giản là quá trình thiết kế Prompt để hướng Model tạo ra Output phù hợp hơn với mục tiêu của chúng ta. Trong bài viết này mình sẽ đi qua những phần quan trọng của Prompt Engineering dựa trên Chapter 6 của cuốn Hands-On Large Language Models của Jay Alammar và Maarten Grootendorst.

Cách sử dụng SQLAlchemy để kết nối và thao tác với Database

Giới thiệu về FastAPI Python

Các hàm Loss phổ biến trong Sentence Transformers

Các phương pháp tăng cường dữ liệu trong quá trình huấn luyện mô hình học sâu

Tóm tắt những phần quan trọng nhất để có thể bắt đầu Fine-tune một Embedding Model, chủ yếu dựa trên bài viết Training and Finetuning Embedding Models with Sentence Transformers của Hugging Face.

Đọc nội dung trong paper VN-MTEB: Vietnamese Massive Text Embedding Benchmark để học hỏi và rút kinh nghiệm

Giới thiệu về phương pháp Nhận dạng giọng nói (ASR) cho hệ thống Video Retrieval

Giới thiệu về cách mình đã thiết kế hệ thống sử dụng LLM trong quá trình thực hiện đồ án môn học Tư Duy Tính Toán

Giới thiệu về cách hoạt động bên trong LLM Tokenization

Các nền tảng cung cấp GPU miễn phí, giá rẻ cho người mới