Giới thiệu về Local LLM
Trên thiết bị LLM.
Ứng dụng LLM cục bộ chạy các mô hình AI mã nguồn mở trực tiếp trên điện thoại của bạn. Không cần máy chủ, không cần tài khoản và không cần kết nối internet sau khi mô hình được tải xuống. Cuộc trò chuyện của bạn không bao giờ rời khỏi thiết bị.
TẠI SAO LẠI CHỈ CHỈ CHẠY TRÊN THIẾT BỊ?
Mọi lời nhắc bạn nhập đều được trả lời bởi một mô hình đang chạy trên phần cứng của chính bạn. Không có gì được tải lên, không có gì được ghi lại trên máy chủ và không có gì được sử dụng để huấn luyện mô hình của bất kỳ ai. Đặt điện thoại ở chế độ máy bay và nó vẫn hoạt động.
CHỌN MẪU CỦA BẠN
Có bảy mẫu có sẵn trong ứng dụng, từ SmolLM2 369 MB chạy mượt mà trên phần cứng tầm trung đến Llama 3.2 3B cho khả năng phản hồi mạnh mẽ hơn:
• SmolLM2 360M — nhanh nhất, RAM thấp nhất
• Qwen2.5 0.5B — rất nhanh, chất lượng ổn định
• TinyLlama 1.1B — cổ điển nhẹ nhàng
• Llama 3.2 1B — mặc định cân bằng
• Qwen2.5 1.5B — khả năng suy luận mạnh mẽ hơn
• Gemma 2 2B — chất lượng cao, chậm hơn
• Llama 3.2 3B — chất lượng tốt nhất, cần dung lượng dự phòng
Mỗi mẫu đều hiển thị kích thước tải xuống chính xác trước khi bạn xác nhận. Bạn cũng có thể dán liên kết trực tiếp đến bất kỳ mẫu GGUF nào bạn thích và chuyển đổi mẫu bất cứ lúc nào mà không cần rời khỏi cuộc trò chuyện.
TRÒ CHUYỆN LƯU TRỮ
Các cuộc trò chuyện được lưu trong cơ sở dữ liệu riêng tư trên thiết bị của bạn. Tiêu đề được chính mô hình viết ra, vì vậy lịch sử trò chuyện của bạn rất dễ xem lại. Mở lại bất kỳ cuộc trò chuyện nào trước đây hoặc xóa tất cả chỉ bằng một lần chạm. Markdown hiển thị đúng cách, với các khối mã được tô sáng cú pháp và sao chép chỉ bằng một lần chạm.
API CỤC BỘ CHO CÁC THIẾT BỊ KHÁC CỦA BẠN
Bật dịch vụ API tùy chọn và điện thoại của bạn sẽ cung cấp mô hình thông qua điểm cuối HTTP tương thích với OpenAI trên mạng cục bộ của bạn. Trỏ bất kỳ ứng dụng khách OpenAI nào đến đó — curl, SDK Python, tập lệnh của riêng bạn — và nhận các gợi ý hoàn thành từ mô hình trong túi của bạn, qua USB hoặc Wi-Fi. Hỗ trợ truyền phát. Nó sẽ tắt cho đến khi bạn bật nó và chạy với thông báo hiển thị khi đang hoạt động.
ĐƯỢC XÂY DỰNG CHO QUYỀN RIÊNG TƯ
• Không cần tài khoản, không cần đăng nhập, không có quảng cáo
• Trò chuyện chỉ được lưu trữ trên thiết bị của bạn
• Văn bản tin nhắn không bao giờ được truyền đi bất cứ đâu
• Chỉ phân tích sử dụng ẩn danh, không bao giờ là nội dung tin nhắn
LƯU Ý VỀ ĐẦU RA CỦA AI
Phản hồi đến từ các mô hình open-weight chạy cục bộ. Những thông tin này có thể sai, lỗi thời hoặc không phù hợp, và chưa được ai kiểm duyệt. Vui lòng không dựa vào chúng để đưa ra các quyết định về y tế, pháp lý hoặc tài chính.
YÊU CẦU
Thiết bị Android 7.0 trở lên, 64-bit. Tải xuống một mô hình duy nhất có dung lượng 369 MB trở lên, và khoảng 1-3 GB RAM trống tùy thuộc vào mô hình bạn chọn. Các mô hình lớn hơn sẽ chạy chậm hơn đáng kể trên các điện thoại đời cũ.
What's new in the latest 1.0
• Chat with AI models that run entirely on your phone. No cloud, no account, and nothing you type ever leaves the device.
• Choose from seven models, from a 369 MB SmolLM2 up to Llama 3.2 3B, or paste a link to your own GGUF file.
• Conversations are saved on-device, with titles written by the model itself.
• Optional local API, OpenAI-compatible, so your laptop can use the model over USB or Wi-Fi.
Thông tin APK Local LLM
Phiên bản cũ của Local LLM
Tải xuống siêu nhanh và an toàn thông qua Ứng dụng APKPure
Một cú nhấp chuột để cài đặt các tệp XAPK/APK trên Android!





