Chat cục bộ riêng tư
Trò chuyện streaming với model cục bộ qua Ollama. Workspace với system prompt và model mặc định riêng, tự động đặt tên hội thoại, lịch sử lưu trên ổ đĩa, xuất ra Markdown hoặc JSON.
Chat với model AI cục bộ, hỏi đáp tài liệu với trích dẫn nguồn, và để code agent an toàn làm việc trên dự án của bạn. VaiChat giữ mọi thứ trên máy Mac và iPhone — không tài khoản, không cloud, không thu thập dữ liệu.
Miễn phí. Hoạt động với Ollama, LM Studio, OmniRoute và mọi server tương thích OpenAI.
Model chạy trên thiết bị của bạn. Hội thoại, tài liệu và code không bao giờ rời khỏi máy.
Không tài khoản, không hóa đơn API, không phí hàng tháng. Dùng model cục bộ của bạn — hoặc tùy chọn kết nối nhà cung cấp cloud.
Sau khi tải model, chat, hỏi đáp tài liệu và code agent đều chạy không cần internet.
Một ứng dụng cho chat riêng tư, hiểu tài liệu và lập trình — xây dựng quanh model cục bộ.
Trò chuyện streaming với model cục bộ qua Ollama. Workspace với system prompt và model mặc định riêng, tự động đặt tên hội thoại, lịch sử lưu trên ổ đĩa, xuất ra Markdown hoặc JSON.
Thả file TXT, Markdown hoặc PDF vào. VaiChat cắt đoạn, tạo embedding và lập chỉ mục ngay trên máy, rồi trả lời câu hỏi kèm trích dẫn chỉ đúng đoạn nguồn.
Trỏ vào một dự án và hỏi về codebase. Ở chế độ agent, nó có thể sửa file và chạy lệnh — mỗi lần sửa kết thúc bằng diff để bạn chấp nhận hoặc hoàn tác, mỗi lệnh đều cần bạn phê duyệt.
Duyệt thư viện ollama.com, kéo model với thanh tiến trình, xem badge năng lực (chat, tools, vision, thinking, embedding), độ dài context và dung lượng, đo độ trễ chỉ một cú nhấp.
Thêm bất kỳ endpoint tương thích OpenAI — LM Studio, vLLM, OmniRoute hay API cloud. Mọi model hiện trong một danh sách chọn và VaiChat tự định tuyến từng cuộc chat đến đúng nhà cung cấp.
Agent tự nhận diện workspace Xcode, liệt kê scheme, build và test bằng xcodebuild, biến output build thô thành chẩn đoán có cấu trúc, nhấp được, kèm tóm tắt đạt/lỗi.
Không gian làm việc đầy đủ: chat, RAG tài liệu có trích dẫn, code agent kiểm soát quyền và Model Center.
Cùng một AI riêng tư trên iPhone và iPad — model chạy trên máy, hoặc dùng model trên máy Mac qua mạng nội bộ.
Tải Ollama từ ollama.com — runtime model cục bộ mã nguồn mở, miễn phí mà VaiChat xây dựng trên đó.
Cài VaiChat trên máy Mac, mở Model Center và kéo một model — model 4B chạy mượt trên Apple Silicon.
Tạo workspace, thả tài liệu vào hoặc mở dự án code, rồi bắt đầu hỏi. Mọi thứ ở lại trên thiết bị của bạn.
Có. VaiChat là local-first: model chạy trên thiết bị của bạn qua Ollama (hoặc server cục bộ khác), còn hội thoại, tài liệu và embedding lưu trong cơ sở dữ liệu SQLite cục bộ. Không có gì được tải lên và không có telemetry. Chỉ khi bạn chủ động cấu hình nhà cung cấp cloud thì lưu lượng đó mới rời khỏi máy.
Chỉ để tải model. Sau đó, chat, hỏi đáp tài liệu và code agent đều chạy hoàn toàn offline.
Mọi model trong thư viện Ollama — Llama, Gemma, Qwen, Mistral, DeepSeek và nhiều hơn nữa. Bạn cũng có thể kết nối LM Studio, vLLM, OmniRoute hay bất kỳ API tương thích OpenAI, trộn model cục bộ và cloud trong một danh sách chọn.
Nó được thiết kế xoay quanh quyền hạn. Việc đọc bị giới hạn trong thư mục dự án; sửa file chỉ được phép ở chế độ agent và luôn kết thúc bằng diff để bạn chấp nhận hoặc hoàn tác; mọi lệnh shell cần bạn phê duyệt rõ ràng, và các lệnh phá hoại bị chặn cứng.
VaiChat miễn phí. Không tài khoản, không thuê bao, không đo lường sử dụng — model cục bộ chạy không tốn đồng nào.
Khuyến nghị máy Mac dùng Apple Silicon (8 GB RAM chạy tốt model nhỏ; 16 GB trở lên thoải mái cho model lớn hơn). Ứng dụng iOS chạy model on-device trên iPhone và iPad đời mới, và cũng dùng được model trên máy Mac qua Wi-Fi.
Riêng tư, cục bộ và miễn phí. Tải VaiChat và chạy AI của riêng bạn trong vài phút.