Bạn có thể bắt đầu mà không tốn đồng nào

Cài đặt RefineLoop trong khoảng 3 phút

Trong 14 ngày đầu bạn có thể bỏ qua cả trang này: bấm Start ở màn hình đầu tiên của ứng dụng, mọi thứ chạy qua kết nối có sẵn của RefineLoop: không key, không tài khoản, không phải tạo gì cả. Khi muốn có kết nối của riêng mình (miễn phí, và là của bạn mãi mãi), ứng dụng dẫn từng bước: Cài đặt (Ctrl+Alt+O) → Get connected free. Trang này là bản đầy đủ của chính hướng dẫn đó, để đọc trước hoặc giúp người khác.

GroqMiễn phí, không cần thẻ, một key lo cả viết, nghe và giọng đọc.Miễn phí · không cần thẻGoogle GeminiMiễn phí với model Flash; một số tài khoản bị yêu cầu bật billing.Miễn phí · tuỳ tài khoảnOllama trên máy bạnKhông gì rời khỏi máy tính. Cần card đồ hoạ rời thì mới nhanh.Miễn phí mãi mãi · offlineAzure, OpenAI, ClaudeChất lượng tốt nhất, và là lựa chọn cho dữ liệu công ty.Trả theo dùng · vài trăm đồng/ngày

Cách miễn phí 1: lấy key Groq (không cần thẻ)

Cách nhanh nhất để RefineLoop chạy được ngay hôm nay. Gói miễn phí của Groq không có credit, không cần thẻ, chỉ giới hạn tốc độ.

  1. Mở console.groq.com và đăng nhập bằng Google, GitHub hoặc email.
  2. Vào mục API Keys rồi bấm Create API key. Copy key: key bắt đầu bằng gsk_.
  3. Trong RefineLoop nhấn Ctrl+Alt+O, chọn Provider là groq, rồi dán key vào.
  4. Để nguyên model openai/gpt-oss-120b, bấm Test connection, rồi Save all.
  5. Riêng phần giọng đọc: Groq yêu cầu chấp nhận điều khoản một lần cho model giọng nói. Mở console.groq.com/playground, chọn model giọng Orpheus và bấm đồng ý. Sau đó bấm Test voice ở mục 3 trong Cài đặt. Phần nhận dạng giọng nói thì không cần bước này.

Một key chạy được mọi thứ. Groq còn có cả nhận dạng giọng nói (Whisper) và giọng đọc (Orpheus) trên cùng key miễn phí đó, nên đọc chính tả, tin nhắn thoại và giọng đọc tự nhiên chạy được ngay: không cần Python, không cần deploy gì thêm. Nếu bạn không muốn cài Python, chỉ cần chọn “Speech-to-text runs” = Same as AI model ở mục 2. Hạn mức miễn phí, đo thực tế trên một key thật: khoảng 1.000 lượt sửa, 2.000 lượt đọc chính tả và 8 giờ âm thanh mỗi ngày (một người dùng không hết), riêng giọng đọc thì khoảng 100 lượt phát mỗi ngày. Hết lượt thì RefineLoop tự chuyển sang giọng đọc của Windows, âm thanh không bao giờ tắt, chỉ bớt hay đi cho đến hôm sau. Groq chạy model mã nguồn mở (Llama, Qwen, GPT-OSS), sửa tiếng Anh tốt; còn giải thích tiếng Việt thì key trả phí Gemini/OpenAI/Claude vẫn hay hơn rõ rệt, đổi sau chỉ cần chọn lại trong dropdown.

Cách miễn phí 2: lấy key Google Gemini

Vẫn miễn phí với các model Flash mà chúng ta dùng, nhưng Google đang siết dần. Nếu AI Studio bắt bạn bật billing, hãy dùng Groq ở trên; RefineLoop chạy như nhau với cả hai.

  1. Mở aistudio.google.com/apikey và đăng nhập bằng tài khoản Google bất kỳ.
  2. Bấm Create API key. Nếu nó hỏi chọn project thì chọn project nào cũng được.
  3. Copy key. Key có dạng AIza… và chỉ hiện một lần, nên hãy lưu lại chỗ an toàn.
  4. Trong RefineLoop nhấn Ctrl+Alt+O, chọn Provider là gemini, rồi dán key vào ô API key.
  5. Để nguyên model gemini-2.5-flash, bấm Test connection, rồi Save all. Xong, thử Ctrl+Alt+B với một câu tiếng Anh.

Lưu ý: ở gói miễn phí của Google, nội dung bạn gửi có thể được dùng để cải thiện sản phẩm của họ. Điều đó ổn khi bạn luyện tiếng Anh và chat hằng ngày. Với văn bản công việc cần bảo mật, hãy dùng key trả phí hoặc Ollama, ứng dụng hoạt động như nhau với mọi provider.

Miễn phí và riêng tư tuyệt đối: Ollama chạy trên máy bạn

Không key, không tài khoản, không cần mạng sau khi tải xong. RefineLoop tự cài giúp bạn, cách này không phải gõ dòng lệnh nào. Đổi lại là tốc độ: cách này cần card đồ hoạ rời. Trên laptop dùng card tích hợp, tra một từ mất khoảng 20 giây, trong khi key cloud miễn phí trả lời trong một hai giây.

  1. Trong RefineLoop nhấn Ctrl+Alt+O và chọn Provider là ollama.
  2. RefineLoop kiểm tra máy bạn còn thiếu gì và hỏi có cài giúp không. Bấm Set it up là nó tự tải Ollama, chạy bộ cài, khởi động và tải model. Chưa bấm nút đó thì không có gì được tải về.
  3. Chọn model khi được hỏi: llama3.1 (khoảng 4,7 GB) là bản nên dùng, gemma3:4b (khoảng 3,3 GB) hợp với laptop cấu hình thấp.
  4. Khi báo đã sẵn sàng, bấm Save all. Từ đó RefineLoop tự khởi động Ollama mỗi khi cần.

Model chạy trên máy yếu hơn model cloud, nhất là với tiếng Việt và phần giải thích “vì sao sai”. Nhiều người bắt đầu bằng Gemini rồi mới chuyển sang Ollama cho công việc nhạy cảm.

Nâng cao: gateway AI của riêng bạn (OmniRoute, LiteLLM, LM Studio…)

Nếu bạn đã chạy sẵn một gateway cục bộ nói chuẩn OpenAI API và tự định tuyến đến các nhà cung cấp bạn chọn, RefineLoop dùng được nó như mọi endpoint khác. Cách này dành cho người quen vận hành server. Không ai bắt buộc phải dùng, và các cách phía trên vẫn đơn giản hơn.

  1. Trong RefineLoop nhấn Ctrl+Alt+O, chọn Provider là custom, nhập địa chỉ gateway vào Endpoint: với OmniRoute là http://localhost:20128/v1, API key lấy từ dashboard của nó, model ghi auto.
  2. TẮT tính năng nén prompt của gateway (OmniRoute: Dashboard → Settings → Compression → off, toàn cục). Nén sẽ viết lại những đoạn “dài dòng” trước khi gửi, mà chính những câu chưa chuẩn của bạn là thứ RefineLoop cần được chuyển đi nguyên vẹn. Prompt bị nén sẽ âm thầm làm hỏng phần sửa lỗi.
  3. Ở mục 2, chọn Speech-to-text runs on là This PC. Gateway thường không tải âm thanh, còn nhận dạng giọng nói cục bộ kèm sẵn vẫn chạy bình thường.
  4. Bấm Test connection, rồi Save all.

Nói thẳng: có hai giới hạn. RefineLoop coi endpoint localhost là model chạy tại chỗ, nên sẽ dùng bộ prompt ngắn viết cho máy yếu ngay cả khi gateway của bạn định tuyến đến model đám mây lớn. Chất lượng có thể kém hơn một chút so với kết nối thẳng nhà cung cấp đó. Và quyền riêng tư nằm ở việc gateway làm gì, không phải địa chỉ trông thế nào: localhost ở đây chỉ là một chặng, văn bản của bạn vẫn đi tiếp đến nhà cung cấp mà gateway chọn.

Giọng nói: không cần cấu hình gì

Đọc chính tả, tin nhắn thoại, nghe lại tức thì và shadowing chạy được ngay.

  1. Ứng dụng tự chạy một server nhỏ nhận dạng giọng nói ngay trên máy bạn, ẩn hoàn toàn. Giọng của bạn không rời khỏi máy.
  2. Cần Python: nếu máy chưa có, lần đầu bấm phím tắt giọng nói, ứng dụng sẽ đề nghị cài giúp bạn (khoảng 25 MB, một cú bấm). Tự cài từ python.org với “Add python.exe to PATH” cũng được.
  3. Lần dùng đầu tiên sẽ tải model nhận dạng (khoảng 460 MB), chỉ một lần. Sau đó chạy ngay và không cần mạng.

Khi có lỗi

Connection refused (localhost:11434)Provider đang là ollama nhưng Ollama chưa chạy. Hãy mở Ollama, hoặc đổi provider sang gemini.
DeploymentNotFoundAzure: ô Deployment phải điền tên deployment trong Azure portal, không phải tên model.
401 / UnauthorizedAPI key sai, hết hạn, hoặc dính dấu cách thừa. Dán lại, bật Show keys để kiểm tra.
Nhấn phím tắt mà không có gì xảy raỨng dụng khác đang giữ phím đó. Menu khay hệ thống hiện cảnh báo đỏ; bấm vào để đổi phím.
Giọng đọc nghe như máyBạn đang nghe giọng Windows dự phòng. Bấm Test voice ở mục 3 trong Cài đặt - nó báo đúng lý do. Với Groq: vào playground chấp nhận điều khoản model giọng nói; với Azure: thêm deployment tts.
Tính năng giọng nói không chạyThiếu Python: bấm phím tắt giọng nói và chọn Set it up để ứng dụng cài giúp; hoặc xem logs\whisper-server.log.

Vẫn bí? Gửi email tới support@refineloop.app kèm mô tả bạn thấy gì trên màn hình, có ảnh chụp thì càng tốt.

← Về trang RefineLoop