Hidemium Chatbot

Admin
📊 Sức khỏe Server & Thống kê Chịu tải (Live Metrics) Mock: Tắt
Chưa nạp
Bộ nhớ RAM tiến trình
- MB
Tiến trình CPU / Threads
-% / - thr
Database SQLite (WAL)
WAL · - MB
Rate Limit (Số lần chặn 429)
0 lần chặn
Tổng câu hỏi 💬
-
Lượt truy vấn tích lũy
Hôm nay
-
Số câu hỏi trong ngày
Tổng token 🪙
-
In: - / Out: -
Latency TB ⏱️
-
Thời gian phản hồi
Người dùng 👥
-
Tài khoản hoạt động
Tài liệu 📚
-
- chunks
Đánh giá
-
👍 - / 👎 -

📈 Thống kê theo ngày

Theo dõi biến động tần suất hỏi và lượng token tiêu thụ mỗi ngày
Ngày Lượt câu hỏi Token tiêu thụ Mức độ

💬 Lịch sử câu hỏi

Thời gian User Câu hỏi Trả lời Model Token Latency Đánh giá Xóa
Đang tải...
Trang 1 / 1
🧩 Cơ chế Vector Embedding: Đang tải... 0 chunks
📄

Kéo thả hoặc click để tải lên tài liệu mới

Hỗ trợ file Markdown (.md), Text (.txt) — Tự động phân đoạn và đánh chỉ mục vector

📚 Danh sách tài liệu đã đánh chỉ mục

Tên fileLoạiChunksKích thướcNgày uploadTrạng tháiThao tác
Tổng Input Tokens📥
-
Tokens đầu vào (câu hỏi + context)
Tổng Output Tokens📤
-
Tokens do model sinh ra
Tổng Cộng🪙
-
Toàn bộ token đã tiêu thụ
Lượt Yêu Cầu🔄
-
Số ngày có dữ liệu

📊 Tỷ lệ phân bổ Input / Output

⚡ Tiêu thụ Token theo ngày

🤖

🧮 Token Automation chia theo phần prompt

Mỗi lượt tạo/sửa workflow gửi cho AI: hiến pháp SKILL.md (ổn định, gửi lại mỗi lượt), yêu cầu, quét trang, mẫu node, đồ thị... Phần ổn định càng lớn thì cache tiền tố của nhà cung cấp càng có lợi. Ngân sách theo loại việc: đơn giản ≤ 20k · trung bình ≤ 40k · phức tạp ≤ 60k · sửa lỗi ≤ 15k/vòng.
Đang tải...
Đang tải dữ liệu token tiêu thụ...

👥 Danh sách người dùng hệ thống

IDTên đăng nhậpQuyềnSố câu hỏiNgày tạoTrạng tháiHành động

⭐ Phản hồi & Đánh giá từ người dùng

Thời gian Người dùng Câu hỏi Trả lời Model Đánh giá Thao tác
📊 Trạng thái hoạt động của 10 nhà cung cấp AI:
Đang kiểm tra cấu hình...
🧩
Cơ chế Vector Embedding API (OpenAI / Gemini vs Local) MỚI
Đang hoạt động: ... · Giúp giải phóng 98% CPU/RAM của máy chủ VPS.
🔀
Điều Hướng & Kiểm Soát Proxy Gateway (Bên B Quản Lý)
Ép model toàn hệ thống và chặn đứng nguy cơ bùng nổ token do vòng lặp Agent tự sửa vô tận.
⚪ Chưa ép (Theo Client)
Chọn model nhanh:
bước thử nghiệm & tự sửa tối đa mỗi câu lệnh trước khi ngắt an toàn (tiết kiệm TPM/token).
Chọn bước nhanh:
✨ Google Gemini 15 RPM Free
Google AI Studio · 1.000.000 tokens/ngày miễn phí · Model mặc định Gemini 3.6 Flash
Kiểm tra...
Model nổi bật (chuẩn github):
Lấy key tại Google AI Studio. Hỗ trợ multimodal và xử lý tài liệu lớn.
🟢 OpenAI Shared Traffic: 2.5M Mini & 250k Flagship/ngày Free
platform.openai.com · Miễn phí 2.5M tokens/ngày (dòng Mini/Nano/o-mini) & 250k tokens/ngày (dòng Flagship/Reasoning)
Kiểm tra...
⚡ Model Nhanh & Tiết kiệm 2.5 Triệu tokens/ngày
🧠 Model Mạnh & Flagship Lý luận 250 Ngàn tokens/ngày
Tài khoản được cấp hạn mức miễn phí Shared Traffic: 2.5 triệu tokens/ngày cho dòng Mini/Nano và 250 ngàn tokens/ngày cho dòng Flagship/Reasoning. Lấy key tại OpenAI Platform.
⚡ Groq Cloud (LPU Inference) 1,000 req/ngày Free
LPU Siêu Tốc · Tốc độ vài trăm token/giây trên phần cứng LPU · Miễn phí 1.000 req/ngày
Kiểm tra...
Model nổi bật:
Tốc độ xử lý siêu tốc vài trăm token/giây trên phần cứng LPU chuyên dụng. Hạn mức miễn phí 1,000 yêu cầu/ngày. Lấy key tại Groq Console.
☁️ Cloudflare Workers AI 10,000 Neurons/ngày Free
Serverless Edge AI toàn cầu · Miễn phí 10.000 neurons mỗi ngày · Không cần server
Kiểm tra...
📍 Lấy mã Account ID thật tại dash.cloudflare.com → chọn mục Workers & Pages (mã hex 32 ký tự ở sidebar bên phải). Tuyệt đối không dùng mã mẫu cf_acc_...
Model nổi bật:
AI serverless phân tán toàn cầu, 10,000 neurons miễn phí mỗi ngày. Tạo Token tại Cloudflare API Tokens (quyền Workers AI).
🌐 OpenRouter AI Nhiều model :free
openrouter.ai · Cổng kết nối hàng trăm AI thế giới · Nhiều model Free refresh hàng ngày
Kiểm tra...
Model miễn phí (:free):
Cổng kết nối hàng trăm model AI quốc tế. Lấy key tại OpenRouter Keys.
⚡ AionLabs (DeepSeek) Free Hàng Ngày
api.aionlabs.ai · Dòng model Aion luyện chế từ DeepSeek V3 · Quota cấp mới mỗi ngày
Kiểm tra...
Chọn nhanh:
Preset:
Dòng model Aion luyện chế từ DeepSeek. Lấy key tại OpenRouter hoặc AionLabs.
🟢 NVIDIA NIM 1,000 Free Credits
build.nvidia.com · Hạ tầng GPU NVIDIA cao cấp · Tặng 1.000 credits dùng thử
Kiểm tra...
Model nổi bật:
Preset:
Catalog mô hình NVIDIA GPU cao cấp. Lấy key tại NVIDIA Build.
🟣 Cohere AI Trial Key Free
dashboard.cohere.com · Command R/R+ chuyên sâu doanh nghiệp, đa ngôn ngữ & RAG
Kiểm tra...
Model nổi bật:
Dòng model mạnh mẽ tối ưu hóa cho tác vụ doanh nghiệp và RAG. Lấy key tại Cohere Dashboard.
🚀 Kilo Code Gateway 200 req/giờ Free
kilo.ai · Cổng AI mã nguồn mở khủng hoàn toàn miễn phí · 200 lượt/giờ · Hỗ trợ Nemotron 550B
Kiểm tra...
Model nổi bật:
Cổng cung cấp các model AI mã nguồn mở khủng hoàn toàn miễn phí (bao gồm Nemotron 550B) với 200 lượt/giờ. Lấy key tại Kilo Code.
🇫🇷 Mistral AI $10 Free Credits / tháng
console.mistral.ai · Hãng AI hàng đầu Châu Âu · Tặng $10 credit · Tối ưu code & suy luận logic
Kiểm tra...
Model nổi bật (chuẩn Mistral):
Hãng AI hàng đầu từ Châu Âu, hỗ trợ đa ngôn ngữ và lập trình vượt trội. Lấy key tại Mistral Console.
🦙 Ollama Cloud Free Usage Limits
ollama.com · 16 họ cloud models mã nguồn mở · Tương thích chuẩn OpenAI SDK tại /v1
Kiểm tra...
Model miễn phí (Cloud models):
Cung cấp tầng miễn phí (Free tier with usage limits) với 16 họ model đám mây từ thư viện Ollama. Tương thích chuẩn OpenAI API tại https://ollama.com/v1 hoặc dùng cho Ollama Local (mặc định http://localhost:11434/v1).
🔍 Langfuse (RAG Tracing & Observability) Free 50k Traces/tháng
cloud.langfuse.com · Giám sát toàn diện: Retrieval Chunks, Thời gian phản hồi, Token & Đánh giá Like/Dislike
Kiểm tra...
Khi tắt: Chatbot chỉ ghi nhận lịch sử câu hỏi, like/dislike và Knowledge Gap vào SQLite local mà không gửi trace lên đám mây Langfuse.
Preset khu vực:
Quản lý quan sát chất lượng RAG, tự động ghi nhận khi có key và tự động bỏ qua an toàn nếu chưa điền key. Đăng ký tài khoản tại cloud.langfuse.com.
🧠 Thiết lập Hệ thống AI & Tối ưu hóa RAG:
Đang tải thiết lập...
MỚI: Giảm 98% CPU

Chuyển đổi giữa chạy mô hình nhúng cục bộ trên CPU máy chủ hoặc gọi API Đám mây để giải phóng RAM & CPU trên VPS.

1. Lựa chọn nguồn xử lý Vector Embedding:
Collection: ... 384 chiều 0 chunks
🟢 Đang kích hoạt
Chatbot sẽ luôn ưu tiên gọi nhà cung cấp này trước. Nếu hết quota hoặc lỗi kết nối, hệ thống sẽ tự động chuyển tiếp (fallback) an toàn sang các dịch vụ AI khác đã cấu hình.

Lựa chọn phong cách phản hồi và mức độ kiểm soát phạm vi câu hỏi cho trợ lý AI.

📐 Ngưỡng khoảng cách tối đa (RAG Max Distance Cutoff)
Khoảng cách cosine càng nhỏ nghĩa là càng liên quan. Các chunk có khoảng cách vượt quá ngưỡng này sẽ bị loại bỏ khỏi ngữ cảnh. Khuyến nghị ChromaDB: 0.45 - 0.55.

Mô hình chuyên biệt phân tích lịch sử 3-4 câu gần nhất (duyệt từ mới nhất đến cũ hơn) để lọc bỏ chủ đề không liên quan, trích xuất Vấn đề cốt lõi, Tiến trình (Đã hỗ trợ vs Điểm nghẽn)Thông số môi trường khi phát hiện Knowledge Gap hoặc khách yêu cầu gặp KTV.

Gợi ý nhanh các model tốc độ cao (~0.5s - 1.2s):
Cú pháp: nhà_cung_cấp:tên_model (ví dụ: groq:llama-3.3-70b-versatile, gemini:gemini-2.5-flash) hoặc để auto để hệ thống tự điều phối theo chuỗi fallback an toàn.

Kiểm soát độ dài tối đa của câu trả lời do AI sinh ra. Hệ thống hỗ trợ tách bạch giới hạn token giữa chế độ Hỏi đáp QnA và chế độ Workflow Automation (để các quy trình phức tạp không bị cắt cụt giữa chừng).

💬 Hỏi đáp QnA (RAG Chatbot)

Khuyên dùng 2048 – 4096 tokens để tiết kiệm chi phí và phản hồi nhanh chóng.

tokens
Chọn nhanh:
Quy trình Automation (HideAuto ReAct)

Khuyên dùng 8192 – 16384 tokens cho các model suy luận (o4-mini, o1...) để đủ token nối node.

tokens
Chọn nhanh:

Chỉnh sửa trực tiếp prompt hệ thống cho từng Persona. Thẻ [GAP] giúp hệ thống phát hiện lỗ hổng tài liệu và tự động sinh Support Ticket.

🟢 Có tag [GAP]
0 ký tự
Lời nhắc Persona Hàng chuẩn: Áp dụng khi Bot Mode là strict
💡 Mẹo: Với Mode Hỏi đáp (Strict/Goofy), giữ nguyên cú pháp [GAP] để kích hoạt sinh ticket. Với Mode Tự động hóa, prompt định hướng ReAct Agent và tự động kế thừa các quy tắc từ SKILL.md.
Mặc định

Nội dung hiển thị khi người dùng bấm nút "📖 Hướng dẫn" trên thanh công cụ Workflow Mode trong Chat. Hỗ trợ đầy đủ định dạng Markdown.

💡 Lưu ý: Để trống sẽ tự động dùng hướng dẫn mặc định của hệ thống.
Mặc định: Bật

Khi câu hỏi có URL cần thao tác phần tử (bấm, nhập, đăng nhập, lấy dữ liệu…), bot quét trang trước khi đoán selector: ưu tiên trình duyệt sống của HideAuto nếu đang ở đúng trang (DOM thật sau JavaScript), không có thì tải nhanh HTML tĩnh (3 giây). Công tắc này chỉ tắt nguồn HTML tĩnh; trình duyệt sống luôn được dùng khi có. (Mặc định BẬT — khoảng 0,6–0,9k token mỗi lượt có quét; chỉ "mở trang, chụp màn hình" thì không quét.)

⚪ Đang tắt

Bảo vệ độc quyền endpoint /api/chat bằng thuật toán Sliding Window in-memory (không cần Redis). Ngăn chặn flood/spam từ người dùng thường (Tài khoản Admin tự động được miễn trừ).

⚡ Giới hạn tức thì (RPS - Requests Per Second):
câu / giây (chống click dồn)
⏱️ Giới hạn theo phút (RPM - Requests Per Minute):
câu / phút (kiểm soát hạn mức)

Cho phép chạy công cụ test tải (Locust / k6) bắn hàng chục nghìn request đo sức bền của CPU, RAM, SQLite và Network mà không tiêu tốn bất kỳ token nào của OpenAI/Gemini.

⚪ Đang tắt (Gọi LLM thật)
🎛️
Tùy Chọn Cá Nhân Hóa & Trải Nghiệm Hệ Thống PREFERENCES SUITE
Thiết lập phong cách giao diện Sáng / Tối, quy cách điều hướng đa nhiệm, cấu hình phím tắt gửi tin và công cụ dọn dẹp bộ nhớ phiên chat. Cấu hình được đồng bộ tự động giữa máy cục bộ và cơ sở dữ liệu tài khoản.
🎨 Giao Diện Hiển Thị & Tông Màu
Lựa chọn chế độ hiển thị phù hợp với điều kiện ánh sáng và sở thích làm việc của bạn.
Theme Selection
🧭 Điều Hướng & Hiển Thị Thông Số
Tùy biến hành vi chuyển đổi giữa các trang và giám sát thông số vận hành của AI.
Navigation & Telemetry
🔗
Mở liên kết giữa Chat và Admin trong tab mới (_blank)
Khi bật: Bấm nút "💬 Vào Chat Workspace" từ Admin hoặc nút "👤 Admin" từ Chat sẽ tự động mở trong tab trình duyệt mới, giúp bạn làm việc song song mà không bị mất bối cảnh trang hiện tại.
Hiển thị bộ đếm thông số kỹ thuật dưới câu trả lời
Hiển thị chi tiết số Tokens tiêu thụ, độ trễ phản hồi (ms) và tên model AI bên dưới câu trả lời trong trang Chat. Tắt đi nếu bạn muốn giao diện trò chuyện tinh gọn và tập trung hơn.
🚀 Bộ Đệm Ngữ Nghĩa & Tối Ưu Chi Phí (Semantic Cache)
Tối ưu tốc độ phản hồi tức thì (~20ms) và tiết kiệm 100% token cho các câu hỏi tương đương qua ChromaDB vector cache.
Cost & Latency
Bật Semantic Cache trong cả đoạn chat đã có lịch sử (Multi-turn Caching)
Mặc định TẮT: Hệ thống chỉ kích hoạt Semantic Cache ở câu hỏi đầu tiên (Turn 1) của phiên chat để bảo vệ ngữ cảnh cuộc trò chuyện.
Khi BẬT: Các câu hỏi ở lượt 2, 3, 4... nếu mang ý nghĩa tương tự câu hỏi đã có trong bộ đệm sẽ được trả lời ngay lập tức (0 token tiêu thụ) mà không cần gọi lại LLM.
⌨️ Phím Tắt Gửi Tin Nhắn Trong Khung Chat
Chọn tổ hợp phím gửi tin phù hợp với thói quen gõ phím của bạn. Khung chat sẽ tự động cập nhật gợi ý dưới chân dock.
Keyboard Shortcuts
🧹 Quản Lý Phiên Chat & Dọn Dẹp Nhanh
Xóa sạch dữ liệu bộ nhớ đệm tạm thời trên trình duyệt và cấp mới phiên làm việc.
Maintenance
⚠️ Dọn sạch màn hình & Làm mới phiên chat (Quick Clear) Phím tắt: Alt + C
Thao tác này sẽ xóa sạch toàn bộ bong bóng chat đang hiển thị trên màn hình, giải phóng transcript cục bộ và tạo một mã Session ID hoàn toàn mới.
☁️ Tự động đồng bộ với tài khoản Admin
📌
Kế Hoạch Nâng Cấp Chiến Lược (TODO List - Commercial Chatbot)
STRATEGIC ROADMAP
Đúc kết từ mô hình vận hành của các chatbot thương mại đầu ngành (Intercom Fin, Zendesk AI, Crisp, Drift). Quản lý danh sách sáng kiến tính năng, rào cản kỹ thuật và lộ trình tích hợp API/Desktop App cho Hidemium Chatbot.
SÁNG KIẾN ĐANG CHỜ
4 Mục Chờ Triển Khai
Sắp xếp tự động theo thứ tự ưu tiên
MỤC ĐÃ HOÀN THÀNH
1 Mục Đã Xong
Tự động làm mờ và chuyển xuống cuối
HÀNH ĐỘNG NHANH
✨ Thêm Mục Kế Hoạch / Sáng Kiến TODO Mới
Đang tải danh sách TODO...
📋 Bảng Tổng Hợp Trạng Thái Các Sáng Kiến
STT Sáng kiến / Tính năng Phân loại Độ ưu tiên Trạng thái hiện tại
Đang cập nhật dữ liệu...