Kết nối DeepSeek-V4-Flash vào Codex và Claude Code: rẻ, mạnh, không lo khoá tài khoản
Một trong những rào cản lớn nhất khi mới học lập trình cùng AI là chính công cụ: Codex và Claude Code — hai công cụ AI coding phổ biến nhất hiện nay — đều yêu cầu tài khoản OpenAI/Anthropic, hạn mức dùng thử nhanh hết, và không ít người từng gặp rủi ro bị khoá tài khoản khi dùng qua các kênh không chính thức. Bài viết này tổng hợp lại một hướng dẫn đang lan truyền trên mạng xã hội Trung Quốc: dùng DeepSeek-V4-Flash — vừa mở API công khai — để “thay não” cho cả Codex lẫn Claude Code, chạy thoải mái mà không cần tài khoản nước ngoài.
DeepSeek-V4-Flash mạnh và rẻ tới mức nào
DeepSeek-V4-Flash vừa chính thức mở API công khai (public beta) với mức giá rất thấp: khoảng 1 nhân dân tệ / triệu token đầu vào và 2 nhân dân tệ / triệu token đầu ra — chỉ bằng khoảng 1/10 giá của DeepSeek-V4-Pro.
Điểm đáng chú ý nhất là năng lực agent (tác vụ tự động, gọi công cụ, thực thi terminal) được tăng cường mạnh trong bản này. Trên Terminal-Bench — bộ benchmark chuyên đánh giá khả năng AI tự chủ thực thi tác vụ trong terminal — DeepSeek-V4-Flash đạt 82,7 điểm, thậm chí vượt qua bản preview của chính DeepSeek-V4-Pro (72,1 điểm). Theo một bảng xếp hạng “đường cắt” (kill line) được lan truyền, phiên bản Flash mới nhất đã vượt qua phần lớn các mô hình khác — kết hợp năng lực agent mạnh với chi phí cực thấp so với những mô hình “thông minh hơn” nhưng đắt gấp nhiều lần.
Yếu tố kỹ thuật quan trọng khiến việc tích hợp trở nên dễ dàng: DeepSeek-V4-Flash hỗ trợ native định dạng Responses API — chuẩn giao tiếp mà Codex (công cụ của OpenAI) sử dụng. Trước đây, muốn gắn một model nội địa Trung Quốc vào Codex, trở ngại lớn nhất luôn là bất tương thích giao thức: Codex dùng Responses API còn hầu hết model nội địa chỉ hỗ trợ Chat Completions API — hai chuẩn hoàn toàn khác nhau, đổi mỗi Base URL thường sẽ gặp lỗi 404, buộc phải dựng thêm một lớp proxy để chuyển đổi giao thức. DeepSeek-V4-Flash giải quyết luôn vấn đề này ở cấp API gốc, không cần lớp trung gian nào nữa.

Chuẩn bị: API key của DeepSeek
Dù tích hợp vào công cụ nào, bước đầu tiên đều giống nhau: vào nền tảng mở của DeepSeek, đăng ký/đăng nhập, vào mục API keys và tạo một key mới. Lưu ý key chỉ hiển thị đầy đủ đúng một lần lúc tạo — cần copy và lưu lại ngay để dùng cho các bước cấu hình sau.
Cách 1: Kết nối vào Codex
Codex là công cụ lập trình AI của OpenAI, có hai dạng: bản dòng lệnh (Codex CLI) chạy trong terminal, và bản desktop app có giao diện đồ hoạ. Cài bản CLI khá đơn giản, chỉ cần máy đã có Node.js rồi chạy:
npm install -g @openai/codex
Cách nhanh nhất — chạy script cấu hình tự động của DeepSeek. Trước khi chạy, cần đảm bảo Codex CLI (hoặc ChatGPT desktop app) đã được cài và khởi động ít nhất một lần, để nó tự sinh thư mục cấu hình ~/.codex.
Trên Windows (PowerShell):
irm https://cdn.deepseek.com/api-docs/codex-deepseek-setup-en.ps1 | iex
Trên Mac/Linux (Terminal):
bash <(curl -fsSL https://cdn.deepseek.com/api-docs/codex-deepseek-setup.sh)
Script sẽ hỏi bạn chọn model (nhập 1 để chọn DeepSeek-V4-Flash), sau đó hỏi API key. Nhấn Enter là xong — script tự động:
- Sao lưu cấu hình Codex hiện có vào
~/.codex/backup-deepseek/(có thể khôi phục bất cứ lúc nào) - Sinh file
~/.codex/models.jsonchứa metadata về model DeepSeek (kích thước cửa sổ ngữ cảnh, các mức reasoning được hỗ trợ…) - Ghi cấu hình API của DeepSeek vào
~/.codex/config.toml, giữ nguyên các MCP server và cấu hình dự án đã thiết lập trước đó - Tự kiểm tra cú pháp cấu hình, dừng lại nếu có lỗi để không làm hỏng file gốc
Mở lại Codex, nếu banner khởi động hiển thị deepseek-v4-flash là đã cấu hình thành công. Nếu dùng ChatGPT desktop app hoặc extension Codex cho VS Code, không cần cấu hình riêng — chúng dùng chung file cấu hình với bản CLI nên tự động nhận model mới. Muốn quay lại model gốc, chỉ cần chạy lại script và chọn mục khôi phục trong menu.
Cách 2 — chỉnh tay file cấu hình. Nếu không muốn chạy script, có thể tự sửa 2 file. Tạo file ~/.codex/models.json (nội dung lấy từ tài liệu chính thức của DeepSeek), sau đó thêm đoạn sau vào ~/.codex/config.toml:
model = "deepseek-v4-flash"
model_provider = "deepseek"
preferred_auth_method = "apikey"
forced_login_method = "api"
model_reasoning_effort = "high"
model_catalog_json = "~/.codex/models.json"
[model_providers.deepseek]
name = "deepseek"
base_url = "https://api.deepseek.com/"
wire_api = "responses"
experimental_bearer_token = "<API Key của bạn>"
Chi tiết mấu chốt nằm ở dòng wire_api = "responses" — chính là chỉ định Codex giao tiếp với DeepSeek bằng giao thức Responses API, thứ mà DeepSeek-V4-Flash hỗ trợ native nên chạy thẳng không cần trung gian.
Cách 2: Kết nối vào Claude Code
Claude Code là công cụ lập trình AI của Anthropic, chạy trong terminal, có thể tự phân tích project, viết code, chạy lệnh, sửa lỗi hoàn toàn tự động. Cài đặt cũng chỉ một dòng lệnh:
npm install -g @anthropic-ai/claude-code
Khác với Codex, DeepSeek hiện chưa có script tích hợp chính thức riêng cho Claude Code. Cách gọn nhất là dùng công cụ mã nguồn mở CC Switch — một app desktop đa nền tảng, miễn phí, cho phép quản lý cấu hình của nhiều công cụ AI coding (Claude Code, Codex, Gemini CLI, OpenCode…) qua giao diện trực quan, tránh phải tự sửa tay các file JSON/TOML/.env dễ gõ sai.
CC Switch có sẵn hơn 50 preset nhà cung cấp, bao gồm DeepSeek, Qwen, Kimi, GLM, MiniMax — chỉ cần vài cú click để đổi model, kể cả đổi nhanh từ khay hệ thống (system tray).
Cài CC Switch:
- macOS (qua Homebrew):
brew install --cask cc-switch - Windows: tải file
.msivà chạy - Linux: dùng AppImage, hoặc gói
.deb/.rpmtuỳ bản phân phối
Cấu hình model cho Claude Code:
- Mở CC Switch, ở thanh trên chọn Claude, bấm “Thêm nhà cung cấp” (Add Provider).
- Trong danh sách preset, chọn DeepSeek.
- Dán API key DeepSeek đã tạo ở bước chuẩn bị.
- Các trường còn lại giữ nguyên — preset DeepSeek của CC Switch đã cấu hình sẵn hai phiên bản: DeepSeek-V4-Pro (mặc định đóng vai trò “model chính”, tương ứng vị trí Opus trong Claude Code) và DeepSeek-V4-Flash (đóng vai “model nhỏ”, tương ứng vị trí Haiku). Nếu muốn tiết kiệm tối đa, có thể chuyển toàn bộ sang dùng V4-Flash — năng lực agent của nó đã đủ mạnh cho phần lớn công việc.
- Bấm “Lưu”, rồi bấm “Kích hoạt” để bật model DeepSeek.
Vào lại Claude Code, thử hỏi “bạn là model gì?” — nếu AI trả lời bình thường, nghĩa là đã chuyển thành công. Sở dĩ quy trình này đơn giản là vì DeepSeek đã cung cấp sẵn một endpoint tương thích giao thức Anthropic, đúng chuẩn mà Claude Code vốn dùng để giao tiếp — CC Switch chỉ đơn giản là ghi cấu hình đó vào file settings.json giúp bạn.
Hạn chế: DeepSeek-V4-Flash chưa “nhìn” được hình ảnh
DeepSeek-V4-Flash dù mạnh về agent nhưng vẫn là model thuần văn bản — nếu yêu cầu nó phân tích một ảnh chụp màn hình hay xem giao diện UI trông ra sao, nó sẽ không làm được. Cách khắc phục là cài thêm một Vision Skill — dùng một model đa phương thức khác (ví dụ Qwen3.8-Max của Alibaba) làm nhiệm vụ “nhìn hộ”: khi gặp tác vụ cần xem ảnh, Skill sẽ tự gửi ảnh sang model thị giác, chuyển nội dung ảnh thành mô tả văn bản, rồi giao lại cho DeepSeek tiếp tục suy luận. Skill dạng này hoạt động được trên cả Codex lẫn Claude Code vì đây là chuẩn Skill dùng chung. Nếu công việc thường ngày không cần AI xem ảnh, có thể bỏ qua bước này và cài sau khi thực sự cần.
Kết quả
Sau khi cấu hình xong, cả Codex và Claude Code đều chạy trên DeepSeek-V4-Flash: cửa sổ ngữ cảnh tới 1 triệu token, năng lực agent mạnh, chi phí rẻ hơn hẳn so với dùng thẳng model gốc của OpenAI/Anthropic — mà không cần tài khoản đăng ký ở nước ngoài, không lo hết hạn mức giữa chừng, cũng không còn nỗi lo bị khoá tài khoản khi dùng qua kênh trung gian không chính thức. Quy trình tương tự cũng áp dụng được nếu muốn đổi sang bất kỳ nhà cung cấp model nào khác mà CC Switch hoặc DeepSeek hỗ trợ.
Đang tải bình luận…