📝 Blog

Phân tích sâu về giá AI Trung Quốc, phát hành mô hình và chiến lược lấy ưu đãi tốt nhất.
  • GLM-5.2 miễn phí trên NVIDIA NIM: API không giới hạn, cắm vào Claude Code

    NVIDIA treo endpoint GLM-5.2 miễn phí trên build.nvidia.com, chuẩn OpenAI, không giới hạn request mỗi ngày. Hướng dẫn lấy Key và cắm vào Claude Code qua CC Switch trong năm phút.

  • Kimi K3 + claude-context: Giảm 27% tiêu thụ token nhờ truy xuất mã ngữ nghĩa

    Thử nghiệm thực tế trên codebase Django cho thấy việc thêm claude-context MCP vào Kimi K3 giúp giảm 27,1% tiêu thụ token và 55% lượt gọi tool, đồng thời nâng F1 định vị mã từ 0,844 lên 0,946.

  • Đánh giá Qwen 3.8 Max Token Plan: 1,5B token cho 39 yuan/tháng?

    Thử nghiệm thực tế Qwen 3.8 Max Token Plan của Alibaba giá 39 yuan/tháng. Dùng ban đêm cho ~1,5B token/tháng ở mức chiết khấu 0,2x, ban ngày ~300M ở 1x, và chỉ 30M ở giá gốc. Phân tích giá AI Trung Quốc.

  • Gemini 3.6 Flash: $7.50, 304 token/s — vì sao Google sẽ thắng cuộc đua AI

    Gemini 3.6 Flash cho tốc độ 304 token/s với giá output chỉ $7.50, vượt 3.1 Pro về độ thông minh. Với dữ liệu, nguồn tiền mặt, hạ tầng tính toán và nhân tài không đối thủ của Google — người chiến thắng cuối cùng của cuộc đua AI có thể đã được định đoạt.

  • Vì sao chuyện cấm Kimi K3 vô lý — và chỉ làm AI Trung Quốc mạnh thêm

    Axios đưa tin chính quyền Trump đang cân nhắc cấm các model AI Trung Quốc như Kimi K3 và DeepSeek. Ba lý do vì sao điều này không hiệu quả: trọng số mở đã phát hành thì không thể thu hồi, kiểm soát xuất khẩu GPU đã thất bại trong việc chặn tiến độ, và cấm một model chỉ chứng tỏ nó đủ cạnh tranh để bị để ý.

  • Đối đầu sinh mã AI: GPT-5.6 Sol vs Kimi K3 vs Qwen3.8Max

    Ba model tuyến đầu, một thử thách lập trình khắc nghiệt: sinh hệ mặt trời Three.js điện ảnh và trình kết xuất thành phố 50 tham số trong một file HTML duy nhất. Xem ai thắng và thử demo trực tiếp.

  • DeepSeek V4 bản chính thức: 121 gray test tiết lộ điều gì về hiệu năng lập trình

    Chúng tôi đã xem lại 121 video nghi là gray test DeepSeek V4 từ 53 tác giả, gồm 40 phiên lập trình được chia sẻ. Đây là những gì bằng chứng gợi ý về bản chính thức, giới hạn của nó, và DeepSeek V4 so với Kimi K3, GPT-5.6 và Fable 5.0.

  • Hướng dẫn quota Kimi K3: Bạn dùng được bao nhiêu? Giới hạn 5 giờ, hàng tuần và hàng tháng

    Quota thành viên Kimi K3 thực sự có bao nhiêu? Dựa trên dữ liệu người dùng Allegretto thực tế, chúng tôi ước tính giới hạn token 5 giờ, 7 ngày và hàng tháng cho các gói Andante, Moderato, Allegretto và Allegro, kèm quota Kimi Code, giá API và so sánh với GPT-5.6 để bạn chọn đúng gói.

  • Thử tay DeepSeek V4 gray release: 12 video & link chia sẻ kiểm chứng được

    Nhiều người dùng báo cáo API và app web của DeepSeek đang gray test một model có năng lực cao hơn. Chúng tôi tổng hợp 6 ảnh chụp thực tế, 4 chia sẻ chat DeepSeek chính thức, 9 log API OpenCode và 12 video — rồi đánh giá 'một prompt, một game hoàn chỉnh' thực sự hiệu quả đến đâu. Phiên bản model chính xác chưa được DeepSeek xác nhận.

  • Kimi K3 rò rỉ qua trang khuyến mãi nạp tiền: Chúng tôi biết gì trước khi ra mắt chính thức

    Moonshot AI đã công bố ngắn hạn trang khuyến mãi nạp tiền Kimi K3 trên platform.kimi.com vào ngày 14/7/2026 trước khi gỡ xuống. Vụ rò rỉ xác nhận tên K3, gợi ý đợt ra mắt sắp tới (15/7 – 11/8), và bật lộ khuyến mãi nạp 10-30% khá mạnh — nhưng bản thân model K3 vẫn chưa dùng được.

  • DeepSeek V4 bản chính thức rò rỉ: Vượt Claude Opus 4.8 với giá chỉ 1/90

    DeepSeek V4 bản chính thức rò rỉ qua gray release. Các tester độc lập xác nhận năng lực vượt Claude Opus 4.8, nằm giữa Opus 4.8 và Gemini 2.5 Pro. Có thể sinh game 3D hoàn chỉnh từ một prompt duy nhất. Giá bằng 1/90 Opus. Kèm 10 video test thực tế trên Bilibili.

  • MiniMax đang xây quái vật 3 nghìn tỷ tham số — và có thể thay đổi cục diện giá AI

    Ghi chú nội bộ rò rỉ cho thấy MiniMax đang xây model 3 nghìn tỷ tham số. Đây là những gì chúng tôi biết về kiến trúc, lộ trình, và ý nghĩa đối với giá AI.

  • Thị trường model AI đang chia đôi — đây là cách bạn định vị bản thân

    Model rẻ đang thành hạ tầng. Model tuyến đầu đang thành tài nguyên khan hiếm bị điều tiết. Giá trị thực không nằm ở việc sở hữu một tài khoản model nào đó — mà ở việc biết khi nào dùng cái rẻ, khi nào dùng cái đắt, và khi nào không nên dùng gì cả.

  • DeepSeek V4 áp dụng giá theo khung giờ: giờ cao điểm giá gấp 2x

    DeepSeek vừa thông báo giá API V4 sẽ nhân đôi trong giờ hành chính (9:00–12:00 và 14:00–18:00 giờ Bắc Kinh). V4 bản chính thức ra mắt giữa tháng 7, 2026. Ngay ở giá cao điểm, DeepSeek vẫn là AI API tuyến đầu rẻ nhất với khoảng cách rất lớn.

  • Giá theo khung giờ DeepSeek V4: Cẩm nang chênh lệch giá AI API

    DeepSeek vừa ra mắt bảng giá API theo khung giờ cao điểm/thấp điểm đầu tiên trên thế giới. Thấp điểm rẻ bằng một nửa — và nhờ chênh múi giờ, giờ cao điểm của người này luôn là thấp điểm của người khác. Đây là cách tận dụng điều đó.

  • 4 công cụ miễn phí dùng GLM 5.2 mà không tốn một xu

    GLM 5.2 đối đầu Claude Sonnet 4 trong benchmark lập trình. Dùng miễn phí qua 4 công cụ dành cho lập trình viên của Trung Quốc — ZCode, Trae, Tabbit, CodeBuddy.