📝 Blogg

Djupdykningar i kinesiska AI-priser, modellreleaser och strategier för att få bästa pris.
  • GLM-5.2 gratis på NVIDIA NIM – obegränsat API i Claude Code

    NVIDIA delar ut GLM-5.2 från Z.ai/Zhipu som obegränsat gratis API på build.nvidia.com — utan kort, OpenAI-kompatibelt. Guide: registrera på 5 min och plugga in Claude Code via CC Switch.

  • Kimi K3 + claude-context: sänk tokenanvändningen med 27% via semantisk kodhämtning

    Ett praktiskt test på en Django-kodbas visar att claude-context MCP till Kimi K3 sänker tokenanvändningen med 27,1% och verktygsanropen med 55%, samtidigt som F1 för kodlokalisering förbättras från 0,844 till 0,946.

  • Qwen 3.8 Max Token Plan-recension: 1,5B tokens för 39 yuan/månad?

    Ett praktiskt test av Alibabas Qwen 3.8 Max Token Plan för 39 yuan/månad. Nattetid får du ~1,5B tokens/månad till 0,2x av priset, på dagen ~300M till 1x av priset och endast 30M till fullt pris. Analys av kinesiskt AI-prissättning.

  • Gemini 3.6 Flash: $7.50, 304 tokens/s — varför Google vinner AI-kapplöpningen

    Gemini 3.6 Flash levererar 304 tokens/s till bara $7.50 i utdatapris och överträffar 3.1 Pro i intelligens. Med Googles oöverträffade data, kassa, beräkningsinfrastruktur och talanger — slutvinnaren av AI-kapplöpningen kanske redan är avgjord.

  • Varför praten om förbud mot Kimi K3 är nonsens — och bara gör kinesiskt AI starkare

    Axios rapporterar att Trump-administrationen överväger att förbjuda kinesiska AI-modeller som Kimi K3 och DeepSeek. Tre skäl till att det inte fungerar: öppna vikter kan inte tas tillbaka, GPU-exportkontrollen har redan misslyckats med att stoppa utvecklingen, och att förbjuda en modell bevisar bara att den är tillräckligt konkurrenskraftig för att spela roll.

  • AI-kodgenerering i duell: GPT-5.6 Sol vs Kimi K3 vs Qwen3.8Max

    Tre frontier-modeller, en brutal kodutmaning: generera ett filmiskt Three.js-solsystem och en stadsrenderare med 50 parametrar i en enda HTML-fil. Se vem som vann och testa live-demoerna.

  • DeepSeek V4 officiellt släpp: vad 121 gråtester avslöjar om kodförmågan

    Vi granskade 121 misstänkta DeepSeek V4-gråtestvideor från 53 skapare, inklusive 40 delade kodsessioner. Här är vad bevisen tyder på om officiell release, dess begränsningar och DeepSeek V4 vs Kimi K3, GPT-5.6 och Fable 5.0.

  • Kimi K3-kvotguide: hur mycket kan du använda? Gränser för 5h, vecka och månad

    Hur mycket kvot får du egentligen med ett Kimi K3-medlemskap? Baserat på verklig användardata från Allegretto uppskattar vi token-gränserna för 5 timmar, 7 dagar och månad för planerna Andante, Moderato, Allegretto och Allegro, plus Kimi Code-kvot, API-priser och GPT-5.6-jämförelse så att du väljer rätt plan.

  • DeepSeek V4 grålansering i praktiken: 12 videos och verifierbara delningslänkar

    Flera användare rapporterar att DeepSeeks API och webbapp gråtestar en mer kapabel modell. Vi samlar 6 praktiska skärmdumpar, 4 officiella DeepSeek-delningslänkar, 9 OpenCode API-loggar och 12 videos — och bedömer hur väl ‘en prompt, ett helt spel’ faktiskt fungerar. Den exakta modellversionen är ännu inte bekräftad av DeepSeek.

  • Kimi K3 läckt via påfyllningskampanjsida: vad vi vet innan officiell lansering

    Moonshot AI publicerade kortvarigt en Kimi K3-påfyllningskampanjsida på platform.kimi.com den 14 juli 2026 innan den togs ned. Läckan bekräftar namnet K3, tyder på en nära förestående lansering (15 juli – 11 augusti) och avslöjar aggressiva 10–30% påfyllningsbonusar — men ingen K3-modell finns tillgänglig ännu.

  • DeepSeek V4 officiell version läckt: slår Claude Opus 4.8 till 1/90 av priset

    DeepSeek V4 officiella version läckt via grålansering. Oberoende testare bekräftar att den slår Claude Opus 4.8 och placerar sig mellan Opus 4.8 och Gemini 2.5 Pro. Kan generera kompletta 3D-spel från en enda prompt. Priset är 1/90 av Opus. Inkluderar 10 verkliga Bilibili-videotester.

  • MiniMax bygger ett monster på 3 biljoner parametrar — och det kan förändra AI-priserna

    Läckta interna anteckningar avslöjar att MiniMax bygger en modell på 3 biljoner parametrar. Här är vad vi vet om arkitekturen, tidslinjen och vad det betyder för AI-priserna.

  • AI-modellmarknaden delas i två — så positionerar du dig

    Billiga modeller blir infrastruktur. Frontier-modeller blir reglerade knappa resurser. Det verkliga värdet sitter inte i modellerna — utan i orkestreringslagret.

  • DeepSeek V4 inför topptidsprissättning: dubbelt pris under kontorstid

    DeepSeek meddelade precis att V4 API-priser dubbleras under kontorstid (09:00–12:00 och 14:00–18:00 Beijing-tid). Officiell V4-lansering sker i mitten av juli 2026. Även vid topptaxa är DeepSeek med god marginal billigast bland frontier AI API:er.

  • DeepSeek V4:s tidsberoende prissättning: AI API-arbitragehandboken

    DeepSeek lanserade precis världens första peak/off-peak API-prissättning. Off-peak är hälften så dyrt — och tack vare tidszoner är någons peak alltid någon annans off-peak. Så här utnyttjar du det.

  • 4 gratisverktyg för att använda GLM 5.2 utan att betala en krona

    GLM 5.2 matchar Claude Sonnet 4 i kodnings-benchmarks. Använd den gratis via 4 kinesiska utvecklarverktyg — ZCode, Trae, Tabbit och CodeBuddy.