Charm Hyper: inferenza per agenti di coding, 100 crediti gratis al mese

Charm, lo studio alla base di Crush (il coding agent CLI con 27k stelle su GitHub), gestisce un proprio servizio di inferenza: Hyper. È il provider ufficiale di Crush, ma funziona con qualunque strumento compatibile con OpenAI: basta puntare il base URL a https://hyper.charm.land/v1.
Non si tratta di "un proxy in più". Charm dichiara di gestire direttamente l'infrastruttura — orchestrazione, scheduling, motori di inferenza — con accordi a livello hardware per contenere i costi. Il catalogo è solo coding: modelli open source scelti specificamente per la generazione di codice, il debugging, il refactoring e la modifica multi-file.
L'API parla sia OpenAI (/v1/chat/completions) che Anthropic (/v1/messages): oltre a Crush (supporto di prima classe), la documentazione copre Claude Code, Codex, OpenCode, Pi e Zed con guide di configurazione dedicate.
Il catalogo
Verificato oggi sull'endpoint pubblico del servizio:
- DeepSeek V4 Flash — $0.20 input / $0.40 output per 1M token, contesto da 1M
- GLM-5.2 — $1.52 / $4.79, contesto da 1M, supporta allegati (screenshot, diagrammi)
- Qwen3.8-Max — $2.00 / $6.00, contesto da 1M, allegati
- Kimi K3 — $3.27 / $16.33, contesto da 1M
- MiniMax M3, Qwen3 Coder 480B, Gemma 4, Llama 4 e altri (circa 25 in totale)
I prezzi
- Free: 100 Hypercredits al mese, senza scadenza
- Abbonamento: $20 al mese con 250 Hypercredits rinnovati ogni giorno
- Pacchetti prepagati: da $5 a $20, con Hypercredits che non scadono mai
- 1 Hypercredit equivale a $0.05 ed è calcolato sui costi reali dei token
Zero data retention
L'aspetto che qui ci sta più a cuore: zero data retention. Charm dichiara una policy ZDR anche con i propri partner cloud e di non addestrare mai sui dati degli utenti. Per chi lavora su progetti di clienti, non è un dettaglio da poco.
Per i team sono disponibili master key e sub-key, report di utilizzo per modello e per utente, conformità al GDPR e piena proprietà dell'output generato.
Cosa manca (per ora)
- Il routing intelligente tra modelli (affidare ogni passaggio al modello più adatto) è annunciato nella roadmap e non è ancora disponibile
- Prezzi e catalogo cambiano spesso: verificate sul sito prima di fare affidamento sui numeri di questo post
Chi usa Crush trova Hyper già integrato come provider predefinito. Chi usa Claude Code lo collega tramite l'endpoint Anthropic-compatibile, chi usa Codex o altri strumenti tramite quello OpenAI-compatibile.
Qualcuno ha già provato Hyper con Crush o Claude Code? Com'è andata?
📌 Questo articolo riassume una discussione su r/vibecodingitalia. Leggi il post originale.

Scritto da
Michael Gasperini@TheStreamCode
Founder & Sviluppatore
Founder di Vibe Coding Italia, la community italiana sull'intelligenza artificiale. Progetta e sviluppa prodotti con l'AI e ne racconta l'applicazione pratica attraverso guide e articoli.
DeepSeek ha rilasciato il suo harness open source: tutto è un plugin
DeepSeek Harness è il nuovo harness open source di DeepSeek per coding agent: architettura a plugin su Cordis, licenza MIT, modelli e tool intercambiabili.
Leggi articoloGLM-5.3: stesso base di 5.2, post-training su coding e cybersecurity
GLM-5.3 di Z.ai: stesso base 743B del 5.2, post-training su coding agentico e cybersecurity. Benchmark del lancio, quota a punti e pesi in arrivo.
Leggi articoloSonnet 5 + Fable 5 Advisor: uno dei sistemi più efficaci mai introdotti in una coding CLI
L'Advisor di Claude Code combina Sonnet 5 come executor veloce e Fable 5 come consulente strategico. Costi ridotti, qualità quasi pari a Fable puro, e come riprodurlo in OpenCode.
Leggi articolo



