Fireworks AI met en disponibilité générale son API d'entraînement et Fireworks Lab, avec facturation au token ou à l'heure GPU
Le 31 août 2026, Fireworks AI a annoncé la disponibilité générale de sa Training API et de Fireworks Lab. L'offre se décline en trois niveaux : la Training API, où l'équipe apporte ses données et sa boucle d'entraînement ; Managed Training, où Fireworks exécute la boucle en SFT, RFT ou DPO depuis l'interface ou l'API ; et Fireworks Lab, qui détache chercheurs et ingénieurs auprès du client, du co-design à la construction sur mesure. Le mode serverless entraîne des adaptateurs LoRA sur une infrastructure partagée facturée au token ; le mode dédié, ouvert après consultation du Lab, couvre l'entraînement en paramètres complets et se facture à l'heure GPU. Fireworks affirme avoir opéré de l'apprentissage par renforcement sur plus de 10 000 GPU et cite ses clients : Harvey, dont le modèle Tenet post-entraîné à partir de Kimi K3 atteint selon l'éditeur 19,7 % de réussite complète sur le banc LAB contre 10,8 % pour le modèle de base ; Vercel, avec 93 % de générations sans erreur pour l'auto-correcteur de v0 ; Factory, dont deux adaptateurs LoRA sur une base Qwen détectent environ 70 % des secrets réels contre environ 59 % pour GPT-5.5.

