10 $ par million de jetons en entrée, 50 $ en sortie. Déploiement progressif sur ChatGPT Plus, Pro, Business, Enterprise et l'API OpenAI.
Pour quoi faire Programmation, cybersécurité, recherche scientifique, pilotage d'ordinateur. C'est le premier modèle à franchir le seuil « critique » du cadre de préparation d'OpenAI en cybersécurité, ce qui veut dire qu'il sait attaquer autant que défendre. Un mode rapide double la vitesse, et double le prix.
Limite Le déploiement n'est pas terminé, tout le monde ne l'a pas encore. Et c'est un modèle que vous ne pouvez pas héberger : la sortie est à 50 $ le million de jetons, quand la gamme Flash de Google est à 3,75 $.
Le dernier modèle Flash de Google, orienté agents, raisonnement et cybersécurité.
Pour quoi faire Faire tourner des agents et du raisonnement au coût le plus bas de la gamme Google. La variante Cyber est réservée aux équipes de défense invitées par Google.
Limite Flash Cyber n'est pas accessible au public, il est réservé à des équipes de défense. Le prix n'est publié nulle part sur la page d'annonce.
184 542 téléchargements, 695 mentions j'aime sur Hugging Face. Licence MIT.
Pour quoi faire Lire du texte et des images, gratuitement, avec des poids que vous hébergez vous-même. Utile pour alimenter un agent qui doit comprendre des captures d'écran ou des documents scannés.
Limite Version expérimentale (le nom le dit). Pas de papier technique repéré.
227 points et 114 commentaires sur Hacker News, premier sur Show HN le 1er septembre 2026. Open source, licence MIT.
Pour quoi faire Faire tourner un gros modèle (Qwen3.8-Flash-Next, 105 Go) sur un Mac à 48 Go de mémoire, à environ 12 jetons par seconde, sans rien envoyer à l'extérieur.
Limite Limité à macOS avec mémoire unifiée suffisante. 12 jetons par seconde, c'est utilisable pour poser des questions, pas pour traiter du volume.
56 292 étoiles, 7 065 forks sur GitHub. Licence AGPL-3.0 (copyleft fort : si vous exposez un service basé dessus sur le réseau, vous devez publier vos modifications). Aucune version officielle publiée.
Pour quoi faire Vous décrivez la vidéo voulue, l'outil enchaîne seul la recherche, le script, les images, la voix, la musique, le montage et le rendu. 12 pipelines disponibles, dont Clip Factory, qui découpe une longue vidéo en une série de clips courts classés. Les démos du projet sont chiffrées entre 1,33 $ et 5 $ la vidéo, avec un plafond par défaut à 10 $.
Limite Installation lourde (Python, Node, Remotion). Pas de version prête à lancer.
Attention au sosie. Le dépôt OpenMontage-app/OpenMontage (1 étoile, créé le 27 août 2026) recopie mot pour mot la description du vrai projet sans en être un fork, et remplace l'AGPL par une licence MIT. Ne pas confondre.
30 601 étoiles, 3 057 forks sur GitHub. Version 2.2.2, licence MIT. Python 3.12 minimum.
Pour quoi faire Vous donnez l'adresse d'une page et une phrase décrivant ce que vous voulez en tirer. Un modèle lit la page et rend les données rangées. La bibliothèque est gratuite, les appels au modèle restent à votre charge. Le service hébergé démarre à 20 $ par mois.
Limite Ne lit ni les flux RSS ni X. Le rendu des pages en JavaScript est à votre charge (Playwright à installer). Les sources gérées sont les sites web et les documents locaux.
2 552 594 téléchargements, 11 209 mentions j'aime sur Hugging Face. 8 710 étoiles sur GitHub. Licence maison « Kimi K3 », poids ouverts sous conditions (au-delà de 20 millions de dollars de revenus en revendant de l'inférence, il faut un accord avec Moonshot AI).
Pour quoi faire Comprendre du texte et des images, et avaler d'un coup une fenêtre de 1 048 576 jetons, soit à peu près trois quarts de million de mots. Utile pour résumer de très gros documents ou alimenter un agent qui doit lire beaucoup. Le texte se lit désormais avec llama.cpp.
Limite Il n'est pas fait pour tourner chez vous. Le plus petit fichier allégé disponible pèse 466 Go, les autres montent à 594, 861 et 1 509 Go. La vision n'est pas encore gérée par llama.cpp, seul le texte l'est.
Deux fois par semaine, le mardi et le vendredi, en quatre minutes : ce qui est sorti dans l'IA et qu'on peut essayer le jour même.
Double confirmation par courriel. Désabonnement en un clic, lien visible en clair dans chaque envoi.
Genève, Suisse. Écrire à hello@newsworldai.xyz.