
Pokee AI a lancé Pokee-Isaac 28B, un modèle de base textuel doté d'un contexte pouvant atteindre 10illions de tokens, conçu pour fonctionner au sein du périmètre du client. Selon les données de MarkTechPost, les poids du modèle ne sont pas publiés; l'accès est fourni via une licence pour VPC, un déploiement local ou sur appareil.
Selon les résultats annoncés, le modèle a obtenu 93,3% sur RULER avec un contexte de 10illions de tokens. Dans le panel de comparaison, toutes les solutions de référence ont obtenu 0,0% au-delà de 2illions de tokens. Sur BFCL v4, le modèle a pris la première place avec un score de 70,94, et la deuxième place sur Terminal-Bench 2.1.
Sur une seule puce B200, la vitesse de prétraitement du contexte complet a atteint 137 200okens par seconde, tandis que la vitesse de génération se maintenait à environ 335okens par seconde. Le prix indiqué est de 0,15 dollar par million de tokens d'entrée et de 1 dollar par million de tokens de sortie.
commentaire éditorial
Pourquoi c’est important
Conséquence probable : un intérêt accru pour les modèles traitant de grands volumes de contexte au sein d'un environnement contrôlé par le client. Le prochain signal observable sera la publication d'une méthodologie de test détaillée, des conditions de licence ou d'une vérification indépendante des résultats. Une incertitude majeure subsiste car seul le synopsis d'une source unique est actuellement disponible et les poids du modèle ne sont pas publiés.