Cela nous donne probablement la bonne façon de réfléchir à la tarification de cette catégorie plus large. Il est peu probable qu’il s’agisse de PC grand public bon marché, du moins pas au lancement. Ils sont plus susceptibles d’arriver sous forme de systèmes haut de gamme destinés aux développeurs, aux professionnels techniques, aux créateurs et aux premiers utilisateurs prêts à payer pour des capacités d’IA haut de gamme sur l’appareil. Avec le temps, cela pourrait s’élargir. Pour l’instant, cependant, cela ressemble à une nouvelle catégorie de grande valeur et à coût élevé plutôt qu’à un rafraîchissement de PC de base.

Quel est son véritable objectif ?

La chose la plus importante à propos du RTX Spark n’est pas la puce. C’est le but derrière la puce. Cette machine est finalement conçue pour exécuter des agents d’IA localement, et c’est une affaire plus importante qu’il n’y paraît à première vue. Un agent IA est plus qu’un chatbot. Il conserve son état, accède aux outils, fonctionne entre les applications, se souvient du contexte, automatise les tâches et agit de plus en plus comme un travailleur logiciel. Nvidia positionne explicitement les systèmes Spark pour exécuter des agents d’IA personnels directement sur la machine locale, potentiellement 24 heures sur 24. Cela crée un modèle informatique très différent de celui que la plupart d’entre nous utilisons aujourd’hui.

Il y a un autre aspect important dans cette histoire. Ces systèmes se positionnent également comme des plates-formes sur lesquelles les utilisateurs peuvent créer et exécuter des versions plus petites, plus limitées et adaptées localement de grands systèmes de modèles de langage. En clair, vous pourrez peut-être créer votre propre assistant basé sur un modèle qui s’exécute directement sur le RTX Spark. Il ne sera pas aussi largement performant qu’un modèle frontière exploité par OpenAI ou un autre hyperscaler. Il est probablement moins performant, plus restreint dans son expertise et plus contraint par les limites matérielles locales. Mais ce sera le vôtre, ce sera local et il répondra sans dépendre d’un appel d’API distant vers un service d’IA hébergé à des centaines ou des milliers de kilomètres.

A lire également