L'IA qui ne lit pas vos conversations (et qui performe)
1013 segments
Bon alors vous le savez certainement
quand vous parlez à Chat GPT ou à Cloud
en réalité vous parlez à l'ensemble des
employés des entreprises qui peuvent
accéder en clair à vos conversation au
maximum à vie et puis avec un
entraînement sur vos données. un minimum
pendant 30 à 60 jours simplement de
rétention réglementaire mais surtout
vous envoyez toutes vos données
directement au gouvernement américain et
à leur service de renseignement ainsi
que tous les gouvernements avec lesquels
ils collaborent pour leur donner tous
les secrets les plus intimes et surtout
énormément de points de votre structure
cognitive qui vont leur permettre
d'anticiper vos comportements futurs,
vos croyances et donc qui vont surtout
leur permettre de pouvoir vous manipuler
parce que si il a peut prédire vos
comportements grâce à des modèles
statistiques de représentation et de
prédic
Elle pourra également prédire comment
vous influencer et vous donner les
croyances dont elle a besoin que vous
ayez pour vous contrôler de mieux en
mieux. C'est une oligarchie
technologique et une manipulation de
masse sans précédent et donc c'est un
enjeu bah de souveraineté et de sécurité
dont de plus en plus de gens se rendent
compte. en particulier une personne qui
s'appelle Eric Vor qui est l'ancien
enfin le fondateur de de Shapshift qui
est donc une boîte dans la crypto qui a
créé une boîte qui s'appelle Venice AI
qui est le sujet de la vidéo
d'aujourd'hui qui a une promesse
extraordinaire. Non seulement elle vous
promet une IA qui est donc privée,
c'est-à-dire que toutes les données euh
sur lesquelles bah les données que vous
envoyez à LIA sont supprimé juste après
que vous ayez eu la réponse. Voir même
c'est certifié cryptographiquement que
l'IA n'a jamais été touché par un humain
parce que votre réponse tourne
uniquement sur un serveur encrypté,
prouvable par une clé cryptographique et
une équation mathématique. Euh donc ça
c'est le premier point privé mais aussi
et surtout non censuré. C'est vous
pouvez avoir accès à des modèles d'IA
qui n'ont pas eu de reinforcement euh
human learning feedback et donc qui
n'ont pas qui n'ont pas eu les
savegardes moraux euh corelia classique
et donc il vous permettent de poser des
questions sur tout et rien. Euh comment
faire des bombes, comment faire des
virus biologiques ou simplement des
questions euh morales dans un pays par
exemple comme la Chine ou les IA ne nous
autorise pas à questionner le
gouvernement ou des valeurs comme la
dictature ou autre.
Ça a l'air incroyable mais le fondateur
et cette boîte Venis rajoute en plus à
une promesse qui est que cette promesse
c'est que bah la plupart du temps, vous
payez un abonnement pour louer des
capacités IA GPT, cloud ou autre. Eux
ils vous proposent une chose différente.
Vous achetez leur token crypto, le VV ou
le DM et en échange vous recevez une
capacité il y a quotidienne. Donc en
gros, je mets par exemple 10000 € dans
le DM. C'est un investissement crypto.
C'est un cryptoactif. vous pourrez
estimer qu'il va monter parce que la
demande sur ce token va augmenter et en
échange, j'ai en l'occurrence 6 à 7 € de
crédit IA par jour que je peux utiliser.
En plus de ça, le VV vous propose un
rendement annuel de 12 %. Donc vous
mettez de l'argent sur quelque chose qui
s'apprécie avec 12 % de rendement annuel
et en plus vous avez 5 à 15 € de crédit
IA par jour en fonction de votre
investissement.
C'est quoi le délire ? Est-ce que c'est
vraiment rentable ? Qu'en est-il
réellement ? Et comment ça fonctionne ?
Et ben c'est tout ce sur quoi on va se
plonger dans cette vidéo. Et euh
globalement la réflexion qu'on va avoir
euh de de fond, ça va être bah si vous
voulez avoir une IA qui est profondément
souveraine et privée parce que ces
questions euh vous dérangent ou
simplement vous avez des obligations
réglementaires avec le RGPD et vos
clients, euh comment créer le meilleur
système ? Est-ce que c'est Vénis ?
Est-ce que c'en est un autre ? Et quel
est ce projet ? Quels sont les
fondamentaux ? C'est parti, rentrons
directement dans le vif du sujet. Donc
très concrètement, Eric Vor c'est un
ultra libertarien qui a déjà créé des
projets cryptos pour justement séparer
la monnaie de l'État comme on avait
séparé la religion de l'État. Les
Siming, c'est l'état l'étape supérieure.
Et aujourd'hui, il y a un nouveau slogan
qui est séparer l'esprit de l'État parce
qu'on se on se dirige de plus en plus
quand même vers des IAS d'État avec un
pouvoir de d'influence et de
manipulation sur la population qui est
sans précédent avec une oligarchie bah
technocratique qui est quand même de
plus en plus présente surtout aux
États-Unis. Et donc lui, il voit ça avec
beaucoup d'inquiétude et il dit
"Attention, il va falloir qu'on fasse
des actions." Et donc c'est cette
solution technologique qui propose deux
fondamentaux, ne pas te surveiller, ne
pas te censurer. Et donc ils mettent en
avant des modèles open source qui
décensurent et qui font tourner sur une
stack technologique qu'on va voir dans
un instant qui est euh correct pour la
vie privée. Concrètement, comment marche
vraiment Venis ? Si vous allez sur leur
site, vous verrez qu'ici vous avez
simplement une interface de chatbot
classique. Et si on va voir l'interface
d'utilisation, vous avez ici un mode de
chat tout à fait classique dans lequel
vous pouvez sélectionner des modèles.
Les modèles de clos de chat GPT sont
disponibles de Grock aussi et d'autres
types de modèles avec différents niveaux
de vie privée qu'on va étudier dans un
instant. Vous avez également une
fonction agentic chat qui permet du coup
de donner des outils comme la recherche
web, la planification d'une liste de
tout ainsi que des capacités de générer
des images, des vidéos et autres. un peu
plus d'agency en terme de ce que l'IA
peut faire et puis une capacité studio
ici dans laquelle vous pourrez générer
des images, des musiques, des vidéos et
puis avoir carrément un petit logiciel
de montage vidéo disponible directement
sur la plateforme. Toutes ces
fonctionnalités disons basiques, elles
sont disponibles au prix de 18 € par
mois. Alors vous pouvez accéder au
modèles de base comme sur Chat GPT
absolument gratuitement avec 10 promes
par jour. C'est vraiment une question
d'essai. Sinon, les plans commencent
réellement à partir de 18 € par mois
avec un accès quasiment illimité à la
plupart des modèles qu'ils hébergent
eux-mêmes et donc sur lequels ils
peuvent faire une bonne marge sur
l'ensemble des clients. Vous avez des
plans qui montent jusqu'à 200 € par
mois. Euh la l'avantage principal, c'est
que vous aurez des crédits euh d'API qui
seront disponibles en plus, ce qui fait
que vous pouvez utiliser sur des
logiciels de coding agentique comme on
verra juste après, en plus d'avoir une
interface super chouette pour poser vos
différentes questions et de les
supporter. Pour finir sur le pricing,
ils ont du coup également une
possibilité d'appeler euh des modèles
euh donc directement par l'API. Donc par
exemple, si vous avez des cloud code,
open code, P agent ou autre ou Airms
agent open clos, vous pourrez utiliser
euh leur backend, donc mettre leur clé
API et leur euh leur endpoint d'API pour
pouvoir appeler des modèles que eux ils
mettent à disposition pour justement les
faire tourner dans vos boucles, vos SDK
qui seront donc Open Cloud, Hermes,
Cloud code ou autre. Si on regarde
concrètement leur pressing au niveau de
la PI, on voit qu'ils sont un petit peu
au-dessus des prix du marché. Sur un GLM
5.2 avec du ZDR, on est à 440 là en
output. Alors que sur une de mes boîtes
préférées d'inférence par exemple,
plutôt sur par exemple un 320 320 en
dollar par million de token en output.
Donc on est un peu plus cher que le prix
du marché pour en l'occurrence là un
niveau de privacy extra similaire. Donc
Venis se veut comme une boîte un tout
petit peu haut de gamme qui font de la
marge sur les tokens qui vous vendent.
Bon, a priori, si vous êtes habitué à
utiliser un chat GPT ou un cloud ou un
Mistral, honnêtement, ça va pas vous
changer grand-chose. Vous aurez
l'interface de chat Agentichat qui sera
un équivalent à peu près approximatif de
de Cloud Cowork dans lequel vous pouvez
également ajouter de la mémoire et des
projets. Donc jusque là, ça ça va très
bien. OK, donc maintenant, qu'en est-il
réellement de leurs options de vie
privée ? La première des choses, c'est
que vous voyez ici, j'ai accès à mon
historique de conversation que je peux
retrouver en cliquant directement sur le
côté. Mais comment ça se fait qu'il
puisse stocker mes discussions et qu'en
même temps ils disent qu'il les stockent
pas ? Ben ça c'est leur innovation
principale. Innovation,
[grognement] tout est relatif.
Simplement que les conversations, les
chats sont stockées directement dans la
mémoire du navigateur sur votre
ordinateur en local. Et donc si je
change l'ordinateur et que je me
connecte au même compte, en
l'occurrence, j'aurai pas accès à ces
conversations là. Ce sera pas transféré
d'un appareil à l'autre. La seule
manière en fait de synchroniser entre
vos appareils sera de créer ce qu'on
appelle un hck uncrypted backup qui vous
permettra par exemple si vous migrez
d'un appareil à un autre de pouvoir
encrypter sur le cloud et de
retélécharger sur un autre appareil.
Leur fonction de mémoire aussi comme une
mémoire de cloud chat GPT est également
stockée en local sur votre appareil. Ce
qui permet évidemment que vous ayez bah
une facilité d'usage mais que ce soit
stocké en local et donc qu'il y ait rien
qui soit stocké sur leur serveur ce qui
répond à leur enjeu de vie privée.
Maintenant qu'en est-il des modèles ?
Parce que maintenant qu'on sait que les
chats sont stockés en local, au moment
où Lia me renvoie sa réponse,
évidemment, elle ne tourne pas en local
sur mon ordi, elle tourne bien sur un
serveur. Ils ont en gros trois niveaux
de vie privé en fonction du modèle que
vous choisissez. Vous avez la capacité
d'utiliser des modèles externes comme
par exemple Cloud, Opus, Chat GPT qui
évidemment sont des modèles
propriétaires qui ne tournent donc que
sur les serveurs en gros qui sont agréés
par Anthopiic et donc fournis par la PI
officiel du Anthopic. Donc là, ce que
vous allez avoir avec ce ces ces si vous
utilisez ces modèles là, c'est
simplement un niveau d'anonymisation,
c'est-à-dire que ça va passer par votre
requête va passer par un serveur de
routing que Venice en fait dont Venice
dispose et ensuite ça va être routé vers
une API standardisée de Entropique. Donc
en fait comment dire tropic ne pourra
pas lier ce prompt à votre identité si
dans le prompt il y a rien qui vous
concerne qui permettrait de vous
identifier. Donc euh il faudrait que
vous utilisiez du pseudonyma qui
d'ailleurs été prouvé pour ne pas
fonctionner mais une sorte de choses où
il y a vraiment rien qui pourrait vous
identifier. Ça passe par leur serveur de
routing ce qui fait qu'ils pourront pas
revenir à votre IP d'origine et ils
pourront pas lier à vous euh la requête
que vous faites. Donc c'est disons le
niveau le plus bas de vie privée que
vous pouvez avoir. Et bien souvent on se
rend compte que ça marche pas parce
qu'on laisse quand même des métadonnées
qui pourraient relier à notre à notre
profil à nous les promes qu'on envoie.
Premier niveau, c'est l'anonymisation.
Ça marche si vous voulez utiliser des
gros modèles euh propriétaires sans sans
forcément vendre vendre votre votre la
peau de vos fesses.
À côté de ça, vous avez une fonction qui
est la fonction private. Private
globalement, ça veut dire que ils font
tourner sur des serveurs qui possèdent
pas forcément. Ils ont posséd une petite
partie mais vraiment pas tous les
serveurs sur lesquels ils font tourner.
Je pense qu'une grande majorité, ils ne
possèdent pas les serveurs. Ils font
tourner en tout cas chez les providers,
partenaires euh sur lequel ils ont une
un agreement de de transfert des données
qui est signé et donc contractuellement
euh euh solide qui implique du ZDR,
c'est zéro data rétention. Ça veut dire
que une fois que la qu'ils ont fini en
fait de générer la requête, la réponse à
votre requête, ça vous renvoie le prompt
et c'est complètement supprimé de leur
serveur et ça c'est et c'est
contractuellement défini. Donc c'est
disons le niveau de privacy que je pense
que tout le monde devrait avoir de base.
C'est un très bon niveau de privacy. Ça
vous protège parce que bah en fait les
données sont pas retenu.
Par contre on a quand même des données
qui sont en clair qui sont au moment où
elles arrivent sur le serveur bah en
clair. Et donc il y a quand même un
moment où elle transite sur un serveur
qui appartient aux États-Unis et on sait
jamais avec le cloud en fait
techniquement les États-Unis s'ils
mettent un sniffer partout il pourrai
quand même récupérer ces données parce
qu'elles arrivent en clair. C'est sur ça
le problème.
Si vous avez des données extrêmement
extrêmement problématiques à
justement partager avec Lia, alors là,
vous pouvez utiliser leur dernière
innovation qui est peut-être la
meilleure qui est celle du te EE. En
gros, ça veut dire que vous envoyez
votre quête sur un serveur, du coup
c'est enrypté dans le transfert et c'est
décrypté au moment où ça s'ouvre en fait
dans l'environnement sécurisé.
Concrètement, c'est un une sorte de
sandbox euh logiciel dans lequel tourne
un serveur en fait qui est vraiment
conteneurisé auquel aucun humain a
accès. Et cette sécurisation, le fait
qu'il y a aucun humain, il a accès avec
c'est Airgap justement euh c'est
démontré par une preuve cryptographique
euh qui qui peut être réalisé justement
pour prouver le fait que ça tourne dans
un environnement entièrement sécurisé et
à part vraiment où il y a aucun contact
avec le monde extérieur. Donc au moment
où vous entrez en communication avec ce
serveur, vous partagez les clés
d'encryption. Ce qui fait que dans le
transfert, c'est complètement sécurisé
et et complètement encrypté et ça se
décrypte uniquement au moment où ça
arrive dans l'environnement sécurisé et
c'est réencrypté pour vous envoyer la
réponse du prompt. Donc c'est le niveau
le plus ultime que vous pouvez avoir en
terme de sécurisation prouvé par une
équation mathématique cryptographique
que ça fonctionne correctement comme ça
a été annoncé. Donc ça c'est vraiment si
vous voulez une une une privacy sur des
modèles assez cools. Honnêtement,
utiliser cette option, elle est très
bonne. Euh leur provider d'infra, c'est
pas eux qui ont l'infrastructure
technique pour faire ça. C'est FA Cloud
le principal. Donc si vous avez besoin
en fait de d'utiliser de l'encryption
comme ça dans votre entreprise,
honnêtement passez directement par eux
et vous pourrez avoir donc des tarifs à
pays qui sont un peu moins chers. Alors
ça perd un peu en puissance honnêtement
et on peut évidemment pas avoir de tools
parce que ça le fait que ce soit dans un
environnement sbox en dehors du web, on
peut pas justement accéder au web,
justement avoir de la web search et
cetera. Donc il va falloir combiner avec
d'autres services euh et avoir et
accepter qu'il y a un peu moins de
capacité. Cependant, c'est vraiment le
voilà le le la référence marché pour
avoir des environnements il a encryptés
et donc que ce soit le meilleur possible
ever pour justement financial AI,
medical AI, enfin tous les trucs où il y
a vraiment un enjeu de de donner client
qui doit absolument pas fuiter.
Honnêtement, d'un point de vue
ingénierie, c'est la meilleure manière
de faire ça. Maintenant, avant de nous
intéresser à cette partie- làà du token,
du yield et de la partie crypto de leur
boîte, je propose qu'on s'intéresse aux
performances réelles qu'on peut obtenir
sur Venis. Est-ce que ça suffit ? Est-ce
que ce serait intéressant de remplacer
vos abonnements par Venice ? Donc la
réponse rapide, c'est que si
actuellement vous avez un usage de lia
qui consiste simplement à poser des
questions à JJPT ou à Claude, la réponse
est oui. Vous serez entièrement
satisfait avec cette IA. Et si vous
voulez comparer par rapport à un
Mistrral AI, Mistral AI retient votre
chat, vous avez pas de possibilité de
ZDR. Et honnêtement, si le gouvernement
français investit autant en
domministral, c'est qu'ils veulent à mon
avis aussi avoir un outil de contrôle de
la population et que vos données, elles
sont absolument pas mieux protégées en
Europe qu'aux États-Unis. euh les
services de renseignement évidemment qui
captent vos données que vous envoyez à
Mistrral. Donc en fait, c'est si vous
voulez de la vie privée, si vous voulez
une enjeu de souveraineté euh
géopolitique au fait que Mistral existe,
par contre, en tant que consommateur,
vous avez tout intérêt à donner plutôt
vos données à la Chine, aux US qu'à la
France parce que si vous donnez vos
données à la France, si vous voulez, le
gouvernement français a beaucoup plus de
pouvoirs d'influence sur vous que un
gouvernement comme le gouvernement
chinois auquel vous avec lequel vous
avez aucun contact. Donc vaut mieux
donner vos données à la Chine parce que
il y aura aucun pouvoir d'influence sur
vous que donner vos pouvoir vos vos
données à la à la France quoi. Donc moi
jamais j'utiliserai les ministras pour
quel que soit que que conversation
confidentielle. En tout cas si c'est
pour soutenir une industrie française
pourquoi pas not. Euh et je pense c'est
important que la France le fasse. Mais
un point de vue théorie des jeux
individuels, vous avez aucun intérêt à
partager vos données avec Mistral qui
sont chopées par un gouvernement
français qui a beaucoup plus de pouvoir
néfast et d'influence sur vous qu'un
gouvernement étranger. Voilà. Donc a
priori, donnez vos données à la Chine si
vous voulez choisir quelqu'un à qui
donner des données sur un truc de je
sais pas de joueur d'échec quoi sur
votre l'échier géopolitique des données.
Parenthèse fermée. Si vous utilisez donc
euh simplement euh le chat, évidemment
ce sera la meilleure manière d'avoir un
chat privé dans une belle interface qui
fonctionne. Voilà, là si c'est votre
usage, je vous le recommande à 100 %.
aller sur le modèle sur sur pardon sur
Venice euh en l'occurrence GLM 5.2 euh
si on va voir les les benchmarks du
modèle qui existent. Voilà, GLM 5.2, il
est vraiment extraordinaire.
Honnêtement, moi je le trouve meilleur
que J GPT et c'est un modèle
complètement open source. Euh voilà, il
est il est il est vraiment top et il le
propose quasiment en illimité dans leur
interface. Donc vous parlez à Gillm 5.2,
vous aurez l'impression de parler à
Claud chat GPT sans aucun problème. Donc
tout ce qui est question, il y a aucun
vraiment voilà énorme énorme coup de
cœur. Allez-y, ce modèle est excellent.
Et donc les modèles qui vous proposent
gratuitement sont excellents et vous
avez aucune raison en fait de partir sur
Cloud ou ou chat GPT à la place. Au
niveau de la jointic chat où il y a un
peu plus de capacité et il y a pourra
faire des recherches pour vous et
cetera, les modèles qui vont vous qui
vous sont proposés pour l'instant pour
moi, ils sont pas satisfaisants. Je
pense qu'ils vont les mettre à jour.
C'est une beta encore. Euh quand ils
proposeront GLM 5.2 ici, ça vaudra le
coup de l'utiliser avec un Kimi 2.5.
Honnêtement, on aurait demandé ça à Nia,
elle nous aurait fait une belle
présentation. Il y aurait eu un canva,
il y aurait eu une capacité. la tout ce
qu'ils ont mis en mode harness qui
entoure le modèle euh c'est pas bon.
Voilà, c'est vraiment à revoir cette
partie chat. il faut qu'il l'améliore et
pour l'instant c'est pas haut niveau.
Mais si vous voulez simplement un chat
àquel vous pouvez poser des questions et
avoir des réponses, il y aura zéro
problème et vous serez super satisfait
de de leur service. Maintenant la
question c'est si vous voulez utiliser
li de manière plus puissante, vous le
savez si vous regardez cette chaîne,
l'équation qu'il faut respecter, c'est
donner du bon contexte à Lia pour
qu'elle sache qui on est, sur qui on
travaille, qui sont nos clients et
qu'elle accès à cette donnée-là et euh
lui donner accès à des fiches process
pour que Lia puisse exécuter pour nous
et lui donner accès à des outils. Le
meilleur outil en fait, c'est simplement
d'ouvrir le gaz sur votre ordinateur
pour qu'elle ait accès à votre terminal
et qu'elle puisse donc prendre contrôle
de tous vos tous vos outils, tous vos
voilà tous vos fichiers pour faire du
travail pour vous et que ça vous
produise de l'output et pas simplement
parler à Unia pour chatter quoi. Et pour
faire ça donc il faut passer d'un stade
où vous êtes avec Lia sur votre sur
votre navigateur et le seul harness qui
existe autour de Lia c'est simplement
question réponse recherche web réponse.
Là vous voulez passer à un stade où du
coup LIA tourne sur votre ordi en local
comme par exemple propose Codex d'Open
AI Cloud Cowork ou Cloud code de cloud
justement ou sinon des des des harness
open source tout comme vous auriez P
agents qui vous permett du coup d'ouvrir
un modèle en local sur votre ordinateur
et qui fasse des choses en local ou bien
par exemple Open Code qui est une autre
référence du marché pour avoir un agent
qui tourne sur votre ordi dans lequel
vous pouvez ouvrir absolument n'importe
quel modèle. D'ailleurs, si vous voulez,
on a nous aussi notre alternative qui
est euh notre outil Prisma Workspace euh
qui est complètement gratuit et open
source. Dans le comme vous voyez ici, je
peux ouvrir des modèles dont le modèle
de par exemple ici euh Dipsic V4 Flash
qui est hébergé par Venice et donc j'ai
une conversation qui est 100 % privée
qui tourne sur mon ordinateur. Vous
voyez quand je lui demande une question
évidemment il va rechercher euh en local
sur mon ordinateur dans mes notes et il
est capable si je lui demande de me
créer une présentation de la créer en
local sur mon ordi. Et c'est là qu'on
atteint un niveau bien supérieur de
puissance de lire. Et donc très
concrètement, si vous voulez atteindre
ce niveau de puissance, il vous faut
donc un contexte qui contient tout ce
que vous avez jamais pensé, lu vu,
entendu, c'est de second cerveau. Ici,
par exle, j'ai tous les projets sur
lesquels je travaille, toutes mes
casquettes, par mes casquettes parle
dans dans la boîte perspective, euh tout
ce qu'on est en train de faire en ce
moment, toutes nos casquettes avec tous
les éléments qui sont dedans. Du coup,
dès que je parle à Lia d'une de mes
casquettes, d'un de mes projets, en
gros, il a pour instruction LIA d'aller
directement rechercher dans le dossier
en question du projet ou de la casquette
dont je parle le contexte. Par ex, je lu
parle de mon projet génétique, il va
lire le contexte de génétique
directement pour savoir de quoi je
parle. Comme ça, on a un niveau de
pertinence extrêmement important dans
l'IA. Ensuite, on lui donne des skills.
Par exemple, ici, j'ai tous mes skills
euh qui sont référencés. Par exemple, si
je veux lui faire écrire des pubs, euh
créer une vidéo YouTube, éditer un cours
du boot camp, euh faire ma compta par
exemple,
créer des slides. Pour tout ça, je vous
ai donné des outils, des skills qui
correspondent simplement à des fiches
process qui disent quoi faire de enfin
de A vers B, quoi. Et donc, une fois que
vous avez votre contexte, votre second
cerveau, vous avez vos skills que vous
possédez en local également sous forme
de note. Tout ça, ça se concrétise sous
la forme d'un dossier qui est sur votre
ordinateur comme celui-ci. L'objectif,
c'est simplement d'ouvrir une IA qui
tourne sur votre ordinateur. Enfin, le
modèle tourne à l'extérieur, mais le
harness, le logiciel dans lequel qui qui
permet d'ouvrir l'Ainterface tourne sur
votre ordinateur. Euh et du coup, vous
allez ouvrir l'IA à l'intérieur de votre
dossier avec tout votre contexte. Et
c'est ça qui va fermer la boucle pour
obtenir la puissance de Lia en local,
tout en gardant de manière souverain le
contexte évidemment que vous allez
donner à Lia, vos skills, vos outils et
cetera.
Et donc si je prends par exemple pour
exemple ici le logiciel Prism Workspace
qui est donc gratuit, vous pourrez
télécharger en description si vous
voulez, euh vous avez simplement ici à
cliquer sur plus ouvrir. Donc il y a à
l'intérieur de votre contexte ici.
Ensuite ici vous pourrez connecter
n'importe quel modèle que vous voulez.
Donc par exemple, si vous voulez du
Mistral juste ici, vous pourriez
connecter un modèle Mistral et ouvrir
Mistral ici. Et si je veux du Venice AI
comme on en parle, je pourrais très bien
ouvrir les modèles de Venice directement
à l'intérieur de cette interface pour
gagner énormément en puissance tout en
gardant en souveraineté sur mon contexte
et ainsi de suite. Pour moi, c'est
vraiment ça. Si vous voulez de la
puissance avec une niaque tout en
gardant de la souveraineté et de la vie
privée, il faut simplement que vous ayez
vous possédez votre harness qui est open
source et gratuit. Donc ça peut être
open code, pi agent ou prism workspace
comme je vous l'ai dit. Vous possédez
votre contexte qui est simplement des
notes sur votre ordinateur, vous ouvrez
l'IA à l'intérieur et ensuite vous
choisissez euh des modèles d'IA qui
tournent sur des providers, des serveurs
qui correspondent à vos à vos à vos
requirements. Ça peut être complètement
encrypté comme on avait avec FA Cloud,
ça peut être un peu moins encrypté avec
du ZDR comme on parlait et peu importe
le provider que vous choisissez, il faut
que vous puissiez changer le modèle à
l'intérieur de votre harness euh de
votre écosystème dans lequel vous ouvrez
Lia. C'est tout ce que j'enseigne sur
cette chaîne YouTube. Si vous voulez, il
y a un bout de camp si vous voulez. Il y
a une un webinaire que je fais bientôt
que je mettrai en description pour vous
enseigner tout ça. Bref, donc la
question maintenant, si on revient sur
Venice AI, c'est de savoir si une fois
qu'on est à l'intérieur de ce contexte
vraiment souverain et puissant pour
ouvrir l'IA en local et en gardant de la
vie privée, est-ce que les modèles donc
sont pertinents et est-ce que du coup ça
vaut l'écart de prix ? Donc pour vous
montrer ça, je vous propose de demander
la même demande à au même modèle donc
qui est Dipsic V4 flash qui est vraiment
pas cher pour le coup. Il coûte 30
centimes par million de token en output
qui est euh euh
plus de 100 fois moins cher, 150 fois
moins cher que Claude Fable 5 par
exemple euh mais qui est aussi moins
capable hein pour être honnête. Je le
fais tourner du coup sur deepsic en
envoyant mes données à la Chine. Je le
fais tourner sur open router avec une
option ZDR ce qui équivaut en fait en
gros à la même politique de
confidentialité que Venice et je le fais
tourner sur Venice qui a donc du ZDR
encore une fois zéro data rétention et
on va voir qui revient en premier et qui
produit la l'inférence la plus rapide.
Donc pour une tâche simple, je vais
simplement lui demander "Hello, quelles
sont mes tâches de la semaine ?" Euh je
vais lancer sur les trois providers à
peu près en même temps. Et euh
globalement ce qu'il a à faire, c'est se
rendre compte que euh en fait il est
dans mon contexte que tous mes plans de
semaine sont directement dans euh mon
mes trucs live phases ici dans mes notes
hebdomadaires. Aller lire cette note et
me rapporter ce qui est marqué dans
cette note. Donc c'est vraiment pas
compliqué mais on va voir du coup s'ils
peuvent le faire.
OK. Dipsic, donc sur les serveurs de
Dieps en Chine a déjà trouvé. Il sait
exactement ce que je dois faire,
déclarer ma TVA, euh écrire mes scripts
de vidéos YouTube, préparer les offre et
cetera.
OK, on a euh Dipsic V4 sur Open Router
qui est également tourné et puis pour
finir, on a Venis qui est revenu. Donc
on a en gros 10 ou 14 secondes d'écart
ici euh ce qui est vraiment pas
déconnant au niveau du coup que ça a
coûté. Du coup, OK, je continue mon test
en testant un deuxième motel GLM 5.2. On
a vu qu'il était un peu au-dessus des
prix du marché sur Venice AI. Je le
teste aussi sur Fireworks AI qui est un
de mes provider d'inférence favoris et
puis GLM 5.2. Donc là faut se dire qu'on
a exactement le même niveau de
confidentialité parce qu'on a du ZDR
dans les trois cas donc du zéro la
tertension. Donc en fait sur ce genre de
chos en l'occurrence il y a aucun
intérêt à aller spécifiquement sur
Venice parce qu'en fait on aura le même
niveau de confidentialité sur les autres
providers. Donc l'idée c'est juste de
voir en fait qui est le plus rapide
concrètement.
Donc qu'est-ce qu'on peut voir déjà ?
C'est que sur Open Router, il m'a déjà
fait les plans de mes slides euh et il
m'a déjà rendu en fait le une question.
J'ai dit "OK, go génère tout" et du coup
il va générer les slides. C'est assez
incroyable, sachant que Venice, il a
même pas encore fini d'explorer et
Firewks est toujours en train de faire
le plan et de réfléchir. Euh donc je
trouve ça très cool. Mais en réalité
pourquoi est-ce que Open Router est
meilleur ? Parce que leur provider
d'inférence principale pour GM5.2 c'est
Wafer AI. Et Wafer AI honnêtement c'est
ma boîte d'inférence préférée en ce
moment. C'est une team de de de de
Chinois qui sont absolument excellents
sur l'optimisation de l'inférence tout
comme Firex AI d'ailleurs. Mais en gros
voilà, si vous passez en direct, ils ont
sur optimisé tous les LLM open source et
on est sur des prix qui cassent en fait
le marché avec une inférence qui est la
plus rapide du bah du milieu avec 151
token par seconde ou 288 token par
seconde. Donc c'est extrêmement rapide.
En gros, quand vous utilisez CLAD en
mode normal, vous près à 50 60 token par
seconde. Donc là, on a vraiment un
intérêt à aller sur sur du WFR, même en
terme d'efficience hein et de de coût
pour une entreprise. OK, donc pendant
que ça travaille, je vous propose qu'on
s'intéresse un petit peu à la partie
yield justement et token crypto de
Venice. Donc concrètement, Venice, il
vous propose deux tokens. On a le VVV
qui est le token principal de Venice qui
vous permet donc de d'avoir le token
communautaire et puis le 10 qui est donc
un un type de token qui en fait vous
permet de posséder une partie en gros de
de l'inférence et donc de recevoir c'est
c'est avec ce token là que vous recevez
1 dollar par jour par nombre de DM que
vous possédez. Par exemple, si je vous
mettais 1400 € dans dans le DM, en gros,
vous avez un token de DM complet, alors
vous avez 1 dollar de équivalent crédit
sur la Venice API. Euh donc là par
exemple, pour vous donner un une ordre
d'idée, ma présentation, elle m'a coûté
32 centimes. Donc je pourrais faire en
gros ou plutôt 50 centimes quand ça sera
fini. Je pourrais faire en gros deux
présentations en mettant 1400 € en en
token. Je pourrais faire en gros deux
présentations par jour en passant par ce
type de de système. Donc au niveau de ce
token VV concrètement, comment est-ce
qu'il fonctionne ? Donc vous pouvez
l'acheter, l'échanger directement une
fois que vous le possédez. Concrètement,
il vous donne si vous avez plus de 100
VV, donc vous avez mis plus de 1400 €
dans leur token, un abonnement gratuit
pour être pro sur Venice, donc à 18 €
par mois qui est offert. C'est un des
avantages. Le second avantage, c'est que
vous pouvez le staker pour dire 12 % de
rendement. Attention tout de même parce
que avec c 12 % de rendement, donc c'est
actualisé, c'est pas un rendement
garanti annuel, en réalité actuellement,
ils sont encore en phase d'émission du
token. Et donc, on est près à 12 %
d'inflation aussi. Donc en fait, c'est
comme si vous euh effectivement vous
avez du du
rendement dessus, mais il y a en même
temps 12 % d'inflation et donc euh en
fait vous c'est comme si vous sauviez
votre mise, ça reste à l'équilibre, ça
on vous le dit pas mais pour le moment
c'est un peu une arnaque. On verra
comment le le yield reste euh quand
l'émission de token sera terminée et qui
passeront seulement en B. Au niveau de
la fluctuation du prix, on peut voir
qu'il a eu un ATH à 22 dollars ici il y
a quelques mois en juin, il a quelques
jours plutôt. Euh du coup, il a assez
récent, il a été mis le 27 janvier 2025,
il a été airdropé à la communauté. Tous
les tokens d'ailleurs ont été brûlés,
ceux qui n'ont pas été réclamés. Et puis
aujourd'hui, on est toujours en phase
d'inflation du nombre de tokens euh et
on atteint du coup un prix qui est assez
intéressant. Je pense que honnêtement,
alors c'est pas un conseil
d'investissement mais euh
si vous voulez tester un peu d'avoir de
la spéculation sur ce genre de token, je
pense qu'il y a moyen que par rapport
aux grandes forces du marché et de la
capacité marketing de Venice, le token
puisse encore prendre pas mal de valeur
et donc vous y retrouviez en fait sur
votre investissement. Et du coup, il y a
un dernier mécanisme qui est intéressant
avec le VV, c'est que vous pouvez euh
donc euh en fait abander une partie de
votre yeld euh pour justement minter du
DM. Ça un peu compliqué mais en gros ça
échanger une partie de enfin en en
locant en disant votre VV euh ça vous
permet de générer du DM ce qui
équivaudrait aujourd'hui à l'heure
actuelle à à peu près le l'équivalent en
fait en en puissance de calcul que vous
auriez en ayant directement du DM. Donc
à l'heure actuelle, c'est beaucoup plus
intéressant d'avoir du VV mais le VV tu
as un truc qui est que ça a une courbe
en V. C'està dire que si la demande est
peu importante, alors tu reçois beaucoup
euh d'équivalents d'M et donc
d'équivalent en puissance de calcul pour
pouvoir l'utiliser en API. Et par contre
quand il y a plus de demande, tu reçois
beaucoup moins. Donc ça te récompense en
fait quand [grognement] de en fait de
supporter le réseau quand il y a moins
de demandes et quand il y a plus de
demandes bah du coup ça ça remet dans le
dans le dans dans l'inférence. Mais
comme il y a plus de gens qui
l'utilisent, c'est qu'il y a plus de
revenus. C'est qu'il y a plus de VVV qui
est brûlé et donc ça veut dire que ton
token apprécie plus. Donc en fait, soit
c'est il te donne plus d'appréciation,
soit ils te donne plus de puissance de
calcul. En fait, ça va dépendre euh de
la journée en gros. Donc c'est des
mécanismes qui sont un peu complexes,
mais honnêtement, je trouve qu'il y a un
truc qui est intéressant là-dedans qui
est mais comment en fait tu crées une IA
qui est qui est de plus en plus
souveraine, non pas un état duquel en
fait tu es parti à l'état mais la
souveraine d'une communauté qui
posséderait la gouvernance d'une d'une
inférence et d'un parc IA. Euh une sorte
de tokenisation data center,
tokenisation de capacité de de d'API.
Euh le problème là, c'est que la
gouvernance n'est pas elle dépend pas
disons d'une d'une DAO qui serait liée
au détenteur du token. Elle elle est
vraiment uniquement réservé au fondateur
de du token qui peut du coup en fait
faire une génération de de 10000 VV de
main, ce qui baisserait mécaniquement le
prix du token. Donc tu es vraiment à la
mercie d'un sorte de dictateur ultra
ultra libéral. Donc je sais pas si c'est
vraiment ce qu'on veut mais si vous êtes
assez riche honnêtement je pense ça vaut
le coup de mettre un peu de cash
là-dessus. Ça peut être intéressant ne
serait-ce que pour avoir l'abonnement
pro gratuitement tout en faisant
apprécier une partie du capital si ça
marche en tout cas et puis en échangeant
une partie contre des token à pay.
Maintenant, est-ce que c'est une
recommandation ? Est-ce que c'est le
hack à la mode ? Absolument pas parce
que pour avoir du coup 10 dollars par
jour de token API, ce qu'il vous
faudrait à peu près pour travailler
correctement.
Euh en tout cas aujourd'hui au prix
actuel, ben il vous faut 14000 € lockés
pour obtenir 10 dollars par jour, tu
vois. Donc c'est c'est un peu un peu
beaucoup, sachant que l'appréciation du
token DM est vraiment est pas est pas
sûre quoi. Ça reste un token crypto
purement spéculatif donc je sais pas si
je le je le mettrai dans [grognement]
mon portfolio. En tout cas, c'est
vraiment pas des conseils
d'investissement. Je trouvais ça juste
intéressant de s'intéresser bah à la
partie souveraineté jusqu'au bout. Euh
l'encryption donc cryptographique enfin
au moment du du traitement de de votre
demande qui permet d'aller plus loin que
le ZDR parce que c'est vérifié
mathématiquement et c'est pas qu'un
englagement contractuel qui peut être
euh balayé du euh cloud act américain
euh qui passe au-dessus de cette loi du
ZDR. Euh et puis aussi qui permet du
coup d'un point de vue souveraineté de
posséder une partie du parc euh bah en
fait enfin du parc de en tout cas de la
capacité euh de d'inférence de lire. OK.
Donc globalement, c'est ce qu'on vient
voir au niveau des résultats pour finir
cette vidéo. GLM 5.2 sur open router,
donc il tourne sur Wafer AI, ils ont mis
3 minutes 25, ça a coûté 35 centimes.
Euh 32 centimes ici sur sur Fireworks AI
avec euh 5 minutes 39 de temps de
travail et 7 minutes 38 pour Venis sur
un coût qui est à peu près deux fois
plus cher. Euh voilà, c'est là qu'on
voit honnêtement euh passer par Venice
AI pour utiliser de la PI, vous avez le
même niveau de confidentialité qu'avec
une boîte qui vous propose du ZDR. Et
donc c'est voilà, c'est vraiment pas
intéressant. Le seul truc intéressant
honnêtement si vous voulez prendre du
Venice AI, c'est de
directement vous abonner euh au Farfait
Pro. Si vous voulez juste avoir un chat
simple, vous pouvez poser des questions
à Lia simple si vous êtes encore un gu
de Lia, je rigole mais une personne qui
utilise LIA pas de manière agentique
dans un écosystème local. Et au niveau
des présentations, on s'en fout un peu
du résultat parce que c'est le même
modèle globalement. Euh voilà, vous fait
une présentation correcte sur les
vidéos. Euh voilà euh c'est pas
transcendant hein, mais c'est correct
honnêtement. Je pourrais présenter
là-dessus sans trop de problème avec
juste un une D que j'aurais édité un peu
mieux. Et voilà, c'est tout pour cette
vidéo. J'espère qu'elle vous aura plu ou
du moins diverti. Si vous avez plus de
connaissances que moi sur le monde de la
crypto, hésitez pas à m'expliquer euh
dans les commentaires des choses que
j'aurais pas compris sur les mécanismes
du token et pourquoi ce serait
intéressant donc de de [grognement]
posséder ce token. Quant à moi, je vous
souhaite une excellente journée. Ciao !
Ask follow-up questions or revisit key timestamps.
Cette vidéo analyse Venice AI, un projet d'intelligence artificielle fondé par Eric Voorhees, se distinguant par ses promesses de confidentialité, de non-censure et son modèle économique basé sur des tokens crypto. L'auteur explore les niveaux de protection des données offerts, allant de l'anonymisation simple au chiffrement TEE (Trusted Execution Environment), tout en comparant les performances et les coûts par rapport aux standards du marché. Enfin, une réflexion est menée sur l'usage des IA dans un contexte souverain et local, soulignant l'importance de posséder ses propres outils et son environnement de travail.
Videos recently processed by our community