ça semble super ! merci.
Je n’avais pas lu ce fil récemment… C’est une super avancée.
Ça me fait penser à mes prompts dans Antigravity, où lorsque je lui demande une action, il commence par une requete pour déterminer l’outil approprié à ma demande, puis se lance avec ces outils. Gladys devient donc petit à petit un agent ! ![]()
Tout est disponible dans Gladys Assistant 4.84 : Gladys Assistant 4.84 : Les intégrations externes sont là 🚀
J’ai testé et ça fonctionne bien !
Par contre je tourve les mentions € économique · €€ moyen · €€€ premium un peu confusantes, un utilisateur pourrait penser que chaque question va lui coûter des sous ![]()
Bonjour,
J’aimerai connecter mon Gladys à mon serveur local qui tourne sur un Qwen3.5 122B. Y a t-il une procédure déjà décrite pour cela?
Je pourrai vous faire un retour sur cette config (certes un peu onéreuse, mais locale).
Existe t-il un protocole de teste mis en place pour pouvoir comparer les différents modèles entre eux?
Bonjour @l.dolle
Très intéressé par ton retour pour ma part, moi qui suit en cours de devis pour le pro pour un serveur IA VLM + LLM ! Ça m’intrigue beaucoup de voir du Qwen3.5-122B tourner en local.
Si ce n’est pas indiscret, tu pourrais détailler un peu l’infra ? Type de machine, quantité et type de RAM (unifiée type Mac/Strix Halo, ou DDR5 classique + GPU ?), quantification utilisée, et le moteur d’inférence (Ollama, llama.cpp, vLLM…).
Et surtout, si tu as des chiffres sous plusieurs angles : le temps avant le premier token et la vitesse de génération, avec et sans le mode thinking. C’est probablement là que ça se joue pour un usage domotique où on attend une réponse quasi immédiate.
Merci d’avance !
EDIT : Pour ma part je fais pour le moment tourner sur mon PC portable pro des petits modèle sous LM Studio, bien pratique pour les tests !
Bonjour @Terdious
Le serveur est un MGKtec evo2 équipé donc d’un AMD Strix Halo avec 128Go de RAM unifiée.
J’ai viré Windows (je ne voyais pas l’intérêt de prendre un serveur local si c’était pour envoyer toutes mes données chez Microsoft) et j’ai dû installer Fedora serveur (qui utilise le cœur Linux 7.1) car Debian13 n’utilise que le cœur Linux 6.12 et donc ne reconnaît pas Strix Halo.
J’ai installé tout l’environnement IA avec ODS (Osmantic Dream Server) que je t’invite à aller voir.
Voici une capture d’écran de mon système au repos.
J’espère avoir répondu à tes questions.
N’hésite pas si tu veux d’autres renseignements.
P.S.: Je manque de protocoles de tests pour évaluer mon serveur. Si tu en disposes, je suis preneur.
Salut @l.dolle, ce n’est pas possible actuellement, mais je pense qu’on pourrait rajouter une API aux intégrations externes pour que ça puisse devenir une intégration externe !
J’ai écris une demande : Intégrations externes : pouvoir créer des intégrations de type "fournisseur IA"

