Encuesta: ¿Cuál es tu modelo de IA favorito en Gladys?

¡Parece genial! Gracias.

No había leído este hilo recientemente… ¡Es un gran avance!
Me recuerda a mis prompts en Antigravity, donde cuando le pido una acción, comienza con una solicitud para determinar la herramienta adecuada para mi solicitud, y luego se lanza con esas herramientas. Gladys se está convirtiendo poco a poco en un agente. :smiley:

Todo está disponible en Gladys Assistant 4.84: Gladys Assistant 4.84 : Les intégrations externes sont là 🚀

¡« Dame una tabla de temperaturas de la casa »!

¡Y además ultra rápido!

¡Lo he probado y funciona bien!

Por otro lado, encuentro las menciones € económico · €€ medio · €€€ premium un poco confusas, un usuario podría pensar que cada pregunta le va a costar dinero :confused:

Hola,

Me gustaría conectar mi Gladys a mi servidor local que funciona con un Qwen3.5 122B. ¿Hay algún procedimiento ya descrito para esto?

Podré darles feedback sobre esta configuración (ciertamente un poco costosa, pero local).

¿Existe algún protocolo de prueba establecido para poder comparar los diferentes modelos entre sí?

Hola @l.dolle

Muy interesado en tu opinión, yo que estoy en proceso de cotización para el proyecto de un servidor IA VLM + LLM. ¡Me intriga mucho ver a Qwen3.5-122B funcionando localmente!

Si no es indiscreto, ¿podrías detallarnos un poco la infraestructura? Tipo de máquina, cantidad y tipo de RAM (unificada tipo Mac/Strix Halo, o DDR5 clásica + GPU?), cuantificación utilizada, y el motor de inferencia (Ollama, llama.cpp, vLLM…).

Y sobre todo, si tienes cifras desde varios ángulos: el tiempo antes del primer token y la velocidad de generación, con y sin el modo thinking. Probablemente ahí está la clave para un uso domótico donde se espera una respuesta casi inmediata.

¡Gracias de antemano!

EDIT: Por mi parte, por el momento hago funcionar en mi portátil profesional modelos pequeños bajo LM Studio, ¡muy práctico para las pruebas!

Hola @Terdious

El servidor es un MGKtec evo2 equipado con un AMD Strix Halo y 128 GB de RAM unificada.

He eliminado Windows (no veía el interés de tener un servidor local si era para enviar todos mis datos a Microsoft) y he tenido que instalar Fedora Server (que utiliza el núcleo Linux 7.1) porque Debian13 solo usa el núcleo Linux 6.12 y, por lo tanto, no reconoce Strix Halo.

He instalado todo el entorno de IA con ODS (Osmantic Dream Server), que te invito a ver.

Aquí tienes una captura de pantalla de mi sistema en reposo.

Espero haber respondido a tus preguntas.

No dudes en preguntar si necesitas más información.

P.D.: Me faltan protocolos de prueba para evaluar mi servidor. Si tienes alguno, estaré encantado de probarlos.

Hola @l.dolle, actualmente no es posible, pero creo que podríamos añadir una API a las integraciones externas para que pueda convertirse en una integración externa.

He escrito una solicitud: Intégrations externes : pouvoir créer des intégrations de type "fournisseur IA"