IA local: Mac Studio M3 ultra vs Strix Halo vs Nvidia Spark

Plavec
ForoCoches: Usuario
#1
Hola, shurs:

Para plantear una solución all-in-one para correr modelos IA local potentes (70b de parámetros para arriba), por cuál os decantaríais? Podéis proponer otro hardware.


Funciones de elaboración de informes, recobir múltiples pdf y generar nuevos documentos con ellos, bases de datos, búsqueda de patrones...


Gracias!
joan16v
ForoCoches: Miembro
#2
pues alguno con 128GB de ram

los RTX spark el problema es que aún no han salido, solo se han anunciado


y el mac studio m3 ultra tiene "solo" 96GB de ram y vale 5000 euros


podrias considerar el macbook pro m5 max con 128gb de ram que son 6000 euros
Plavec
ForoCoches: Usuario
#3
Cita de joan16v
pues alguno con 128GB de ram

los RTX spark el problema es que aún no han salido, solo se han anunciado


y el mac studio m3 ultra tiene "solo" 96GB de ram y vale 5000 euros


podrias considerar el macbook pro m5 max con 128gb de ram que son 6000 euros
y crees que de quedaría pronto obsoleto para modelos futuros? Sabes de otras opciones además del macbook pro m5 max? Gracias por responder.
Muffins
ForoCoches: Usuario
#4
Por lo que vale el m3 te compras dos nvidia y el hardware pare conectarlos juntos con el nvlink de 400gb
Sato.sh
Feliz y contento
#5
Pero habéis comprobado a qué nivel están esas IA primero? Comparadas con las comerciales como serían, como un GPT 4, 5, 5.4? Claude Sonnet 4.7?
Antrax18
ForoCoches: Usuario
#6
Cita de Plavec
y crees que de quedaría pronto obsoleto para modelos futuros? Sabes de otras opciones además del macbook pro m5 max? Gracias por responder.
Evidentemente. Pero es que esto ya va a ser un no parar hasta la inteligencia artificial general. Cada vez será más complicado actualizar el hardware, hasta que la IA permita iterar la innovación en hardware al mismo ritmo, que lo dudo.


Llegados a ese punto, sería la menor de mis preocupaciones.
joan16v
ForoCoches: Miembro
#7
pues en twitter he visto gente que tiene el M3 Ultra con 512GB de RAM, pero no se como lo han conseguido


igual antes se tenia la opción de aumentarle hasta esa cantidad, pero ahora veo que no
OsMaN2k3
ForoCoches: Usuario
#8
Realmente ejecutar modelos grandes (128gb) en local es eficiente? O se va a tirar media hora en contestar ya que por mucha memoria que haya no hay potencia suficiente?
Plavec
ForoCoches: Usuario
#9
Cita de OsMaN2k3
Realmente ejecutar modelos grandes (128gb) en local es eficiente? O se va a tirar media hora en contestar ya que por mucha memoria que haya no hay potencia suficiente?
creo que depende del ancho de banda. Dos 5090 te dan mucho más que el Mac pero a cambio se queda corta de VRAM para cargar el modelo y el gasto eléctrico y ruido aumenta. Yo busco algo para llevar al trabajo, no debe ser ruidoso ni ocupar mucho espacio. Creo que eso lo cumple el Mac mini o macbook pro, asus ascent, nvidia spark y Strix Halo de AMD.

Por otro lado, lo de quedarse obsoleto no se hasta qué punto. Las empresas ahora buscan cuantizar mejor y hacer modelos eficientes.
CheckCenter
ForoCoches: Miembro
#10
Por lo que cuestan estos trastos, lo pronto que se quedan obsoletos y el elevado consumo de electricidad no lo veo la verdad si pretendes hacerlo en España.

Ahora mismo, salvo que necesites estar 24/7 a full, prefiero alquilar GPUs en vast.ai o runpod y/o modelos en openrouter o deepinfra.

Cuando hayan modelos que puedas ejecutar con una CPU y memoria normal, volveré a interesarme por esto. Ahora sigo con Gemini o DS/qwen
Plavec
ForoCoches: Usuario
#11
Cita de CheckCenter
Por lo que cuestan estos trastos, lo pronto que se quedan obsoletos y el elevado consumo de electricidad no lo veo la verdad si pretendes hacerlo en España.

Ahora mismo, salvo que necesites estar 24/7 a full, prefiero alquilar GPUs en vast.ai o runpod y/o modelos en openrouter o deepinfra.

Cuando hayan modelos que puedas ejecutar con una CPU y memoria normal, volveré a interesarme por esto. Ahora sigo con Gemini o DS/qwen
Necesito privacidad por manejar datos sensibles. No se me ocurre otra opción que hacerlo en local. Existen acuerdos con suscripciones de empresa, pero no sé hasta que punto cumplen RGPD y me sale más rentable.
loko_rose
ForoCoches: Miembro
#12
Cita de CheckCenter
Por lo que cuestan estos trastos, lo pronto que se quedan obsoletos y el elevado consumo de electricidad no lo veo la verdad si pretendes hacerlo en España.

Ahora mismo, salvo que necesites estar 24/7 a full, prefiero alquilar GPUs en vast.ai o runpod y/o modelos en openrouter o deepinfra.

Cuando hayan modelos que puedas ejecutar con una CPU y memoria normal, volveré a interesarme por esto. Ahora sigo con Gemini o DS/qwen
La spark tiene un tgp que no llega a los 200W. Menos que una ps5, por ejemplo. Teniendo una conectada 24/7 no va a arruinar ninguna empresa, y en idle no gastará ni 60W.
EnxebreFC
ForoCoches: Usuario
#13
Debes actualizar el concepto de "modelo potente" porque uno denso (Qwen3.6 27B o Gemma4 31B) de 2026 supera a modelos 120B de 2025.

Lo primero sería tener claro con qué herramientas y modelos quieres trabajar para decidir el hardware.

Para mover modelos densos necesitas mucho ancho de banda y ninguno de esos equipos (excepto el M3 Ultra) lo ofrece.

Si quieres algo profesional necesitas una o varias GPU de 32-48GB como la Radeon R9700 o la RTX PRO 4500.

También está la opción de recurrir a segunda mano, aunque aquí hay muchas opciones dónde elegir.
Plavec
ForoCoches: Usuario
#14
Cita de EnxebreFC
Debes actualizar el concepto de "modelo potente" porque uno denso (Qwen3.6 27B o Gemma4 31B) de 2026 supera a modelos 120B de 2025.

Lo primero sería tener claro con qué herramientas y modelos quieres trabajar para decidir el hardware.

Para mover modelos densos necesitas mucho ancho de banda y ninguno de esos equipos (excepto el M3 Ultra) lo ofrece.

Si quieres algo profesional necesitas una o varias GPU de 32-48GB como la Radeon R9700 o la RTX PRO 4500.

También está la opción de recurrir a segunda mano, aunque aquí hay muchas opciones dónde elegir.
Necesito algo portable, no exceder gasto de electricidad, que no sea muy ruidoso y modelos que permitan grabar voz, transcribir y hacer informes con ello y generar bases de datos con esos informes. Entiendo que para ello no necesito modelos muy top.
EnxebreFC
ForoCoches: Usuario
#15
Cita de Plavec
Necesito algo portable, no exceder gasto de electricidad, que no sea muy ruidoso y modelos que permitan grabar voz, transcribir y hacer informes con ello y generar bases de datos con esos informes. Entiendo que para ello no necesito modelos muy top.
Probablemente lo mejor sea un Macbook Pro M5 Max de 64GB pero hablamos de 4900€.

Tiene 460GB/s de ancho y con MacOS puedes instalar el framework MLX, rinde bien y es fácil de configurar.


Si quieres un Strix Halo o un Spark, sólo vas a conseguir buen rendimiento en Linux y vas a tener que aprender a manejarte con Docker y software que no está siempre bien pulido (especialmente con AMD).
Mig17
ForoCoches: Miembro
#16
Cita de Plavec
Necesito algo portable, no exceder gasto de electricidad, que no sea muy ruidoso y modelos que permitan grabar voz, transcribir y hacer informes con ello y generar bases de datos con esos informes. Entiendo que para ello no necesito modelos muy top.

Para hacer eso los 70B incluso se te quedan grandes. Un 7B, 13B te lo pueden hacer bien. Y considera también la quantización para hacerlos más pequeños.
CibernoX_CTDI
ForoCoches: Miembro
#17
Yo no compraría ninguno de esos.
El m3 ultra tiene memoria rápida pero el prompt processing es muy lento.
Los strix halo tienen un prompt processing algo mejor pero nada de tirar cohetes y una memoria muy lenta.
El Nvidia Spark es el mejor de todos porque el prompt processing volará, pero la memoria es solo un poquito mejor que el AMD. Aunque como tiene soporte para fp4 y fp8 y el software de nvidia está muy bien optimizado es, en la práctica, es que mejor irá de los 3.

Ahora mismo, salvo que estés dispuesto a dejarte 15k€, lo que mejor calidad/rendimiento te dará serán 2 gráficas de 24gb por 2k euros montadas en un PC normalito. No vas a poder correr modelos tope de gama, pero vas a poder correr modelos uno modelos de ~30B a máxima calidad con mucho contexto y buena velocidad.
Yo prefiero 100 veces correr un modelo como qwen 27B a tope de contexto a 70tk/s y prompt processing a 900tk/s, que intentar correr un modelo muy muy listo a 12tk/s y con un PP a 150tk/s. Un modelo menos listo pero que puede iterar en un problema varias veces, testeando su propio trabajo y haciendo ajustes el preferible que un modelo que tarda 10 minutos solo en procesar un contexto de 100k tokens y en empezar a trabajar.


Es posible que el M5 ultra cambie las reglas un poco, porque la linea m5 tiene por fin aceleradores matmul que deberían hacer que el prompt processing the los mac sea competente, puede que similar a una RTX4090. Ahora bien, no espereis que valga menos de 7500€
Plavec
ForoCoches: Usuario
#18
Cita de CibernoX_CTDI
Yo no compraría ninguno de esos.
El m3 ultra tiene memoria rápida pero el prompt processing es muy lento.
Los strix halo tienen un prompt processing algo mejor pero nada de tirar cohetes y una memoria muy lenta.
El Nvidia Spark es el mejor de todos porque el prompt processing volará, pero la memoria es solo un poquito mejor que el AMD. Aunque como tiene soporte para fp4 y fp8 y el software de nvidia está muy bien optimizado es, en la práctica, es que mejor irá de los 3.

Ahora mismo, salvo que estés dispuesto a dejarte 15k€, lo que mejor calidad/rendimiento te dará serán 2 gráficas de 24gb por 2k euros montadas en un PC normalito. No vas a poder correr modelos tope de gama, pero vas a poder correr modelos uno modelos de ~30B a máxima calidad con mucho contexto y buena velocidad.
Yo prefiero 100 veces correr un modelo como qwen 27B a tope de contexto a 70tk/s y prompt processing a 900tk/s, que intentar correr un modelo muy muy listo a 12tk/s y con un PP a 150tk/s. Un modelo menos listo pero que puede iterar en un problema varias veces, testeando su propio trabajo y haciendo ajustes el preferible que un modelo que tarda 10 minutos solo en procesar un contexto de 100k tokens y en empezar a trabajar.


Es posible que el M5 ultra cambie las reglas un poco, porque la linea m5 tiene por fin aceleradores matmul que deberían hacer que el prompt processing the los mac sea competente, puede que similar a una RTX4090. Ahora bien, no espereis que valga menos de 7500€
Gracias por el comentario. Debe ser portable, dos gráficas me dan ancho de banda pero no permiten cargar modelos pesados, gasta electricidad y es ruidoso, por lo que no me sirven.

Tampoco se utilizar Linux. Lo único que he utilizado es Ollama. Busco algo user-friendly y compatible con programas de mi trabajo (Mac/Windows).


Aunque pueda salir caro, creo que un Macbook Pro M5 Max puede cumplir, o algún otro Mac mini/studio, que desconozco si están por salir M con más memoria unificada y ancho de banda.
CibernoX_CTDI
ForoCoches: Miembro
#19
Cita de Plavec
Gracias por el comentario. Debe ser portable, dos gráficas me dan ancho de banda pero no permiten cargar modelos pesados, gasta electricidad y es ruidoso, por lo que no me sirven.

Tampoco se utilizar Linux. Lo único que he utilizado es Ollama. Busco algo user-friendly y compatible con programas de mi trabajo (Mac/Windows).


Aunque pueda salir caro, creo que un Macbook Pro M5 Max puede cumplir, o algún otro Mac mini/studio, que desconozco si están por salir M con más memoria unificada y ancho de banda.
Lo de que gasta electricidad es cierto a medias. Es cierto que un mac ultra consume la mitad que una GPU, pero también es cierto que la GPU termina la tarea en la mitad de tiempo o menos. Y gastar el doble durante la mitad de tiempo al final es la misma energía. La diferencia no es grande.
Plavec
ForoCoches: Usuario
#20
Cita de CibernoX_CTDI
Lo de que gasta electricidad es cierto a medias. Es cierto que un mac ultra consume la mitad que una GPU, pero también es cierto que la GPU termina la tarea en la mitad de tiempo o menos. Y gastar el doble durante la mitad de tiempo al final es la misma energía. La diferencia no es grande.
por especificaciones estoy entre el m5 max de 128GB o esperar a RTX spark, que en principio sale a a finales de año, para poder tener CUDA y Windows, que me facilitaría la vida. Tener algo no portable lo descarto. Gracias.
CibernoX_CTDI
ForoCoches: Miembro
#21
Cita de Plavec
por especificaciones estoy entre el m5 max de 128GB o esperar a RTX spark, que en principio sale a a finales de año, para poder tener CUDA y Windows, que me facilitaría la vida. Tener algo no portable lo descarto. Gracias.
Si no tienes otra opción y tiene que ser portátil pues son las dos opciones que hay. Yo como tengo en casa una zona con dos servidores pues lo meto todo allí y el portátil no ejecuta nada.
← A Electrónica / Informática
Amazon
Nuevas ofertas cada día