¿Habéis probado las IAs chinas recientes? GLM-5.2

beliceus
ForoCoches: Usuario
#31
Cita de Sartana
Pues ya me dirás dónde porque esto es lo que me sale en G2A. Por 5€ merece la pena el riesgo.



Puse que era de Gemini
https://www.g2a.com/es/google-ai-gem...10000510949007
Sartana
El Winchester más rápido
#32
Cita de beliceus
Ah lástima, lo que quería era Codex
eThor
ForoCoches: Usuario
#33
¿Qué tal esos modelos para el día a día picando código? Yo no sé hasta qué punto necesito Opus 4.8 o gpt 5.5. El primero me dura día y medio literal, y el segundo 3 días y me tengo que esperar toda la semana.. No sé si tirando de OpenCode por 5 o 10 euros podría usar esos modelos de manera habitual o se nota mucho la pérdida de calidad..Vamos, que para apps web, MVC y algo así, tampoco diseño cohetes de la Nasa
Kolapsos
ForoCoches: Miembro
#34
Cita de eThor
¿Qué tal esos modelos para el día a día picando código? Yo no sé hasta qué punto necesito Opus 4.8 o gpt 5.5. El primero me dura día y medio literal, y el segundo 3 días y me tengo que esperar toda la semana.. No sé si tirando de OpenCode por 5 o 10 euros podría usar esos modelos de manera habitual o se nota mucho la pérdida de calidad..Vamos, que para apps web, MVC y algo así, tampoco diseño cohetes de la Nasa

Has probado antigravity de Google? Con el plan pro da para bastante antes de gastarte los tokens,
eThor
ForoCoches: Usuario
#35
Cita de Kolapsos
Has probado antigravity de Google? Con el plan pro da para bastante antes de gastarte los tokens,
Uff, pues ni lo había pensado, la IA de Google no la he usado mucho
guillefix
ForoCoches: Miembro
#36
Cita de Kolapsos
Has probado antigravity de Google? Con el plan pro da para bastante antes de gastarte los tokens,
Siento discrepar... Si lo usas para tareas puntuales, puede servir, pero si vas a estar unas horitas programando, en dos días te fundes los créditos semanales.
Cita de eThor
¿Qué tal esos modelos para el día a día picando código? Yo no sé hasta qué punto necesito Opus 4.8 o gpt 5.5. El primero me dura día y medio literal, y el segundo 3 días y me tengo que esperar toda la semana.. No sé si tirando de OpenCode por 5 o 10 euros podría usar esos modelos de manera habitual o se nota mucho la pérdida de calidad..Vamos, que para apps web, MVC y algo así, tampoco diseño cohetes de la Nasa
Pues mira, yo he estado usando opencode go estos días normalmente con GLM-5.2 haciendo los planes y usando MiniMax M3 para implementarlos (o deepseek v4 flash si son cosas sencillas) y he logrado hacer casi todo a la primera; lo único que le ha costado a GLM ha sido encontrar un bug en Android pero solo he tenido que iterar una vez sobre su respuesta. Así que estoy satisfecho, que por lo que cuesta en comparación a Claude y Chatgpt...

Si te interesa te puedo pasar referido por MP y nos dan 5$ de créditos extra a ambos. Tampoco quiero hacer spam, pero bueno, que también puedes encontrarlos por internet.
Cita de Casa Paco
Qué equipo te hace falta para correr las chinas en local?
Uno de la nasa. Olvídate de ejecutar GLM en uno normal o incluso en uno potente sin cuantizarlo bastante.
cincen
rayos truenos y sentellas
#37
Hola,

Yo estoy usando para código Claude, tengo la suscripción Max5 ... pero cuando agoto mi cuota horaria cambio a MiniMax-M3 que la cuota horaria me dura 10 veces más que la de Claude . .a veces incluso directamente uso Minimax en lugar de Claude.

Después para otros procesos uso Deepseek-V4-Flash.

La nueva de Kimi aun no la he probado pero tiene muy buena pinta al igual que la de GLM 5.2.
Lord-Blade
ForoCoches: Miembro
#38
Cita de Casa Paco
Qué equipo te hace falta para correr las chinas en local?
Varias dgx spark.
Imac muy potente con mucha memoria RAM.
Varios strix halo.
Servidor rack o workstation.
Placa base con muchos pcie, 128 gbs de RAM y muchas GPU que la mayor capacidad VRAM posible.


Y con esto estaríamos hablando de ejecutarlo cuantizado y mucho mas lento que en la nube.
TeteYildo
ForoCoches: Miembro
#39
Cita de joan16v
yo uso Qwen en local y van genial
Que ordenador usas y que modelo de qwen??
joan16v
ForoCoches: Miembro
#40
tengo una RTX 3080 10GB y corro el Qwen3 8B muy fluido
Kalambrazo
ForoCoches: Usuario
#41
Cita de beliceus
Primero tendría que enterarse


Esta semana cambié Chatgpt 5.5 y Opus 4.8 por DeepSeek 4 Pro como modelo principal de thinking de programación. No sé qué narices hicieron para esta última versión pero me encanta como responde, no es que sean mejores respuestas que los otros, están al mismo nivel, pero es como te las presenta y como enfoca los problemas que le planteo sin apenas necesidad de dirigirlo, la sensación de que sabe hacia dónde quiero ir es infinitamente mayor a de los otros donde tengo que pelearme constantemente para que no se salgan del camino. Abora estoy "in love" pero entiendo que esto ya depende de los gustos de cada uno.




Lo mismo que con Gemini Pro, desde principios de semana es mi agente principal para Android Studio, y eso que lo había probado hace meses y era un desastre
(por cierto, si buscais teneis ofertas de licencias de 12 meses por 5€ o así en G2A o similar)




Los probé por casualidad esta semana, cada dos o tres meses doy un paseo por IAs que no uso, en dos meses seguramente cambiaré otra vez aunque con Opus y Chatgpt ya llevaba casi un año
Por curiosidad, es fiable añadir a tu cuenta principal de Gmail una licencia de esas que comentas de Gemini de G2A? No se comparten datos ni se puede perder la cuenta de correo si te pillan?. Un saludo
Yaguito
I ❤ CEJAS
#42
Yo he probado Qwen, para cosas muy muy tontitas, no uso profesional, y no me disgusta. Al fin y al cabo, es gratis
todopegas
ForoCoches: Miembro
#43
Cita de pepistos
CaixaBank shur. Lo tienes de un día para otro.



Ya dije que use el Excel para sumar.
No se da cuenta la IA en 10 años de ingresos y gastos que me da cifras que son el doble? Eso cualquier humano lo detecta al momento.
Solo ChatGPT salvo los muebles.
Yo intentaría con Python + Pandas, exportando antes desde Excel a CSV. Cualquier IA te va a hacer un script durmiendo.
Xtroder
ForoCoches: Miembro
#44
Cita de EnxebreFC
Qwen3.6 27B es lo que está de moda ahora en local, pero necesitas al menos 24GB de VRAM.

Si te apoyas en los modelos frontera para diseñar y en local para picar código, te ahorras un buen dinero.
SI haces lo mismo planificando con Opus 4.8 y desarrollando con Sonnet 5 te sobra con la suscripción de 20 $ de Claude.

Tengo Qwen 3.6 27B y apenas lo uso porque Sonnet me lo hace mejor, no llegas al limite de los tokens y encima no gasto corriente.
miwa
ForoCoches: Miembro
#45
En el trabajo utilizo Claude. En proyectos personales voy alternando entre Claude y Codex.

Antigravity lo tenía para proyectos más sencillos, pero me está causando más problemas que soluciones, así que hace unas semanas me subscribí a Opencode Go y he estado probando GLM 5.2 junto a Kimi 2.7 Code.

La experiencia está siendo buena, sobre todo con GLM, pero con los 10€ de Go dura un suspiro. Así que por ahora no voy a gastar más dinero en ellos y voy a seguir con los modelos estadounidenses.


También he hecho pruebas en local en un M5 Pro con 24Gb de RAM y en un PC con Nvidia 4070 de 12Gb. Para consultas está bien, pero para programar tampoco lo veo una buena opción. Y salvo para IA local, los dos equipos me dan de sobra para mi uso diario, así que no me planteo actualizarlos.
EnxebreFC
ForoCoches: Usuario
#46
Cita de Xtroder
SI haces lo mismo planificando con Opus 4.8 y desarrollando con Sonnet 5 te sobra con la suscripción de 20 $ de Claude.

Tengo Qwen 3.6 27B y apenas lo uso porque Sonnet me lo hace mejor, no llegas al limite de los tokens y encima no gasto corriente.
Qwen 27B Q8 genera código al mismo nivel que Opus, pero tampoco creo tengas +48GB VRAM
europingüino
Eres kangrena
#47
Cita de pepistos
Yo la verdad que bastante sorprendido con lo que leo y las posibilidades de la IA pero a mí es que no me sirve ni para hacer sumas en Excel, Me he descargado del banco los movimientos de mi cuenta durante los últimos 10 años y la cosa es fácil, ingresos, gastos y sumatorios.
Yo lo he sumado en el Excel -bastante fácil como sabéis-, son 6400 filas, con lo que entiendo que no es un fichero muy grande (o si).
El caso es que como el Excel venía un poco raro, ya que una mitad iba en ascendente y otra en descendente y había un montón de fechas le he dicho a la IA que me lo agrupe por años y me haga gráficos, esquemas y toda la parafernalia. He subido el Excel con el sumatorio ya hecho.


Resultados (todas las IA de pago)


1) Gemini Pro, que me dice que son muchos datos y que el sumatorio lo haga yo.




2) Perplexity, con los modelos de Claude, Kimi y Nemotron, me saca las gráficas y los datos pero lo hace MAL en los tres modelos porque me duplica los gastos y los ingresos y no han sido capaces de detectar que la última fila era un sumatorio.




3) ChatGPT, de las que he usado ha sido la única que ha "detectado" el sumatorio y ha sacado los datos bien.


Y yo os leo aquí diciendo que programáis, que os viene bien, que si es el futuro, que si nos vamos a quedar sin trabajo todos y a mí no es capaz de detectarme una duplicidad en un simple Excel
this




estoy empezando a trastear y de momento esta es la sensacion que me esta dando todo el humo de los agentes




creo que les falta todavia mucho por pulir para poder hacer cosas basicas como esta
europingüino
Eres kangrena
#48
Cita de Dastan
Para programación (y mira que no lo soy) la única que no me borra códigos , aporta ideas , sabe exactamente lo que quiero y no me falla nunca es Claude y la versión free no me quiero imaginar si pago.

Las demás como Gemini Pro te borra cosas y te pide siempre perdón. Deepseek le hablas y te manda 200 líneas sin venir a cuento y así con todas.
+1


Claude esta muy bien hecho y destaca que te cagas
Xtroder
ForoCoches: Miembro
#49
Cita de EnxebreFC
Qwen 27B Q8 genera código al mismo nivel que Opus, pero tampoco creo tengas +48GB VRAM
De momento 24.

Generar código si, planificar no, ni de coña están al mismo nivel.
AJ4X
ForoCoches: Miembro
#50
Cita de EnxebreFC
Qwen 27B Q8 genera código al mismo nivel que Opus, pero tampoco creo tengas +48GB VRAM
Shur tengo un macbook m5 pro con 64gb de ram.


Que modelos me recomiendas? el que mejor resultado me ha dado de momento es el qwen3.6 35b a3b. Lo uso en vscode con cline para programar o con el hermes agent.


Crees que el 27b q8 puede tirar bien?


Acepto recomendaciones de otros agentes y tal.


(Lo probaria antes de preguntar pero es que estoy en el pueblo tirando de 5G y quiero asegurarme antes de descargar 30gb 😝)
Kilowatt
ForoCoches: Miembro
#51
He tenido plan max de Claude, codex, Zai, opencode go etc y después de muchísimos tiros pegados lo que he decidido es evitar el vendor locking construyendo un arnés y metodología de trabajo en opencode (te vale Pi o cualquier otro agente similar) e irme con el proveedor que más me convenga cada mes.

Voy adoptando lo que se va estandarizando y veo que me funciona, pero paso de acoplarme al CLI de una compañía que ya lo pasé mal para salirme de Claude Code en todos los proyectos.

Si quieres un modelo concreto siempre hay una trapala para meterlos en un CLI open source por subscripción. Para programar, cada mes que pasa importa menos no tener un modelo frontera. Y el curro que te pegas en el arnés no te lo secuestra nadie.

Actualmente mantengo la cuenta de Zai que hasta noviembre es como tener GLM 5.2 ilimitado y dos cuentas de 20$ de codex que balanceo con codex-lb (las pone la empresa). Gasto tokens sin mucho miramiento y voy bien. Cuando deje de rentar plug and play de otra cosa y fuera.
guillefix
ForoCoches: Miembro
#52
Cita de Kilowatt
He tenido plan max de Claude, codex, Zai, opencode go etc y después de muchísimos tiros pegados lo que he decidido es evitar el vendor locking construyendo un arnés y metodología de trabajo en opencode (te vale Pi o cualquier otro agente similar) e irme con el proveedor que más me convenga cada mes.

Voy adoptando lo que se va estandarizando y veo que me funciona, pero paso de acoplarme al CLI de una compañía que ya lo pasé mal para salirme de Claude Code en todos los proyectos.

Si quieres un modelo concreto siempre hay una trapala para meterlos en un CLI open source por subscripción. Para programar, cada mes que pasa importa menos no tener un modelo frontera. Y el curro que te pegas en el arnés no te lo secuestra nadie.

Actualmente mantengo la cuenta de Zai que hasta noviembre es como tener GLM 5.2 ilimitado y dos cuentas de 20$ de codex que balanceo con codex-lb (las pone la empresa). Gasto tokens sin mucho miramiento y voy bien. Cuando deje de rentar plug and play de otra cosa y fuera.
¿Qué tipo de arnés usas en OpenCode?
anekro
ForoCoches: Miembro
#53
Cita de pepistos
Yo la verdad que bastante sorprendido con lo que leo y las posibilidades de la IA pero a mí es que no me sirve ni para hacer sumas en Excel, Me he descargado del banco los movimientos de mi cuenta durante los últimos 10 años y la cosa es fácil, ingresos, gastos y sumatorios.
Yo lo he sumado en el Excel -bastante fácil como sabéis-, son 6400 filas, con lo que entiendo que no es un fichero muy grande (o si).
El caso es que como el Excel venía un poco raro, ya que una mitad iba en ascendente y otra en descendente y había un montón de fechas le he dicho a la IA que me lo agrupe por años y me haga gráficos, esquemas y toda la parafernalia. He subido el Excel con el sumatorio ya hecho.


Resultados (todas las IA de pago)


1) Gemini Pro, que me dice que son muchos datos y que el sumatorio lo haga yo.




2) Perplexity, con los modelos de Claude, Kimi y Nemotron, me saca las gráficas y los datos pero lo hace MAL en los tres modelos porque me duplica los gastos y los ingresos y no han sido capaces de detectar que la última fila era un sumatorio.




3) ChatGPT, de las que he usado ha sido la única que ha "detectado" el sumatorio y ha sacado los datos bien.


Y yo os leo aquí diciendo que programáis, que os viene bien, que si es el futuro, que si nos vamos a quedar sin trabajo todos y a mí no es capaz de detectarme una duplicidad en un simple Excel

Claude Cowork con la extension para Excel deberia de funcionarte
Dahrkael
Chuj ci w dupę
#54
llevo unos dias usando Big Pickle a traves de opencode que no es mas que GLM 5.2 pero gratis a cambio de que te lean las conversaciones y va mas rapido y tiene mucha mas cuota que pagando. estoy por cancelar la sub mientras dure
du212
Con Acritud
#55
Cita de Lord-Blade
Entiendo que estas enterado de los últimos debates en el seno de la UE y lo que sucede en UK.


En UK van bastante avanzados...


https://lasillarota.com/mundo/2026/2...el-584501.html


Me entere en reddit y allí me pusieron el enlace a la ley o propuesta.


En resumen, se puede aplicar medidas como las que aplica la liga en España o reino unido con su internet.


Obligar al bloqueo de determinados contenidos según su origen, declarar la posesión o uso de un modelo llm como ilegal y actuar en consecuencia.


Y dirás...pues VPN...y de ahí los debates sobre VPN en Europa.


Y aun así puedes decir bueno, pero aun así se podrán conseguir y ejecutar y si claro, al igual que puedes tener otros objetos que son ilegales.


Entiendo el tono de tu comentario y si crees que los debates y leyes en la UE no van en la dirección de controlar todo.


Pero se resumiría fácil si hay debate en, que es para ti el chat control, la verificación de edad y cual fue el origen de la creación de la DSA europea?


Un saludo
La noticia no tiene nada que ver con las peliculas que has montado. No hay mas limitaciones a la IA para usos comunes....por supuesto que la creacion multimedia está limitada por los derechos de imagen, autor e intimidad, que es lo que dice esa noticia. La UE no puede prohibir el uso de la IA, Europa no es China
← A Electrónica / Informática
Amazon
Nuevas ofertas cada día