¿Habéis probado las IAs chinas recientes? GLM-5.2

guillefix
ForoCoches: Miembro
#1
Sin tener en cuenta los benchmarks, que a veces son puro marketing, son muchas las personas en internet que comparan este modelo GLM-5.2 lanzado esta misma semana, a algo parecido a un Claude Opus 4.6/4.7 o GPT-5.4-5.5 pero 4-5 veces más barato.

También ha salido Kimi K2.7-Code pero diría que ese se asemeja más a un Sonnet 4.6.


Los chinos se están poniendo las pilas...
siscu_vectra
ForoCoches: Miembro
#2
que los chinos nos comen !!! Pues uso una api de deepseek pero por la quema de token y funciona bien yo ya la gente tan purista yo ya me pierdo si no es para programar o crear imagénes las veo todas iguales
guillefix
ForoCoches: Miembro
#3
Cita de siscu_vectra
que los chinos nos comen !!! Pues uso una api de deepseek pero por la quema de token y funciona bien yo ya la gente tan purista yo ya me pierdo si no es para programar o crear imagénes las veo todas iguales
Deepseek tiende a alucinar mucho. Quizás lo mejoren en sus versiones 4.1, que creo que lanzarán en las próximas semanas.
Panicio
ForoCoches: Hola.
#4
tengo unas ganas de que glm supere de una vez al más puntero de anthropic que no lo sabe nadie, encima open-source y sin discriminar a nadie
Skalexs
ForoCoches: Miembro
#5
Uso Hermes agent con kimi 2.7 para programar web apps/ PWA para uso propio y deepseek V4 Flash para administrar el propio sistema operativo redes etc.
Prácticamente todo vía telegram
Van suficientemente bien para mí hobby, trabajar el soul, las skills y el contexto que les Metes influye mucho en como se comportan.
Para mí gusto mucho mejor que minimax2.7 que no era malo del todo pero si bastante malo en ciertas cosas
Yukyolol
Tha moafking bist
#6
Cita de Panicio
tengo unas ganas de que glm supere de una vez al más puntero de anthropic que no lo sabe nadie, encima open-source y sin discriminar a nadie
Pese a que los modelos chinos están dando resultados increíblemente buenos por una fracción del coste de entrenamiento comparados con los modelos americanos, la verdad es que cada vez va a ser más difícil usar estos modelos de forma local. Aunque son open source, cada vez pesan más, y a la velocidad a la que están mejorando, pronto no será tan fácil hostear uno de estos modelos y sí o sí tendrás que recurrir a un proveedor de inferencia que te alquile una GPU bajo demanda o utilizar un servicio serverless.


La única desventaja que tienen actualmente los modelos chinos es que no compiten en igualdad de condiciones. Tienen vetados muchos modelos de GPU y las que les venden están "nerfeadas" para IA. Aun así, son capaces de conseguir GPUs en el mercado negro y, con lo que tienen, la verdad es que el resultado es evidente: a nivel de coste operacional, los chinos se comen a los americanos.


Las pérdidas billonarias que tiene OpenAI anualmente son descomunales y todavía siguen sin ser rentables. Según los forecasts, no lo serán hasta 2030 (como mínimo). Leí hace poco que HSBC si no recuerdo mal, les había hecho un estudio y que tenían que ingresar 200B al año para aguantar el ritmo al que están quemando dinero para 2030 (actualmente ingresan 13B)


China también ha anunciado que va a empezar a inyectar cantidades ingentes de dinero en las empresas de IA (295B de dólares), así que habrá que ver cómo acaba todo esto...


También te digo que los modelos chinos son de código abierto porque no les queda otra. Teniendo en cuenta que el pastel se lo reparten principalmente OpenAI y, muy de cerca, Anthropic, ahora mismo no podrían competir a nivel económico con modelos cerrados y la "mala prensa" que siempre les acompaña por el tema del supuesto "secuestro de datos". Además el día que un modelo chino, se coma a un modelo americano, van a llover sanciones y amenazas a cualquier empresa de inferencia que se atreva a hostear los peligrosisimos modelos chinos.

Mientras tanto, OpenAI buenos modelos polivalentes, Anthropic buenos modelos para código, Gemini buenas tardes
Lord-Blade
ForoCoches: Miembro
#7
Cita de Panicio
tengo unas ganas de que glm supere de una vez al más puntero de anthropic que no lo sabe nadie, encima open-source y sin discriminar a nadie
El día que una IA open source supere a una americana en el punto en el que estamos te vas a enterar por su prohibición de uso y tenencia.


No tengo pruebas ni tampoco dudas.
Erclon Muska
Tecnonigromante
#8
Cita de Lord-Blade
El día que una IA open source supere a una americana en el punto en el que estamos te vas a enterar por su prohibición de uso y tenencia.


No tengo pruebas ni tampoco dudas.

¿Y como se prohibe eso?, ¿también prohibirán internet entero para no poder acceder al modelo, descargarlo y ejecutarlo en local o alguna de sus variantes cuantificadas?.


Cuentame más...
Lord-Blade
ForoCoches: Miembro
#9
Cita de Erclon Muska
¿Y como se prohibe eso?, ¿también prohibirán internet entero para no poder acceder al modelo, descargarlo y ejecutarlo en local o alguna de sus variantes cuantificadas?.


Cuentame más...
Entiendo que estas enterado de los últimos debates en el seno de la UE y lo que sucede en UK.


En UK van bastante avanzados...


https://lasillarota.com/mundo/2026/2...el-584501.html


Me entere en reddit y allí me pusieron el enlace a la ley o propuesta.


En resumen, se puede aplicar medidas como las que aplica la liga en España o reino unido con su internet.


Obligar al bloqueo de determinados contenidos según su origen, declarar la posesión o uso de un modelo llm como ilegal y actuar en consecuencia.


Y dirás...pues VPN...y de ahí los debates sobre VPN en Europa.


Y aun así puedes decir bueno, pero aun así se podrán conseguir y ejecutar y si claro, al igual que puedes tener otros objetos que son ilegales.


Entiendo el tono de tu comentario y si crees que los debates y leyes en la UE no van en la dirección de controlar todo.


Pero se resumiría fácil si hay debate en, que es para ti el chat control, la verificación de edad y cual fue el origen de la creación de la DSA europea?


Un saludo
siscu_vectra
ForoCoches: Miembro
#10
Cita de guillefix
Deepseek tiende a alucinar mucho. Quizás lo mejoren en sus versiones 4.1, que creo que lanzarán en las próximas semanas.
No lo sabía , sabes alguna que vaya mejor y salga por un precio similar de api ? DeepSeek creo que es 0,01 por 1M es para Open claw
joan16v
ForoCoches: Miembro
#11
yo uso Qwen en local y van genial
DrAlpha
ForoCoches: Usuario
#12
Tengo subscripción de Z.ai desde GLM 5. Uso claude code con Opus de director de orquesta con un ayudante GLM 5.2. El problema es que es muy lento y las subscripciones te meten un cuello de botella de lentitud.
iFuSiiOnzZ
Veritas Liberabit Vos!
#13
Cita de Yukyolol
Pese a que los modelos chinos están dando resultados increíblemente buenos por una fracción del coste de entrenamiento comparados con los modelos americanos, la verdad es que cada vez va a ser más difícil usar estos modelos de forma local. Aunque son open source, cada vez pesan más, y a la velocidad a la que están mejorando, pronto no será tan fácil hostear uno de estos modelos y sí o sí tendrás que recurrir a un proveedor de inferencia que te alquile una GPU bajo demanda o utilizar un servicio serverless.


La única desventaja que tienen actualmente los modelos chinos es que no compiten en igualdad de condiciones. Tienen vetados muchos modelos de GPU y las que les venden están "nerfeadas" para IA. Aun así, son capaces de conseguir GPUs en el mercado negro y, con lo que tienen, la verdad es que el resultado es evidente: a nivel de coste operacional, los chinos se comen a los americanos.


Las pérdidas billonarias que tiene OpenAI anualmente son descomunales y todavía siguen sin ser rentables. Según los forecasts, no lo serán hasta 2030 (como mínimo). Leí hace poco que HSBC si no recuerdo mal, les había hecho un estudio y que tenían que ingresar 200B al año para aguantar el ritmo al que están quemando dinero para 2030 (actualmente ingresan 13B)


China también ha anunciado que va a empezar a inyectar cantidades ingentes de dinero en las empresas de IA (295B de dólares), así que habrá que ver cómo acaba todo esto...


También te digo que los modelos chinos son de código abierto porque no les queda otra. Teniendo en cuenta que el pastel se lo reparten principalmente OpenAI y, muy de cerca, Anthropic, ahora mismo no podrían competir a nivel económico con modelos cerrados y la "mala prensa" que siempre les acompaña por el tema del supuesto "secuestro de datos". Además el día que un modelo chino, se coma a un modelo americano, van a llover sanciones y amenazas a cualquier empresa de inferencia que se atreva a hostear los peligrosisimos modelos chinos.

Mientras tanto, OpenAI buenos modelos polivalentes, Anthropic buenos modelos para código, Gemini buenas tardes
Hay una cosa que no acabo de comprender, aunque hablo desde la barra del bar ya que no tengo mucha idea de como estan estructuradas las redes neuronales. No paro de preguntarme porque no pueden hacer streaming, es decir, mover datos entre el disco y la VRAM, los juegos no lo hacen constantement y no pasa nada. Tener una parte pequeña subida en la VRAM para detectar lo que estas preguntando y lugo traese del disco poco a poco lo que le hace falta para genererar la respuesta, de igual forma a dia de hoy son MoE las LLM sino me equivoco, cuan lo cual me pregunto cual es la razon de no hacerlo? Algun experto por aqui que puede contestar??
guillefix
ForoCoches: Miembro
#14
Cita de siscu_vectra
No lo sabía , sabes alguna que vaya mejor y salga por un precio similar de api ? DeepSeek creo que es 0,01 por 1M es para Open claw
Me quiere sonar que MiniMax M3 y MiMo V2.5 Pro están bastante a la par y con precios similares.

Y en su versión flash, tienes también como competencia a MiMo V2.5.
EnxebreFC
ForoCoches: Usuario
#15
Qwen3.6 27B es lo que está de moda ahora en local, pero necesitas al menos 24GB de VRAM.

Si te apoyas en los modelos frontera para diseñar y en local para picar código, te ahorras un buen dinero.
beliceus
ForoCoches: Usuario
#16
Cita de Lord-Blade
El día que una IA open source supere a una americana en el punto en el que estamos te vas a enterar por su prohibición de uso y tenencia.


No tengo pruebas ni tampoco dudas.
Primero tendría que enterarse


Esta semana cambié Chatgpt 5.5 y Opus 4.8 por DeepSeek 4 Pro como modelo principal de thinking de programación. No sé qué narices hicieron para esta última versión pero me encanta como responde, no es que sean mejores respuestas que los otros, están al mismo nivel, pero es como te las presenta y como enfoca los problemas que le planteo sin apenas necesidad de dirigirlo, la sensación de que sabe hacia dónde quiero ir es infinitamente mayor a de los otros donde tengo que pelearme constantemente para que no se salgan del camino. Abora estoy "in love" pero entiendo que esto ya depende de los gustos de cada uno.




Lo mismo que con Gemini Pro, desde principios de semana es mi agente principal para Android Studio, y eso que lo había probado hace meses y era un desastre
(por cierto, si buscais teneis ofertas de licencias de 12 meses por 5€ o así en G2A o similar)




Los probé por casualidad esta semana, cada dos o tres meses doy un paseo por IAs que no uso, en dos meses seguramente cambiaré otra vez aunque con Opus y Chatgpt ya llevaba casi un año
guillefix
ForoCoches: Miembro
#17
Cita de beliceus
Primero tendría que enterarse


Esta semana cambié Chatgpt 5.5 y Opus 4.8 por DeepSeek 4 Pro como modelo principal de thinking de programación. No sé qué narices hicieron para esta última versión pero me encanta como responde, no es que sean mejores respuestas que los otros, están al mismo nivel, pero es como te las presenta y como enfoca los problemas que le planteo sin apenas necesidad de dirigirlo, la sensación de que sabe hacia dónde quiero ir es infinitamente mayor a de los otros donde tengo que pelearme constantemente para que no se salgan del camino. Abora estoy "in love" pero entiendo que esto ya depende de los gustos de cada uno.




Lo mismo que con Gemini Pro, desde principios de semana es mi agente principal para Android Studio, y eso que lo había probado hace meses y era un desastre
(por cierto, si buscais teneis ofertas de licencias de 12 meses por 5€ o así en G2A o similar)




Los probé por casualidad esta semana, cada dos o tres meses doy un paseo por IAs que no uso, en dos meses seguramente cambiaré otra vez aunque con Opus y Chatgpt ya llevaba casi un año
Ojo con esas licencias que igual te duran un suspiro. Suelen ser robadas o de orígenes turbios.
Cita de EnxebreFC
Qwen3.6 27B es lo que está de moda ahora en local, pero necesitas al menos 24GB de VRAM.

Si te apoyas en los modelos frontera para diseñar y en local para picar código, te ahorras un buen dinero.
¿A qué modelo lo compararias?
Sartana
El Winchester más rápido
#18
Cita de beliceus
(por cierto, si buscais teneis ofertas de licencias de 12 meses por 5€ o así en G2A o similar)
Pues ya me dirás dónde porque esto es lo que me sale en G2A. Por 5€ merece la pena el riesgo.

enoarro
ForoCoches: Miembro
#19
Llevo un tiempo probando, y desde entonces he cancelado ChatGPT y Claude, que los tokens del plan duran poco, y por API es caro.

GLM no me parece tan bueno, es más, en suscripción me parece cuantizado además de lento.

Lo que hago es usarlos a través de OpenRouter y voy eligiendo proveedores.

Hasta hace poco usaba DeepSeek para todo, Pro para planear y Flash para ejecutar, aunque últimamente se me ha vuelto algo torpe y me he pasado a Mimo.

Para agentes, en mi caso minimax es el rey.

Es una pasada hacer uso intensivo y apenas gastar $3 en una sesión, cuando con Claude Max agotaba el límite semanal en dos días, con sus respectivas esperas de 5 horas cada vez. Me tiraba para atrás el pago por uso, he sido más de suscripción y saber lo que voy a pagar, pero al final se tira mucho de caché y los inputs salen casi gratis.
EnxebreFC
ForoCoches: Usuario
#20
Cita de guillefix
Ojo con esas licencias que igual te duran un suspiro. Suelen ser robadas o de orígenes turbios.

¿A qué modelo lo compararias?
Lo comparo con Sonnet 4.6 o GPT 5.2, es mejor que otros modelos abiertos de 120B que se presentaron hace un año.


Incluso desplegado a Q4 o Q5 es válido para generar código, eso sí necesitas una GPU con buen ancho (600-700GB/s) sino va ir a pedales.
Statik
Staff
#21
Dola Seed 2.0
Lord-Blade
ForoCoches: Miembro
#22
Cita de beliceus
Primero tendría que enterarse


Esta semana cambié Chatgpt 5.5 y Opus 4.8 por DeepSeek 4 Pro como modelo principal de thinking de programación. No sé qué narices hicieron para esta última versión pero me encanta como responde, no es que sean mejores respuestas que los otros, están al mismo nivel, pero es como te las presenta y como enfoca los problemas que le planteo sin apenas necesidad de dirigirlo, la sensación de que sabe hacia dónde quiero ir es infinitamente mayor a de los otros donde tengo que pelearme constantemente para que no se salgan del camino. Abora estoy "in love" pero entiendo que esto ya depende de los gustos de cada uno.




Lo mismo que con Gemini Pro, desde principios de semana es mi agente principal para Android Studio, y eso que lo había probado hace meses y era un desastre
(por cierto, si buscais teneis ofertas de licencias de 12 meses por 5€ o así en G2A o similar)




Los probé por casualidad esta semana, cada dos o tres meses doy un paseo por IAs que no uso, en dos meses seguramente cambiaré otra vez aunque con Opus y Chatgpt ya llevaba casi un año


Pregunta sobre gemini, que hace un tiempo añadieron la opción de hacer documentos.


Lo has probado?


Tengo pendiente intentar que me transforme un PDF a doc y ver si mantiene texto e imágenes pero editable.
carlupiter
Emprendedor Ingeniero
#23
Yo solo he probado Qwen 3.6 27B que ahora mismo es la mejor IA local que se puede correr en un PC doméstico.

Bastante bien, aunque sigo prefiriendo pagar por Claude Code.

Tened en cuenta que estás IAs baratas son una especie de clones de Opus. Puede que los benchmarks sean impresionantes, pero por ejemplo para vibe coding hay muchas más cosas detrás de un LLM, como los loops internos o el post procesamiento.

Para vibe coding, Claude sigue siendo la mejor.
pepistos
ForoCoches: Miembro
#24
Yo la verdad que bastante sorprendido con lo que leo y las posibilidades de la IA pero a mí es que no me sirve ni para hacer sumas en Excel, Me he descargado del banco los movimientos de mi cuenta durante los últimos 10 años y la cosa es fácil, ingresos, gastos y sumatorios.
Yo lo he sumado en el Excel -bastante fácil como sabéis-, son 6400 filas, con lo que entiendo que no es un fichero muy grande (o si).
El caso es que como el Excel venía un poco raro, ya que una mitad iba en ascendente y otra en descendente y había un montón de fechas le he dicho a la IA que me lo agrupe por años y me haga gráficos, esquemas y toda la parafernalia. He subido el Excel con el sumatorio ya hecho.


Resultados (todas las IA de pago)


1) Gemini Pro, que me dice que son muchos datos y que el sumatorio lo haga yo.




2) Perplexity, con los modelos de Claude, Kimi y Nemotron, me saca las gráficas y los datos pero lo hace MAL en los tres modelos porque me duplica los gastos y los ingresos y no han sido capaces de detectar que la última fila era un sumatorio.




3) ChatGPT, de las que he usado ha sido la única que ha "detectado" el sumatorio y ha sacado los datos bien.


Y yo os leo aquí diciendo que programáis, que os viene bien, que si es el futuro, que si nos vamos a quedar sin trabajo todos y a mí no es capaz de detectarme una duplicidad en un simple Excel
guillefix
ForoCoches: Miembro
#25
Cita de pepistos
Yo la verdad que bastante sorprendido con lo que leo y las posibilidades de la IA pero a mí es que no me sirve ni para hacer sumas en Excel, Me he descargado del banco los movimientos de mi cuenta durante los últimos 10 años y la cosa es fácil, ingresos, gastos y sumatorios.
Yo lo he sumado en el Excel -bastante fácil como sabéis-, son 6400 filas, con lo que entiendo que no es un fichero muy grande (o si).
El caso es que como el Excel venía un poco raro, ya que una mitad iba en ascendente y otra en descendente y había un montón de fechas le he dicho a la IA que me lo agrupe por años y me haga gráficos, esquemas y toda la parafernalia. He subido el Excel con el sumatorio ya hecho.


Resultados (todas las IA de pago)


1) Gemini Pro, que me dice que son muchos datos y que el sumatorio lo haga yo.




2) Perplexity, con los modelos de Claude, Kimi y Nemotron, me saca las gráficas y los datos pero lo hace MAL en los tres modelos porque me duplica los gastos y los ingresos y no han sido capaces de detectar que la última fila era un sumatorio.




3) ChatGPT, de las que he usado ha sido la única que ha "detectado" el sumatorio y ha sacado los datos bien.


Y yo os leo aquí diciendo que programáis, que os viene bien, que si es el futuro, que si nos vamos a quedar sin trabajo todos y a mí no es capaz de detectarme una duplicidad en un simple Excel
Has descubierto las limitaciones del contexto de un LLM. El principal talón de Aquiles y lo que las hace inventarse cosas en muchas ocasiones.
Dastan
In vino veritas
#26
Para programación (y mira que no lo soy) la única que no me borra códigos , aporta ideas , sabe exactamente lo que quiero y no me falla nunca es Claude y la versión free no me quiero imaginar si pago.

Las demás como Gemini Pro te borra cosas y te pide siempre perdón. Deepseek le hablas y te manda 200 líneas sin venir a cuento y así con todas.
enoarro
ForoCoches: Miembro
#27
Cita de pepistos
Yo la verdad que bastante sorprendido con lo que leo y las posibilidades de la IA pero a mí es que no me sirve ni para hacer sumas en Excel, Me he descargado del banco los movimientos de mi cuenta durante los últimos 10 años y la cosa es fácil, ingresos, gastos y sumatorios.
Yo lo he sumado en el Excel -bastante fácil como sabéis-, son 6400 filas, con lo que entiendo que no es un fichero muy grande (o si).
El caso es que como el Excel venía un poco raro, ya que una mitad iba en ascendente y otra en descendente y había un montón de fechas le he dicho a la IA que me lo agrupe por años y me haga gráficos, esquemas y toda la parafernalia. He subido el Excel con el sumatorio ya hecho.


Resultados (todas las IA de pago)


1) Gemini Pro, que me dice que son muchos datos y que el sumatorio lo haga yo.




2) Perplexity, con los modelos de Claude, Kimi y Nemotron, me saca las gráficas y los datos pero lo hace MAL en los tres modelos porque me duplica los gastos y los ingresos y no han sido capaces de detectar que la última fila era un sumatorio.




3) ChatGPT, de las que he usado ha sido la única que ha "detectado" el sumatorio y ha sacado los datos bien.


Y yo os leo aquí diciendo que programáis, que os viene bien, que si es el futuro, que si nos vamos a quedar sin trabajo todos y a mí no es capaz de detectarme una duplicidad en un simple Excel

Las ventanas de contexto son limitadas, además de que son modelos de lenguaje, no están diseñados para eso. ¿No es mejor utilizar excel directamente que es una herramienta diseñada para ello?


Puedes utilizar la IA para darle formato, crear fórmulas que te den lo que deseas, incluso con la IA integrada en el propio excel o con herramientas tipo Cowork.
Muffins
ForoCoches: Usuario
#28
Cita de pepistos
Yo la verdad que bastante sorprendido con lo que leo y las posibilidades de la IA pero a mí es que no me sirve ni para hacer sumas en Excel, Me he descargado del banco los movimientos de mi cuenta durante los últimos 10 años y la cosa es fácil, ingresos, gastos y sumatorios.
Yo lo he sumado en el Excel -bastante fácil como sabéis-, son 6400 filas, con lo que entiendo que no es un fichero muy grande (o si).
El caso es que como el Excel venía un poco raro, ya que una mitad iba en ascendente y otra en descendente y había un montón de fechas le he dicho a la IA que me lo agrupe por años y me haga gráficos, esquemas y toda la parafernalia. He subido el Excel con el sumatorio ya hecho.


Resultados (todas las IA de pago)


1) Gemini Pro, que me dice que son muchos datos y que el sumatorio lo haga yo.




2) Perplexity, con los modelos de Claude, Kimi y Nemotron, me saca las gráficas y los datos pero lo hace MAL en los tres modelos porque me duplica los gastos y los ingresos y no han sido capaces de detectar que la última fila era un sumatorio.




3) ChatGPT, de las que he usado ha sido la única que ha "detectado" el sumatorio y ha sacado los datos bien.


Y yo os leo aquí diciendo que programáis, que os viene bien, que si es el futuro, que si nos vamos a quedar sin trabajo todos y a mí no es capaz de detectarme una duplicidad en un simple Excel

Por curiosidad, ¿Qué banco? Porque algo tan simple y normal como esto, BBVA no me deja hacerlo.
pepistos
ForoCoches: Miembro
#29
Cita de Muffins
Por curiosidad, ¿Qué banco? Porque algo tan simple y normal como esto, BBVA no me deja hacerlo.

CaixaBank shur. Lo tienes de un día para otro.

Cita de enoarro
Las ventanas de contexto son limitadas, además de que son modelos de lenguaje, no están diseñados para eso. ¿No es mejor utilizar excel directamente que es una herramienta diseñada para ello?


Puedes utilizar la IA para darle formato, crear fórmulas que te den lo que deseas, incluso con la IA integrada en el propio excel o con herramientas tipo Cowork.
Ya dije que use el Excel para sumar.
No se da cuenta la IA en 10 años de ingresos y gastos que me da cifras que son el doble? Eso cualquier humano lo detecta al momento.
Solo ChatGPT salvo los muebles.
Casa Paco
ForoCoches: Usuario
#30
Qué equipo te hace falta para correr las chinas en local?
← A Electrónica / Informática
Amazon
Nuevas ofertas cada día