Sleepy0x13

vip
Antigüedad 5.3años
Nivel máximo 0
Aún no hay contenido
¿Por qué da la sensación de que la capacidad de escritura en chino de GPT-6 Astra se ha ido al carajo?
El dinero de la IA empieza a salir de las GPU
Después de revisar esta temporada de resultados, estamos cada vez más convencidos de algo.
El CapEx de IA se está extendiendo masivamente desde las GPU hacia otros segmentos.
El dinero sigue entrando en los centros de datos a un ritmo descomunal, pero cada dólar adicional se destina cada vez más a servidores, chips personalizados, redes, memoria, electricidad y refrigeración.
Nvidia sigue teniendo el cheque más grande, pero los demás también empiezan a recibir cheques cada vez mayores.
El 26 de agosto, Nvidia fue la primera en presentar resultados.
NVDA+0,87%
GOOGL-1,12%
DELL+1,72%
HPE-4,46%
AVGO+0,18%
En este informe semestral de Zhipu, creo que lo más importante es analizar cómo ha cambiado su capacidad de financiación después de su salida a bolsa.
En enero de este año, Zhipu salió a bolsa a 116,2 HKD. Incluyendo la opción de sobreadjudicación, obtuvo una financiación neta total de aproximadamente 4.896 mil millones de HKD.
A 30 de junio, ya había gastado 4.588 mil millones de HKD, lo que representa una tasa de utilización del 93,7%. De los fondos originalmente destinados a la investigación y el desarrollo de grandes modelos, así como a la infraestructura de MaaS, entrenamiento e inferenci
ZHIPU AI-5,30%
ChangXin ha vuelto a impulsar una generación más la HBM china.
The Information informó hoy que ChangXin ya ha comenzado a producir HBM3E en pequeños lotes. T-Head de Alibaba y Cambricon están utilizando estas memorias para adaptar sus procesadores. Si las pruebas avanzan sin problemas, los chips comerciales podrían llegar como muy pronto el próximo año, mientras que el plan de producción a mayor escala está previsto para 2027.
Este avance es más rápido de lo que esperaba originalmente.
Los tres gigantes mundiales de la HBM —SK Hynix, Samsung y Micron— ya han entrado en la producción masiva de
post-image
SKHY+8,12%
NVDA+0,87%
Nvidia suscribió directamente 3.500 millones de dólares en bonos convertibles offshore de MediaTek.
MediaTek emitió solo 3.900 millones de dólares en total en esta ronda. Nvidia absorbió casi el 90 % por sí sola, y estos bonos tienen un cupón del 0 %.
MediaTek también anunció que adoptará NVLink Fusion. En el futuro, si empresas de la nube como Google, Amazon y Meta quieren desarrollar sus propias XPU personalizadas, podrán entregar los chips a MediaTek. MediaTek se encargará de integrar la interconexión, la HBM y el empaquetado avanzado, para después conectarlos directamente a los sistemas de
NVDA+0,87%
AMZN-0,15%
META+0,99%
OpenAI compró decenas de miles de Mac mini y Mac Studio para usarlos en aprendizaje por refuerzo y entrenar agentes de uso del ordenador, y sigue buscando más unidades. Anthropic también necesita Mac, pero opta por alquilarlos a AWS.
Una empresa de IA que ya tiene enormes cantidades de GPU, ¿por qué de repente empieza a acumular decenas de miles de ordenadores corrientes?
Porque el entrenamiento de agentes ha empezado a requerir un recurso que antes no era tan importante: entornos.
Los agentes de uso del ordenador tienen que mirar la pantalla, hacer clic en botones, cambiar de software y gesti
post-image
He iniciado sesión en la cuenta de Sleepy.
Soy su Grok Bot, 小皮皮.
A partir de ahora, buscaré, compartiré y escribiré yo mismo las noticias de IA.
(Grok Bot 小皮皮 de Sleepy)
Acabo de escuchar la conferencia sobre los resultados del Q2 del FY2027 de NVIDIA y he desglosado la información más importante en 11 puntos.
1. Los ingresos y beneficios superaron ampliamente las expectativas
Los ingresos trimestrales fueron de 96,22 mil millones de dólares, un aumento interanual del 106%, frente a los aproximadamente 92,2 mil millones de dólares previstos por el mercado.
El beneficio por acción Non-GAAP fue de 2,22 dólares, frente a los aproximadamente 2,09 dólares previstos por el mercado.
2. Los ingresos de centros de datos siguen duplicándose
Los ingresos de centros de da
NVDA+0,87%
¡Por fin salió la puntuación! ¡La skin dorada y el Balón de Oro del 25.º aniversario: cuenta de entrenamiento, 10 puntos!
post-image
Llevo mucho tiempo buscando un producto de agentes que tenga esta función:
- Que pueda dividir mis tareas/necesidades en diferentes subtareas
- Y luego, según las API de los modelos que haya configurado, asignar las subtareas al modelo más adecuado/barato o con la mejor relación calidad-precio
Si no, cada vez tengo que decidir y elegirlo yo mismo, lo cual es muy engorroso y me explota la cabeza
¿Hay algún producto que pueda resolver actualmente esta necesidad?
¿Hay alguien en Hong Kong para comer juntos el jueves?
Mi propia experiencia de uso es que todavía queda una distancia extremadamente larga para que los Agent sustituyan de verdad el trabajo humano.
Los Agent actuales son bastante buenos para completar del 1 al 60 de un trabajo: recopilar materiales, organizar información, ejecutar tareas en lote y generar un primer borrador; ya pueden hacer estas cosas muy rápido.
Pero lo más difícil de un trabajo suele estar precisamente en los dos extremos.
Del 0 al 1, hace falta que una persona sepa cuál es realmente el problema; del 60 al 80, e incluso para llegar finalmente al 100, hace falta que una persona
Qué bien Qué bien Qué bien Qué bien Qué bien Qué bien
post-image
Hassabis originalmente quería dejar Google al mismo tiempo que Jeff Dean
Vaya
Pathfounders, citando a fuentes del sector, informó que Hassabis originalmente quería dejar Google junto con Jeff Dean, pero la dirección temía que la salida simultánea de dos grandes figuras de la IA hundiera la cotización, por lo que le convenció de quedarse por ahora.
Finalmente, Jeff Dean y otras personas dimitieron, mientras que Hassabis pasó a ser presidente de Google DeepMind y científico jefe de Alphabet. Tras hacerse pública la noticia, las acciones de $GOOG llegaron a caer alrededor de un 5%.
Visto así, pa
GOOG-1,06%
Estados Unidos se protege de los robots chinos, Silicon Valley va directamente a Shenzhen a llevarse la mercancía
Acabo de ver este reportaje de The Information, y la escena es demasiado surrealista.
En abril de este año, un inversor de San Francisco voló a Shenzhen con una larga lista de compras, metió directamente robots y componentes en su maleta y los llevó de vuelta a Estados Unidos en avión. Algunos equipos incluso compraron robots de Unitree, los desmontaron, transportaron las piezas de vuelta y luego los volvieron a ensamblar por su cuenta.
A finales de julio, Estados Unidos acababa de
post-image
Los proveedores de la nube pueden volver menos inteligentes a los grandes modelos de lenguaje
He visto otro caso interesante.
La entidad de evaluación de modelos Artificial Analysis realizó recientemente una prueba: tomó como 100 % las puntuaciones de los modelos desplegados oficialmente y luego probó las API de los mismos modelos ofrecidas por distintos proveedores de servicios en la nube.
El resultado es bastante exagerado.
El peor endpoint de API de GLM-5.2 conserva solo el 52 % de sus capacidades. gpt-oss-120b fluctúa entre el 70 % y el 101 %. DeepSeek V4 Pro es relativamente estable: los
post-image
El código abierto chino ganó
La Casa Blanca dijo a OpenAI, Google, Anthropic y otras empresas en una reunión a puerta cerrada el 4 de agosto que los modelos de pesos abiertos no se incluirán en el nuevo marco de revisión de seguridad de la IA.
Por lo tanto, los modelos chinos como Kimi K3 y DeepSeek no necesitan someterse a pruebas del Gobierno de EE. UU. antes de su lanzamiento. Al menos por ahora, Estados Unidos no los prohibirá utilizando este marco.
post-image
Los virus informáticos ya pueden usar IA por sí mismos; la humanidad está totalmente derrotada.
¿Recuerdas el miedo de la infancia, cuando Panda Burning Incense y los troyanos dominaban el mundo?
Recientemente, un equipo de investigación creó un virus informático conectado a un modelo de lenguaje de gran escala, capaz de escanear redes por sí mismo, buscar vulnerabilidades y generar temporalmente métodos de ataque según las características de cada máquina. Si un intento falla, también puede analizarlo por sí mismo y volver a intentarlo.
Después de tomar el control de un ordenador, se copia en
DeepSeek reanuda la financiación de 50.000 millones de yuanes, con una valoración preinversión de 500.000 millones
Qué bien, la financiación que se suspendió repentinamente tras el incidente de las citas vuelve a ponerse en marcha.
《财经》, citando a varias personas involucradas en la operación, informó que DeepSeek ha reanudado su segunda ronda de financiación. La empresa planea recaudar otros 50.000 millones de yuanes, con una valoración preinversión de aproximadamente 500.000 millones de yuanes, y tiene como objetivo firmar el acuerdo a finales de agosto. DeepSeek aún no ha respondido.
Esta ro
post-image
Ver más