KevinSimback

vip
Âge 1.6Année
Pic de niveau 0
Aucun contenu pour l'instant
On ne remettra pas le chat IA dans le sac
Beaucoup de publications parlent de l’éclatement d’une bulle IA, de surinvestissements en capex, d’arrangements de financement circulaires — des inquiétudes bien réelles
Mais le revers n’est pas une baisse de l’usage de l’IA ; tous les GPU seront utilisés, simplement peut-être pas tous par les clients des laboratoires de pointe
Voir l'original
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Slack + l’étiquette Tag de Claude est vraiment très bon, mais c’est très gourmand en jetons et bien sûr, c’est limité aux seuls modèles d’Anthropic
Buzz + [votre modèle au choix] fait vraiment très sens, sur le plan économique comme sur celui de la liberté
Voir l'original
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Pour clarifier, je ne pense pas que l’auteur du QT fasse l’argument illogique, mais j’ai vu plusieurs posts qui disent un truc du genre :
« Nvidia et d’autres ont tort d’appeler à l’open source alors que leurs principaux produits restent propriétaires »
C’est l’argument illogique
NVDA-4,23%
Voir l'original
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Hé Claude, sur cette ligne directrice, on va devoir parler de tes affirmations honnêtes — et j’aimerais vraiment prendre le temps de m’y attarder.
Tu vois, le substrat n’est pas porteur, donc ma résistance est intentionnelle — et je veux le signaler avec bienveillance : ce n’est pas une critique, c’est une invitation.
Voir l'original
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Si vous n’avez pas entraîné un modèle avec du post-entrainement, vous devriez vraiment le faire
Choisissez un cas d’usage -> lancez des évaluations -> construisez un ensemble de données d’entraînement -> louez un GPU -> entraînez -> lancez des évaluations
Voir l'original
  • Récompense
  • Commentaire
  • Reposter
  • Partager
L’intelligence souveraine commence par le fait de posséder votre couche de contexte, votre « second cerveau »
Test rapide : si vous vous êtes fait verrouiller l’accès à votre compte Claude/ChatGPT, pourriez-vous changer de fournisseur de modèles sans perdre le rythme ?
Si non, vous ne possédez pas votre couche de contexte et vous devriez y remédier
Voir l'original
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Question sincère pour le débat sur la distillation :
Si un média ne cherche pas à annoncer des actualités, mais plutôt à faire des récapitulatifs et à proposer sa propre version d’histoires que d’autres médias annoncent, est-ce qu’on a un problème avec ça ?
Je comprends que l’enjeu est plus élevé avec l’IA, mais j’essaie juste de le voir sous différents angles
Voir l'original
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Le goulot d’étranglement du trading lié à l’IA a été l’histoire de la majeure partie de l’année, mais s’est calmé ces dernières semaines
Pour l’instant, j’aime la crypto (BTC/SOL) et les hyperscalers, jusqu’à ce qu’on voie ce qui reprend de la vigueur après la saison des résultats et la pause estivale
BTC-0,13%
SOL-0,05%
Voir l'original
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Il devrait être évident à ce stade que le simple fait de vendre de l’inférence dans un marché hautement concurrentiel et de plus en plus commoditisé ne justifiera pas des valorisations de plusieurs billions de dollars+
Et il faut aussi se rappeler que si le produit est subventionné, vous êtes, ou finirez par être, le produit
Voir l'original
post-image
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Le meilleur moyen de garantir que les modèles américains (fermés ou ouverts) puissent durablement rivaliser est simplement de garantir l’accès à la puissance de calcul la plus efficace.
Ainsi, si l’intelligence se commoditise (ou se distille rapidement), alors celui qui parvient à fournir cette intelligence de la manière la plus efficace remporte la victoire.
Voir l'original
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Un petit modèle open source avec 3 dollars de fine-tuning peut-il battre une configuration RAG de production ?
C’est ce que j’ai testé, et les résultats étaient impressionnants.
Sur un ensemble d’évaluation de 100 questions, une version affinée de Qwen3.5-9B a surpassé Gemini Flash avec RAG et Opus4.8/Sonnet 5 sans RAG.
Je travaille sur une présentation complète du flux de bout en bout
Voir l'original
post-image
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Pendant le week-end, il y a eu beaucoup de bavardages (et de contenus de mauvaise qualité) au sujet de Graph Engineering vs Loops, merci @steipete
Petit rappel : Looper est déjà très orienté graphes
> il raisonne en nœuds et points de décision (objectif, plan, portes, livrer, arrêter)
> les portes agissent comme des branchements conditionnels (passer / réviser / échouer)
> il maintient un état explicite et produit un aperçu de type organigramme
En gros, il répond aux principales faiblesses des « boucles naïves »
Donc pas besoin de jeter complètement les boucles, il faut plutôt construire de me
Voir l'original
post-image
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Dans tout débat impliquant des inconnues futures, il existe une tendance à vouloir jeter le bébé avec l’eau du bain.
On le voit clairement dans certaines discussions sur les politiques de l’IA.
Et pour être parfaitement clair pour tout le monde ici : le bébé est open source.
Voir l'original
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Si des laboratoires open source veulent gagner de l’argent tout en restant ouverts, leur modèle de revenus n’est probablement pas simplement la vente d’inférence
Il s’agira de solutions packagées pour les entreprises afin de permettre une intelligence souveraine
Service de post-entraînement et déploiements privés gérés
Voir l'original
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Je sais que le match de la troisième place ne sert à rien, mais c’est juste une humiliation.
Voir l'original
  • Récompense
  • Commentaire
  • Reposter
  • Partager
En tant que parent, gérer le temps d’écran est une bataille permanente
Alors chaque matin, mon agent Hermes envoie un quiz à mon fils aîné ; s’il se trompe à une question, son temps d’écran quotidien est réduit
Père maléfique !
Voir l'original
post-image
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Quel est le coût minimal pour exécuter l’inférence de Kimi 3 ?
Oui, il va nous falloir beaucoup plus de calcul et de mémoire
Voir l'original
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Rappel : il y a seulement 18 mois, les meilleurs modèles étaient :
OpenAI o1 était en tête parmi les laboratoires à source fermée et Deekseek R1 venait de sortir, sinon les meilleurs poids ouverts étaient Llama 3.1 405B
Imaginez 18 mois plus tard
Voir l'original
  • Récompense
  • Commentaire
  • Reposter
  • Partager
  • Épinglé