KevinSimback

vip
Âge 1.6Année
Pic de niveau 0
Aucun contenu pour l'instant
Hé Claude, sur cette ligne directrice, on va devoir parler de tes affirmations honnêtes — et j’aimerais vraiment prendre le temps de m’y attarder.
Tu vois, le substrat n’est pas porteur, donc ma résistance est intentionnelle — et je veux le signaler avec bienveillance : ce n’est pas une critique, c’est une invitation.
Voir l'original
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Si vous n’avez pas entraîné un modèle avec du post-entrainement, vous devriez vraiment le faire
Choisissez un cas d’usage -> lancez des évaluations -> construisez un ensemble de données d’entraînement -> louez un GPU -> entraînez -> lancez des évaluations
Voir l'original
  • Récompense
  • Commentaire
  • Reposter
  • Partager
L’intelligence souveraine commence par le fait de posséder votre couche de contexte, votre « second cerveau »
Test rapide : si vous vous êtes fait verrouiller l’accès à votre compte Claude/ChatGPT, pourriez-vous changer de fournisseur de modèles sans perdre le rythme ?
Si non, vous ne possédez pas votre couche de contexte et vous devriez y remédier
Voir l'original
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Question sincère pour le débat sur la distillation :
Si un média ne cherche pas à annoncer des actualités, mais plutôt à faire des récapitulatifs et à proposer sa propre version d’histoires que d’autres médias annoncent, est-ce qu’on a un problème avec ça ?
Je comprends que l’enjeu est plus élevé avec l’IA, mais j’essaie juste de le voir sous différents angles
Voir l'original
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Le goulot d’étranglement du trading lié à l’IA a été l’histoire de la majeure partie de l’année, mais s’est calmé ces dernières semaines
Pour l’instant, j’aime la crypto (BTC/SOL) et les hyperscalers, jusqu’à ce qu’on voie ce qui reprend de la vigueur après la saison des résultats et la pause estivale
BTC-1,02%
SOL-2,32%
Voir l'original
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Il devrait être évident à ce stade que le simple fait de vendre de l’inférence dans un marché hautement concurrentiel et de plus en plus commoditisé ne justifiera pas des valorisations de plusieurs billions de dollars+
Et il faut aussi se rappeler que si le produit est subventionné, vous êtes, ou finirez par être, le produit
Voir l'original
post-image
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Le meilleur moyen de garantir que les modèles américains (fermés ou ouverts) puissent durablement rivaliser est simplement de garantir l’accès à la puissance de calcul la plus efficace.
Ainsi, si l’intelligence se commoditise (ou se distille rapidement), alors celui qui parvient à fournir cette intelligence de la manière la plus efficace remporte la victoire.
Voir l'original
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Un petit modèle open source avec 3 dollars de fine-tuning peut-il battre une configuration RAG de production ?
C’est ce que j’ai testé, et les résultats étaient impressionnants.
Sur un ensemble d’évaluation de 100 questions, une version affinée de Qwen3.5-9B a surpassé Gemini Flash avec RAG et Opus4.8/Sonnet 5 sans RAG.
Je travaille sur une présentation complète du flux de bout en bout
Voir l'original
post-image
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Pendant le week-end, il y a eu beaucoup de bavardages (et de contenus de mauvaise qualité) au sujet de Graph Engineering vs Loops, merci @steipete
Petit rappel : Looper est déjà très orienté graphes
> il raisonne en nœuds et points de décision (objectif, plan, portes, livrer, arrêter)
> les portes agissent comme des branchements conditionnels (passer / réviser / échouer)
> il maintient un état explicite et produit un aperçu de type organigramme
En gros, il répond aux principales faiblesses des « boucles naïves »
Donc pas besoin de jeter complètement les boucles, il faut plutôt construire de me
Voir l'original
post-image
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Dans tout débat impliquant des inconnues futures, il existe une tendance à vouloir jeter le bébé avec l’eau du bain.
On le voit clairement dans certaines discussions sur les politiques de l’IA.
Et pour être parfaitement clair pour tout le monde ici : le bébé est open source.
Voir l'original
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Si des laboratoires open source veulent gagner de l’argent tout en restant ouverts, leur modèle de revenus n’est probablement pas simplement la vente d’inférence
Il s’agira de solutions packagées pour les entreprises afin de permettre une intelligence souveraine
Service de post-entraînement et déploiements privés gérés
Voir l'original
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Je sais que le match de la troisième place ne sert à rien, mais c’est juste une humiliation.
Voir l'original
  • Récompense
  • Commentaire
  • Reposter
  • Partager
En tant que parent, gérer le temps d’écran est une bataille permanente
Alors chaque matin, mon agent Hermes envoie un quiz à mon fils aîné ; s’il se trompe à une question, son temps d’écran quotidien est réduit
Père maléfique !
Voir l'original
post-image
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Quel est le coût minimal pour exécuter l’inférence de Kimi 3 ?
Oui, il va nous falloir beaucoup plus de calcul et de mémoire
Voir l'original
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Rappel : il y a seulement 18 mois, les meilleurs modèles étaient :
OpenAI o1 était en tête parmi les laboratoires à source fermée et Deekseek R1 venait de sortir, sinon les meilleurs poids ouverts étaient Llama 3.1 405B
Imaginez 18 mois plus tard
Voir l'original
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Prédiction : Anthropic devra céder sur tous ces points
> Anthropic limite l’utilisation du plan sub via des agents externes exploitant des harness comme Hermes
> Fable est affaibli sur de nombreux sujets
> Fable est limité dans le plan sub à 50% de l’usage + ne passe à l’API qu’à 50 $/m d’output en 3 jours si ce n’est pas prolongé
Mais on a maintenant GPT 5.6 Sol et Kimi 3, ainsi que d’autres, qui arrivent juste derrière
La concurrence est un mécanisme de pression particulièrement violent
Voir l'original
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Chronologie cette semaine :
Lundi - Sol 5,6 ftw
Mardi - retour vers Fable
Mercredi - retour vers Sol 5,6
Jeudi - omg Kimi 3
Hâte de voir ce que demain nous réserve
SOL-2,32%
Voir l'original
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Parlons des couches de contexte partagées, souvent appelées des « cerveaux d’entreprise »
Pour répondre à des questions difficiles sur votre entreprise, comme :
« qu’est-ce qui est vrai au sujet de X, depuis quand, d’après qui, et où les comptes divergent ? »
Vous avez besoin d’un contexte qui soit une couche de faits dérivés et citables, par-dessus l’ensemble de vos communications et documents
C’est le système de référence de ce que l’entreprise ou l’organisation « sait », ce qui diffère des systèmes de référence qui contiennent les sorties du travail effectué
Jack en comptabilité sait pourqu
Voir l'original
  • Récompense
  • Commentaire
  • Reposter
  • Partager
J’ai eu un patron qui donnait souvent la même mission à 2-3 personnes différentes.
Cela a créé du ressentiment au sein de l’équipe et c’était terriblement inefficace.
Les agents n’ont pas ce problème, et cela ne coûte quasiment rien.
Voir l'original
post-image
  • Récompense
  • Commentaire
  • Reposter
  • Partager
  • Épinglé