Code and Cortex

Un peu d'intelligence artificielle… et de matière grise !

C

Derniers articles

Tour d’horizon du concept de liminalité

Je m’intéresse ici à la notion de liminalité parce qu’elle permet de penser, de manière transversale, ce qui se joue dans les « moments de transition », les « états instables », les « seuils de passage » au sein des systèmes humains, sociaux ou cognitifs. Qu’il s’agisse de rites de passage (Van Gennep), de paradoxes relationnels (Bateson), d’entropie (vs néguentropie)...

Extraction de commentaires YouTube via streamlit

X est devenu le repaire de la désinformation… Alors que Facebook ou Linkedin imposent une API payante pour récupérer leurs posts, il nous reste donc une source – certes également sujette à la désinformation, mais où l’expression demeure spontanée et authentique – celle des commentaires YouTube. Il faut bien l’avouer : certaines vidéos suscitent une avalanche de réactions ! Merci...

Comprendre la CHD et la méthode Reinert

Cet article vise à « reproduire » la démarche statistique (simplifiée) expliquée par Julien Barnier autour de la CHD. Je reprends donc l’exemple et la démarche lors de son excellente intervention sur l’excellente chaîne YouTube Tuto Mate-SHS. L’objectif est de (re)construire un script R (sans utiliser le package « rainette ») qui, à partir des 5 phrases de l’exemple de...

Speech-to-text avec whisper et streamlit cloud

J’ai adapté un script utilisant le modèle Whisper d’OpenAI en une solution « no code » déployée sur Streamlit Cloud. Il suffit de lancer l’URL de l’application et, après un délai de réponse assez long dû aux serveurs de Streamlit Cloud, vous aurez accès à un l’interface qui vous permet de retranscrire vos fichiers MP3 ou, directement, la voix en texte à partir...

Approche exploratoire des techniques d’embedding et de centralité

Toute bonne chose a une fin… Il était temps de mettre un point final à cet article. Il s’agit ici d’une démarche exploratoire visant à croiser, pour l’analyse textuelle, plusieurs méthodes d’embedding de BERT, une analyse de similarité cosinus et une analyse de centralité (théorie des graphes). Ça fait déjà beaucoup de choses ! Dans l’analyse textuelle, il est...

BERT – Attention et embeddings pour l’analyse textuelle

Lorsqu’on parle des LLM (Large Language Models) comme BERT, on pense souvent à leur utilisation dans des chatbots ou des systèmes d’IA conversationnelle. L’objectif classique est alors d’entraîner ces modèles à générer des réponses optimales en ajustant les probabilités de succession des mots pour maximiser la cohérence des phrases. Ici, nous exploitons un « Large Language Model (LLM) » non...

Analyse textuelle par similarité cosinus

Parmi les nombreuses approches utilisées dans le  traitement du langage naturel (NLP – Natural Language Processing), la mesure de la similarité cosinus permet de comparer des mots en fonction de leur proximité dans un espace vectoriel. Le script ci-dessous a été conçu avec un corpus test, issu d’articles récupérés via Europresse et formaté pour être compatible avec le logiciel...

Retranscription textuelle avec Whisper

YouTubeTranscript vs Whisper Lorsqu’il s’agit d’extraire la retranscription textuelle d’une vidéo YouTube, trois solutions principales se démarquent : YouTubeTranscript , Google speech to texte et Whisper. YouTubeTranscript ne fait que récupérer le texte généré par YouTube. Ce texte est souvent structuré comme des sous-titres, découpé en segments avec des horodatages, mais...

Extraire des images d’une vidéo YouTube

Rien de révolutionnaire dans ce script, mais il vous permettra d’extraire simplement les images d’une vidéo YouTube tournée à 25 images par seconde (standard Europe). Ces images pourront ensuite être utilisées par exemple pour des analyses comme la détection des émotions faciales, (cf. article 1 – article 2 – article 3). Bon, c’est un petit retour en arrière, mais...

CHD avec Rainette : de la classification à l’export des statistiques

Rainette est un paquet R développé par Julien Barnier pour effectuer des analyses textuelles, à l’aide d’une Classification Hiérarchique Descendante (CHD). Dans cet article, nous détaillons un script qui permet d’exporter en fichier texte, html, csv les résultats de la CHD. Voici les fonctionnalités principales du script : Réalisation de la CHD (cf. article) Extraction de...

Stephane Admin