
Reconnaissance vidéo générale avec l’IA
Que comprend un tel modèle lorsqu’il voit une image comme celle-ci ou, encore plus complexe, une vidéo ?
BloguePage 8 sur 11
Mon blogue sur l'ingénierie IA pratique, les LLMs, les agents, la recherche et ce qui est réellement utile à construire.

Que comprend un tel modèle lorsqu’il voit une image comme celle-ci ou, encore plus complexe, une vidéo ?

Personnaliser la génération de texte en image avec l’inversion textuelle

Une nouvelle tâche difficile pour l’IA : la génération de graphes de scène panoptiques

Une architecture de synthèse d’images haute résolution : la diffusion latente

Créez des modèles 3D déformables à partir d’images avec BANMo !
« Make-A-Scene » : un fantastique mélange de génération d’images guidée par du texte et des croquis.

Mesures d’atténuation avant l’entraînement de DALL·E 2

Les chercheurs reconstruisent le son avec des caméras et un faisceau laser dirigé sur n’importe quelle surface vibrante, ce qui leur permet d’isoler des instruments de musique, de se concentrer sur une personne précise, d’éliminer les bruits ambiants et de réaliser de nombreuses autres applications incroyables.

Le début de l’IA centrée sur les données avec la programmation des données

Traduire 200 langues avec un seul modèle de Meta AI

DALL·E mini est une IA gratuite et open source qui produit des images extraordinaires à partir d’inputs textuels. Voici comment elle fonctionne.

Une IA qui crée à partir de texte des images photoréalistes meilleures que celles de DALL-E 2 !

Comment Uber peut-il livrer vos repas à l’heure, ou même quelques minutes d’avance ?

Gato : un seul Transformer pour les gouverner tous ! Le premier agent généraliste d’apprentissage par renforcement fondé sur les Transformers !

Un modèle GAN qui utilise de simples blobs pour manipuler les objets dans les images…

Un modèle à code source libre aussi puissant que GPT-3 !
Cette IA peut reconstruire, améliorer et retoucher vos images !

Un nouveau modèle qui génère automatiquement des résumés par apprentissage automatique, offert dans Google Docs et que vous pouvez déjà utiliser !

Un nouveau modèle impressionnant d’OpenAI capable de générer des images et d’en modifier certaines zones par inpainting à partir d’un texte, avec des résultats incroyables !

Instant NeRF de NVIDIA Research expliqué simplement

Combiner le LiDAR et des caméras classiques pour la détection d’objets 3D : Waymo et Google Research

Ce nouveau modèle d’IA entièrement gratuit peut réparer la plupart de vos vieilles photos en une fraction de seconde !

Les cinq meilleurs articles de février sur l’intelligence artificielle

Correction de la grammaire, de la prononciation et du bruit de fond avec l’IA !
Choisissez si Google Analytics peut utiliser des témoins. Le site conserve toujours des décomptes de pages anonymes, sans témoins. Détails sur la confidentialité