fermer

Intelligence Artificielle

L’intelligence artificielle (IA) transforme de nombreux secteurs, de la santé à la finance, en passant par l’éducation et la sécurité. Explorez comment l’IA est utilisée pour automatiser des tâches, augmenter l’efficacité et créer de nouvelles opportunités de marché.

Nos discussions incluent également les défis éthiques et les implications sociétales de l’adoption de l’IA, fournissant une perspective équilibrée sur ce développement technologique clé.

Intelligence Artificielle

OpenAI et Financial Times : Un partenariat stratégique pour enrichir ChatGPT

OpenAI et Financial Times : Un partenariat stratégique pour enrichir ChatGPT

Le Financial Times a annoncé aujourd’hui un « partenariat stratégique » et un accord de licence avec OpenAI, dans le but d’améliorer ChatGPT avec du contenu attribué et d’incorporer leurs travaux journalistiques. Grâce à ce partenariat, les utilisateurs du chatbot pourront consulter des résumés, des citations et des liens vers des travaux journalistiques du Financial Times en réponse à leurs questions.

En retour, OpenAI impliquera l’entreprise de presse dans le développement de nouveaux produits d’IA. Le mois dernier, l’éditeur a introduit une fonction de recherche générative en bêta alimentée par le Large Language Model Claude d’Anthropic.

Cette annonce marque le premier grand éditeur de presse à annoncer un accord avec la société d’IA, après Politico, Business Insider et Axel Springer. L’Associated Press, Le Monde et El País ont également signé des accords avec OpenAI jusqu’à présent.

Dans un communiqué de presse, l’équipe de journalistes a été décrite comme étant « bien familiarisée avec la technologie », avec des « gains de créativité et de productivité » rendus possibles par la création d’OpenAI.

Brad Lightcap, directeur de l’exploitation d’OpenAI, a donné plus d’explications dans un communiqué de presse : « Notre partenariat et notre dialogue continu avec le FT visent à trouver des moyens créatifs et productifs pour que l’IA renforce les organismes de presse et les journalistes, et enrichisse l’expérience ChatGPT avec un journalisme de classe mondiale en temps réel pour des millions de personnes à travers le monde ».

L’engagement en faveur du journalisme humain est exprimé avec ChatGPT

À l’annonce de la nouvelle, le PDG du groupe Financial Times, John Ridding, a souligné que le journalisme humain restait au centre des préoccupations, tout en précisant que l’entreprise était depuis longtemps un chef de file en matière d’innovation dans les médias d’information.

« Le FT est attaché au journalisme humain, tel qu’il est produit par notre salle de rédaction inégalée, et cet accord élargira la portée de ce travail, tout en approfondissant notre compréhension des demandes et des intérêts des lecteurs ». « Outre les avantages pour le FT, il y a des implications plus larges pour l’industrie. Bien sûr, il est juste que les plateformes d’IA paient les éditeurs pour l’utilisation de leur matériel. OpenAI comprend l’importance de la transparence, de l’attribution et de la rémunération — autant d’éléments essentiels pour nous. Dans le même temps, il est clairement dans l’intérêt des utilisateurs que ces produits contiennent des sources fiables ».

OpenAI s’est félicité de l’élargissement de ses relations avec FT.

Lire plus
Intelligence Artificielle

La mémoire de ChatGPT: Nouvelle fonctionnalité améliorée pour les utilisateurs payants

La mémoire de ChatGPT: Nouvelle fonctionnalité améliorée pour les utilisateurs payants

Une nouvelle mise à jour de la mémoire de ChatGPT, alias Memory, a été publiée par OpenAI, permettant à l’IA de se souvenir d’informations spécifiques à l’utilisateur au cours de différentes conversations. À l’époque, elle n’était accessible qu’à une « petite partie » des utilisateurs, mais elle est désormais disponible pour les abonnés payants de ChatGPT Plus en dehors de l’Europe et de la Corée.

Néanmoins, OpenAI n’a pas expliqué pourquoi Memory ne sera pas disponible en Europe ou en Corée. La société indique que Memory sera disponible pour les abonnés à ChatGPT Enterprise et Teams, ainsi que pour les GPT personnalisés sur le GPT Store, mais n’a pas précisé quand.

Une fois cette fonction activée, ChatGPT peut stocker des détails sur les préférences et les interactions des utilisateurs, ce qui permet d’obtenir des réponses plus personnalisées et plus pertinentes sur le plan contextuel au fil du temps.

La mise à jour de la mémoire introduit plusieurs fonctionnalités clés qui fonctionnent ensemble pour créer une expérience utilisateur plus personnalisée et plus efficace :

  • Suivi automatique de la mémoire : ChatGPT a désormais la capacité d’enregistrer et de stocker automatiquement les détails pertinents des interactions de l’utilisateur, tels que les préférences, les intérêts et les projets. Cela permet à l’IA d’affiner en permanence ses réponses et ses interactions en fonction de l’historique et des préférences de l’utilisateur, garantissant ainsi une personnalisation accrue de chaque conversation au fil du temps.
  • Personnalisation accrue : Au fur et à mesure que les utilisateurs s’engagent avec ChatGPT, le système apprend et s’adapte à leurs besoins et préférences spécifiques. Ce processus d’ajustement dynamique améliore non seulement la précision et la pertinence des réponses de l’IA, mais rend également les interactions plus pertinentes par rapport aux demandes de l’utilisateur, créant ainsi une expérience plus engageante et plus efficace.
  • Options de gestion de la mémoire : Les utilisateurs conservent un contrôle total sur la fonction de mémoire, avec la possibilité d’inspecter les informations stockées, d’activer ou de désactiver la fonction de mémoire et d’effacer des entrées de données spécifiques. Les utilisateurs peuvent ainsi décider dans quelle mesure l’IA conserve les informations relatives à leurs interactions, ce qui garantit un niveau de confidentialité et de personnalisation adapté à leurs besoins individuels.

Memory Render V4 4262024

Lorsque vous engagez une conversation avec ChatGPT, vous avez la possibilité de lui demander de se souvenir de détails spécifiques ou de l’autoriser à collecter des informations de manière autonome au cours de la conversation. Plus vous vous engagez avec ChatGPT, plus sa mémoire s’affine, améliorant ainsi la personnalisation de ses réponses au fil du temps.

Voici quelques exemples :

  • Si vous précisez que vous préférez que les notes de réunion soient organisées avec des titres, des puces et un résumé des mesures à prendre à la fin, ChatGPT s’adaptera et fournira des comptes rendus de réunion dans ce format.
  • Si vous mentionnez que vous êtes propriétaire d’un café local, ChatGPT utilisera ce contexte pour vous aider à concevoir du contenu pour les réseaux sociaux afin de promouvoir un nouveau point de vente.
  • Si vous indiquez que votre enfant aime les méduses, ChatGPT peut suggérer de manière créative une carte d’anniversaire représentant une méduse ornée d’un chapeau de fête.
  • En tant qu’enseignante de maternelle gérant 25 élèves avec une préférence pour les leçons de 50 minutes et les activités qui en découlent, ChatGPT s’en souviendra et l’intégrera dans l’élaboration de vos plans de cours.

Contrôle de la mémoire et confidentialité de ChatGPT

  • Vous pouvez désactiver la mémoire à tout moment en allant dans : Settings > Personalization > Memory
  • Vous pouvez également consulter et supprimer des mémoires spécifiques ou effacer toutes les mémoires en allant sur : Settings > Personalization > Manage Memory

En plus des fonctionnalités de base de la mémoire, la mise à jour de ChatGPT introduit également un mode de chat temporaire pour les discussions qui requièrent de la confidentialité ou pour les utilisateurs qui préfèrent que certaines conversations ne soient pas sauvegardées. Dans ce mode, l’IA ne conserve aucune information de l’interaction, ce qui garantit la protection de la vie privée de l’utilisateur.

La fonction de mémoire est également très adaptable, capable de s’adapter à différents contextes, que l’utilisateur interagisse avec ChatGPT pour un usage personnel, des tâches professionnelles ou des projets spécifiques. Cette adaptabilité minimise le besoin d’informations répétées et favorise des conversations plus fluides et mieux adaptées au contexte, ce qui permet à l’utilisateur d’économiser du temps et des efforts.

Les nouvelles fonctions de mémoire de ChatGPT sont particulièrement bénéfiques pour les utilisateurs en entreprise et en équipe qui intègrent l’outil dans leurs processus de travail. Il s’adapte à votre style de communication et à vos préférences, apprenant de chaque interaction pour améliorer l’efficacité et fournir des réponses plus personnalisées. Voici quelques exemples :

  • ChatGPT peut capturer vos préférences en matière de ton, de voix et de formatage, et les appliquer automatiquement aux futurs projets d’articles de blog, éliminant ainsi le besoin d’instructions répétitives.
  • Pour les tâches de développement, une fois que vous avez spécifié à ChatGPT votre langage de programmation et vos frameworks préférés, il conserve cette information, ce qui aide à rationaliser votre workflow dans les futures tâches de codage.
  • Pour les analyses mensuelles, vous pouvez fournir vos données en toute sécurité à ChatGPT, et il générera les graphiques que vous préférez, chacun accompagné de trois informations clés, alignées sur vos préférences établies.

En tirant parti de la capacité de l’IA à mémoriser les préférences des utilisateurs et à s’y adapter, les entreprises peuvent fournir une meilleure assistance à la clientèle, rationaliser les flux de travail et créer des interactions plus attrayantes avec leurs clients et leurs employés.

La confidentialité et le contrôle des utilisateurs sont au cœur de cette mise à jour. Les utilisateurs ont la possibilité de désactiver complètement la fonction de mémorisation, de gérer les informations conservées ou d’utiliser ChatGPT de manière à ne pas créer ou accéder à des mémoires. Cette flexibilité permet aux utilisateurs de personnaliser leurs paramètres de confidentialité en fonction de leurs préférences, garantissant ainsi une expérience sûre et confortable.

Mémoire des GPT personnalisée

Les GPT personnalisés seront également bientôt disponibles pour bénéficier de la mémoire unique de ChatGPT. Les créateurs de GPT peuvent choisir d’activer ou non cette fonction pour leurs GPT. Il est important de noter que vos conversations et les mémoires générées sont privées et ne sont pas accessibles aux constructeurs. Pour utiliser un GPT avec mémoire, vous devez également activer la fonction de mémoire.

Alors que ChatGPT continue d’évoluer et d’affiner ses capacités, il est clair que l’avenir de l’interaction avec l’IA réside dans l’intégration transparente de la personnalisation, de l’adaptabilité et du contrôle de l’utilisateur. Avec cette dernière mise à jour de la mémoire, ChatGPT est prêt à transformer la façon dont nous interagissons avec l’IA, en rendant les conversations plus pertinentes, plus engageantes et plus bénéfiques que jamais.

Lire plus
Intelligence Artificielle

Pourquoi ChatGPT peut être lent ? Solutions pratiques pour une réponse rapide

Pourquoi ChatGPT peut être lent ? Solutions pratiques pour une réponse rapide

ChatGPT est devenu un outil créatif incontournable pour de nombreux utilisateurs. Néanmoins, il est parfois sujet à des ralentissements qui peuvent allonger les temps de réponse de plusieurs secondes, voire quelques minutes.

Passer au modèle payant ChatGPT-4 ne garantit pas nécessairement une accélération des performances. Cela soulève deux questions importantes : pourquoi ChatGPT peut-il être lent et comment améliorer sa vitesse de réponse ?

ChatGPT est un exemple d’IA générative, capable de créer du contenu nouveau. Ce processus nécessite une puissance de calcul significative. À chaque message envoyé, le chatbot doit le décoder et générer une réponse. Le modèle linguistique sous-jacent de ChatGPT traite le texte par « tokens », les unités fondamentales de son message. Ces modèles ont été entraînés sur des centaines de gigaoctets de texte, leur permettant d’apprendre les schémas du langage humain. À partir de là, le modèle peut générer du texte totalement nouveau.

Chaque prédiction de token requiert une certaine puissance de calcul, un peu comme notre cerveau qui parfois doit marquer une pause pour prendre une décision. La différence est que les modèles IA, fonctionnant sur de puissants serveurs, peuvent prédire des centaines de tokens par seconde.

La lenteur de ChatGPT est souvent due à une demande excessive par rapport à la puissance de calcul disponible. Le modèle linguistique choisi a également un impact : les modèles plus avancés sont généralement plus lents.

Comment améliorer la vitesse de réponse de ChatGPT ?

Plusieurs astuces peuvent être envisagées pour accélérer les réponses de ChatGPT :

  1. Essayer un autre navigateur, connexion et appareil : Avant de blâmer ChatGPT, il convient de vérifier si le problème ne vient pas de notre propre configuration. Un navigateur mal configuré ou une connexion internet déficiente peut être en cause.
  2. Vérifier la page de statut d’OpenAI : OpenAI maintient une page de statut officielle qui indique si ChatGPT rencontre des problèmes. C’est le moyen le plus rapide de savoir si le service subit une panne majeure ou peine à répondre à la demande accrue.
  3. Vérifier la connexion VPN active : Un VPN peut influencer la vitesse de réponse de ChatGPT de manière subtile, surtout les VPN d’entreprise. Il pourrait être bénéfique d’essayer le chatbot sans VPN si possible.
  4. Passer à ChatGPT Plus : Si les autres solutions n’ont pas fonctionné, envisager l’abonnement à ChatGPT Plus pourrait être une solution. Pour 20 dollars par mois, cela offre des réponses plus rapides et un accès prioritaire lors des périodes de forte demande.
  5. Utiliser un autre chatbot avec des temps de réponse plus rapides : D’autres outils d’IA générative comme Microsoft Copilot ou Google Gemini peuvent offrir des réponses plus rapides selon la charge des serveurs de ChatGPT. Des modèles linguistiques plus petits pourraient aussi répondre plus vite, mais au détriment de la qualité des réponses.

En résumé, bien que ChatGPT puisse parfois être lent, il existe plusieurs stratégies pour améliorer votre expérience utilisateur. L’évaluation de votre propre configuration et l’exploration d’autres options peuvent contribuer à optimiser les temps de réponse.

Lire plus
Intelligence Artificielle

Au-delà de GPT-5 : Les spéculations surprenantes sur GPT-6

Au-delà de GPT-5 : Les spéculations surprenantes sur GPT-6

Alors que les rumeurs sur la sortie du GPT-5 s’amplifient, avec un début prévu pour l’été 2024, un curieux développement a fait surface et a fait des vagues dans la communauté de l’IA.

Des spéculations sur une potentielle fuite de GPT-6 ont émergé, suscitant des débats animés sur son intégrité et ses implications. La rumeur a été lancée par les YouTubers de « Dylan Curious—AI », qui se sont demandé si ce qui était censé être un simple aperçu du GPT-5 n’aurait pas été notre premier aperçu du GPT-6.

Dans un paysage dominé par les progrès rapides de la technologie de l’IA, la distinction entre les générations successives peut annoncer des bonds significatifs en termes de capacités et d’applications. Les discussions menées par « Dylan Curious—AI » explorent les complexités et le potentiel de ce que GPT-6 pourrait signifier pour une industrie déjà au bord d’un changement transformateur.

La spéculation : GPT-6 dévoilé ?

Au cours d’une session détaillée, « Dylan Curious—AI » a discuté de plusieurs avancées technologiques qui suggèrent une révolution imminente. L’une d’entre elles est l’augmentation de la taille des paramètres de l’IA, un aspect technique qui améliore considérablement la compréhension et les capacités de génération d’un modèle d’IA. « Si la rumeur veut que le GPT-5 atteigne environ 12,8 trillions de paramètres, le saut spéculatif de GPT-6 pourrait établir un nouveau sommet dans la sophistication de l’IA », a noté Dylan, l’animateur de la chaîne.

La chaîne a également mis en évidence les progrès réalisés dans le domaine de l’IA qui pourraient correspondre aux capacités d’un modèle GPT-6. Des avatars alimentés par l’IA sur les réseaux sociaux aux nouveaux frameworks qui permettent des interactions plus nuancées avec l’IA, la technologie sprinte vers un avenir de plus en plus intégré dans les interactions numériques humaines.

Les spéculations autour de GPT-6, bien que prématurées étant donné la sortie prochaine de GPT-5, suscitent des discussions intéressantes sur les caractéristiques et les avancées potentielles. Sur la base des tendances en matière de développement de l’IA, en particulier dans les domaines de l’extensibilité, de la multimodalité et de l’efficacité, voici une liste de caractéristiques possibles que GPT-6 pourrait présenter :

  1. Augmentation du nombre de paramètres : S’appuyant sur la progression des modèles précédents, GPT-6 pourrait augmenter considérablement le nombre de ses paramètres, jusqu’à atteindre des dizaines de milliards, afin d’améliorer la profondeur de sa compréhension et la précision de ses réponses.
  2. Multimodalité avancée : GPT-6 pourrait s’intégrer de manière plus transparente à différentes formes d’entrée et de sortie de données, telles que le texte, les images, le son et la vidéo, ce qui permettrait des interactions plus complexes imitant la compréhension humaine à travers plusieurs sens.
  3. Une meilleure compréhension du contexte : Grâce à l’amélioration de la taille de la fenêtre contextuelle, GPT-6 pourrait gérer des conversations ou des documents encore plus longs, en conservant le contexte sur des textes plus longs ou sur plusieurs sessions grâce à des capacités de mémoire améliorées.
  4. Amélioration de l’efficacité énergétique : Des progrès dans l’efficacité des algorithmes pourraient permettre à GPT-6 d’atteindre des niveaux de performance plus élevés tout en utilisant moins de puissance de calcul, ce qui répondrait aux préoccupations concernant l’impact environnemental de l’entraînement de grands modèles d’intelligence artificielle.
  5. Sécurité et robustesse accrues : Grâce aux enseignements tirés des déploiements précédents, GPT-6 pourrait présenter des caractéristiques de sécurité plus robustes afin de minimiser les risques d’utilisation abusive, notamment une meilleure détection des contenus nuisibles et des informations erronées.
  6. Capacités d’interaction en temps réel : Grâce à une latence de traitement réduite, GPT-6 pourrait interagir en temps réel ou quasi réel pour des applications dans le domaine du service à la clientèle, des jeux et des traductions en direct.
  7. Algorithmes de personnalisation : Personnalisation améliorée pour adapter les réponses en fonction des préférences et de l’historique de l’utilisateur sans compromettre la vie privée, en utilisant éventuellement des approches d’apprentissage fédéré.
  8. Capacités multilingues : Amélioration des capacités de traitement et de traduction entre plusieurs langues, y compris les langues à faibles ressources, ce qui élargit son applicabilité à l’échelle mondiale.
  9. Modèles spécifiques à un domaine : Des versions plus spécialisées de GPT-6 pourraient être formées pour des domaines professionnels spécifiques tels que la recherche juridique, médicale ou scientifique, afin de fournir des réponses plus précises et mieux adaptées au contexte dans des domaines spécialisés.
  10. Raisonnement autonome : GPT-6 pourrait présenter des niveaux plus élevés de raisonnement et de résolution de problèmes, ce qui lui permettrait de s’attaquer à des scénarios complexes dans des environnements dynamiques qui nécessitent des inférences logiques, des prédictions et de la planification.
  11. Meilleure intégration avec la robotique et l’IoT : GPT-6 pourrait être mieux intégré à la robotique et aux dispositifs IoT, ce qui faciliterait la mise en place d’assistants de maison connectée plus intelligents, de robots plus interactifs et de systèmes IoT plus autonomes.
  12. Considérations éthiques sur l’IA : Incorporation de lignes directrices éthiques dans le processus de développement du modèle afin d’aborder de manière proactive les questions de partialité, d’équité et de transparence dans sa formation et ses résultats.
  13. Explicabilité de l’IA et confiance : Des fonctions améliorées d’explicabilité permettent aux utilisateurs de comprendre comment GPT-6 parvient à certaines conclusions ou recommandations, ce qui renforce la confiance et facilite le respect de la réglementation.

Bien que ces fonctionnalités soient spéculatives, elles reflètent les tendances actuelles et la progression naturelle dans le développement de transformateurs génératifs pré-entraînés visant à rendre l’IA plus puissante, plus accessible et plus sûre pour diverses applications.

Réaction de la communauté : Entre scepticisme et enthousiasme

La réaction de la communauté de l’IA a été un mélange de scepticisme et d’enthousiasme. Alors que certains enthousiastes estiment que les discussions sur GPT-6 sont prématurées, d’autres pensent que le rythme rapide du développement pourrait rendre ces avancées inévitables le plus tôt possible. « Le saut entre le GPT-4 et le GPT-5 a été monumental, et avec l’IA, nous avons appris à nous attendre à l’inattendu », a déclaré un modérateur d’un forum de discussion sur la technologie de l’IA.

Au milieu de ces discussions, le potentiel de réalisation de l’intelligence générale artificielle (AGI) se profile à l’horizon. L’épisode « Dylan Curious—AI » a abordé ce sujet, soulignant que nous pourrions nous rapprocher de systèmes d’IA capables de rivaliser avec les capacités cognitives humaines.

« Si nous débattons âprement de la question de savoir s’il s’agit d’une AGI, c’est peut-être que c’est déjà le cas », a déclaré Dylan sur la chaîne, se faisant l’écho d’un sentiment de plus en plus répandu parmi les chercheurs en IA.

Perspectives : Ce que cela signifie pour le développement de l’IA

Alors que les spéculations autour de GPT-6 se multiplient, elles soulèvent des questions importantes sur la future trajectoire du développement de l’IA. Chaque avancée repousse les limites de ce que ces algorithmes peuvent réaliser et suscite des discussions sur l’éthique, la gouvernance et l’impact sociétal de machines presque sensibles.

L’histoire de GPT-6, qu’elle soit fondée ou non, met en lumière la ferveur et l’anticipation qui entourent les nouveaux développements de l’IA. Alors que des entreprises comme OpenAI continuent d’innover à un rythme effréné, la frontière entre les capacités actuelles et la science-fiction continue de s’estomper, nous entraînant tous dans un avenir où l’IA n’est pas seulement un outil, mais un élément essentiel de notre vie quotidienne.

La communauté de l’IA surveille de près le compte à rebours jusqu’à la prochaine grande révélation, qu’il s’agisse de GPT-5 ou d’un saut inattendu vers GPT-6. Quelle que soit l’issue, le voyage vers une IA plus avancée sera jalonné de débats, de découvertes et, potentiellement, de révélations spectaculaires qui pourraient redéfinir l’interaction entre l’homme et la machine.

Lire plus
Intelligence Artificielle

Révolutionnez votre montage vidéo avec ces 5 outils IA incontournables

Révolutionnez votre montage vidéo avec ces 5 outils IA incontournables

Si vous cherchez des moyens de réduire le temps que vous passez à éditer vos vidéos, vous serez peut-être intéressé par cinq outils d’IA qui non seulement améliorent votre flux de travail d’édition vidéo, mais vous font également gagner du temps dans le processus.

Vous pourriez être intéressé par quelques outils utilisés par Think Media au cours du processus de production pour créer des vidéos que ses 2,8 millions d’abonnés visionnent chaque semaine. Ces outils d’IA offrent une série de fonctionnalités qui simplifient et automatisent divers aspects du processus de montage.

Outils d’IA pour l’édition de vidéos

CapCut

Tout d’abord, nous avons CapCut, un outil qui regorge de fonctions d’IA conçues pour faciliter l’édition de vidéos. Imaginez que vous ayez besoin de supprimer un arrière-plan vidéo. Au lieu de passer des heures sur cette tâche, CapCut vous permet de le faire en un clic. Mais ce n’est pas tout. Il améliore la clarté de vos vidéos, leur donnant un aspect professionnel qui ne manquera pas d’impressionner.

Vous souhaitez ajouter des effets dynamiques ? CapCut vous propose des options telles que le zoom sur les travellings et les transformations 3D, qui ajoutent de la profondeur et du mouvement à vos créations. Si vous souhaitez améliorer l’apparence de vos sujets, l’outil propose un lissage de la peau et d’autres fonctions de retouche. Il ajuste même vos vidéos pour qu’elles s’adaptent parfaitement aux différentes plateformes et s’accompagne de légendes générées automatiquement pour rendre votre contenu plus accessible et plus attrayant.

Screen 2024 03 29 11.27.34 jpg

L’équipe de Think Media explique en détail son processus de montage vidéo et la manière dont elle utilise l’intelligence artificielle pour améliorer son flux de travail et gagner du temps à différentes étapes du processus de montage vidéo.

Adobe Podcast Enhance

Pensez ensuite à l’importance de la qualité audio de vos vidéos. Un son de mauvaise qualité peut nuire à la qualité du contenu, même s’il est visuellement époustouflant. C’est là qu’intervient Adobe Podcast Enhance. C’est une véritable bouée de sauvetage pour ceux qui ont besoin d’un son d’une clarté irréprochable. Que vous soyez confronté à des conditions d’enregistrement peu idéales ou que vous souhaitiez simplement éliminer les bruits de fond et les imperfections, cet outil permet à votre public d’entendre chaque mot sans distraction.

Screen 2024 03 29 11.30.09 scaled

Opus Clip

Il y a ensuite Opus Clip, un outil qui vise à maximiser l’engagement en automatisant votre processus d’édition. Il ne se contente pas de sélectionner les points forts de votre contenu ; il crée également des légendes et génère des titres et des descriptions. Cette automatisation vous permet de vous concentrer sur les aspects créatifs de la production vidéo, sachant que Opus s’occupe des parties fastidieuses.

opusclip 3.0 jpg

Vidyo.ai

Pour ceux qui cherchent à réutiliser du contenu, Vidyo.ai est l’outil de choix. Il est conçu pour vous aider à donner une nouvelle vie à des vidéos plus longues en identifiant et en extrayant les segments les plus intéressants pour les utiliser dans des podcasts ou des clips plus courts. Avec Vidyo.ai, vous pouvez sans effort augmenter la présence de votre contenu sur différentes plateformes, en maximisant la valeur de vos vidéos existantes.

Screen 2024 03 29 11.34.26 jpg

Gling.ai

Enfin, Gling.ai propose une approche unique de l’édition vidéo. Il transcrit vos vidéos en texte, ce qui vous permet d’effectuer des modifications comme si vous travailliez sur un document écrit. Cette méthode innovante offre une précision incroyable, car les modifications apportées au texte se répercutent directement sur la vidéo. Gling.ai vous aide également à identifier les meilleures prises et peut être utilisé parallèlement aux outils d’édition traditionnels pour une mise au point encore plus détaillée.

Screen 2024 03 29 11.32.22 jpg

Ces cinq outils d’IA redessinent le paysage de l’édition vidéo. Ils se chargent des tâches les plus lourdes, améliorent la qualité audio et rendent les effets visuels sophistiqués accessibles à tous les créateurs. Que vous soyez débutant ou professionnel chevronné, ces outils peuvent améliorer votre processus de montage et vous aider à produire du contenu de haute qualité avec une plus grande efficacité.

À mesure que la technologie de l’IA progresse, nous pouvons nous attendre à voir apparaître toute une série de nouveaux outils, chacun étant conçu pour soutenir et améliorer le processus créatif des créateurs de contenu numérique. L’avenir du montage vidéo est prometteur, et avec l’IA à vos côtés, vous êtes bien équipé pour créer des vidéos qui captivent et engagent votre public comme jamais auparavant.

Lire plus
Intelligence Artificielle

OpenAI demande le rejet des poursuites engagées par Elon Musk

OpenAI demande le rejet des poursuites engagées par Elon Musk

OpenAI a déclaré que l’affirmation d’Elon Musk selon laquelle l’entreprise a violé ses engagements contractuels de créer une entité open source et à but non lucratif est « révisionniste » et constitue une tentative de promouvoir sa propre entreprise d’IA concurrente.

Le PDG de Tesla, qui a contribué à fonder l’entreprise en 2015, a poursuivi la société et son directeur général Sam Altman en mars, affirmant que le virage de l’entreprise soutenue par Microsoft vers des objectifs axés sur le profit va à l’encontre de l’accord initial.

« Il y a des années, le plaignant Elon Musk a abandonné OpenAI lorsque sa tentative de dominer l’entreprise a échoué », ont déclaré les avocats d’OpenAI dans un dossier judiciaire, demandant le rejet de la poursuite. « Maintenant qu’il a lancé une entreprise d’intelligence artificielle concurrente, Elon Musk cherche à tirer parti du succès d’OpenAI et à diriger les affaires d’OpenAI pour son propre bénéfice commercial ».

Les avocats d’OpenAI réfutent également l’accusation de Musk selon laquelle l’entreprise s’est engagée à ne pas monétiser sa technologie, affirmant que le milliardaire propriétaire de la plateforme X n’a fourni aucune preuve contractuelle à l’appui de son affirmation. « Musk ne peut pas intenter un procès sur la base d’un accord dont il ne peut même pas plaider l’existence », selon le dépôt du tribunal d’État de San Francisco.

Quelles étaient les revendications d’OpenAI à l’encontre de Musk ?

Dans un démenti et une motion de radiation déposés le 27 mars, OpenAI a affirmé que l’argument de Musk contenait une erreur critique et que le prétendu accord de fondation était « fictif ». En termes simples, un tel accord n’a jamais existé et Musk n’a pas réussi à démontrer l’existence d’un quelconque contrat — qu’il soit écrit, oral ou implicite — étayant son affirmation.

Cette objection juridique remet en question la suffisance de la plainte du plaignant. Il demande essentiellement au tribunal de déterminer que même si toutes les déclarations du plaignant s’avéraient vraies lors du procès, elles ne constitueraient toujours pas une base suffisante pour rendre un jugement en faveur du plaignant. Ce mécanisme permet au tribunal d’éliminer, dès le début du litige, les cas où les faits — tels qu’ils sont présentés par le plaignant — ne constituent pas une demande légale légitime.

Parallèlement, OpenAI a présenté une motion visant à supprimer des sections de la plainte de Musk. Ces sections demandent au tribunal d’évaluer l’état de développement de la technologie d’OpenAI et, sur la base de ces évaluations, « d’ordonner une exécution spécifique exorbitante et irréalisable ». L’exécution spécifique est un recours juridique qui oblige une partie à respecter les termes d’un contrat exactement comme convenu.

Les avocats représentant Musk ont déclaré que « Altman a proposé à Musk d’unir leurs forces pour former un laboratoire d’IA à but non lucratif qui essaierait de rattraper Google dans la course à l’AGI, mais qui serait à l’opposé de Google ».

Une audience très attendue

Le procès ajoute qu’avec Brockman, ils sont parvenus à un consensus sur l’éthique fondamentale du nouveau laboratoire d’IA. Selon cet accord, OpenAI « serait un organisme à but non lucratif développant l’AGI pour le bénéfice de l’humanité, et non pour une société à but lucratif cherchant à maximiser les profits de ses actionnaires ; et (b) serait une source ouverte, équilibrant uniquement les considérations de sécurité compensatoires, et ne garderait pas sa technologie fermée et secrète pour des raisons commerciales exclusives ».

Une audience sur l’exception d’irrecevabilité et la motion d’irrecevabilité est prévue pour le 24 avril.

Lire plus
Intelligence Artificielle

Apple et TSMC, ensemble pour une avancée IA : Vers un processeur serveur

Apple et TSMC, ensemble pour une avancée IA : Vers un processeur serveur

Apple pourrait renouveler sa collaboration avec le fabricant de puces TSMC pour produire son propre processeur serveur IA, révèle une fuite sur le réseau social chinois Weibo.

Cette information sur la prochaine avancée d’Apple dans le monde des outils d’intelligence artificielle nous est rapportée, non sans ironie, par MacRumors, qui cite « l’utilisateur de Weibo connu sous le nom de “Phone Chip Expert” ». Ce dernier suggère que le processeur sera fabriqué en utilisant le procédé ultra-moderne de nœuds de 3 nanomètres de TSMC.

Selon MacRumors, l’utilisateur de Weibo connu sous le nom de Phone Chip Expert a déjà prouvé sa fiabilité, ayant correctement annoncé, avant les annonces officielles, que l’iPhone 7 serait résistant à l’eau et que la puce A16 Bionic serait exclusive à la variante Pro de l’iPhone 14.

L’utilisateur de Weibo connu sous le nom de Phone Chip Expert pourrait bien frapper à nouveau avec ses pouvoirs de clairvoyance, mais il est incertain de savoir quand exactement Apple annoncerait formellement un tel processeur IA, et encore moins quand il serait lancé commercialement.

Dans un monde de plus en plus obsédé par l’IA et piloté par les centres de données, il n’est pas surprenant qu’Apple aspire à être autonome dans ses processus de calcul en cloud.

Une nécessité pour Apple

Apple est une entreprise suffisamment grande pour gérer ses propres datacenters et, à mesure que les outils d’IA générative, tels que le futur Large Language Model (LLM) d’Apple, se généralisent auprès des publics B2B et des consommateurs, il est logique qu’elle cherche à exercer autant de contrôle et de supervision que possible sur la manière dont ces traitements sont effectués.

Il est clair qu’Apple a des projets dans « le secteur IA » et aurait même des idées crédibles sur la manière dont cela pourrait améliorer nos vies, mais nous ne savons vraiment pas quels sont ces projets avant, probablement, la WWDC de l’entreprise en juin.

Lire plus
Intelligence Artificielle

Meta dévoile Llama 3 : Un nouveau standard en IA pour raisonnement et codage

66217d9ae4015dd99157a819 introdu

Suite au lancement du nouveau Large Language Model Llama 3 par Meta et Mark Zuckerberg, WorldofAI a testé les performances et les capacités de Llama 3 pour le raisonnement et le codage. WorldofAI a testé les performances et les capacités de Llama 3 en matière de raisonnement et de codage. Llama 3 s’est déjà imposé comme un véritable catalyseur dans le domaine de l’intelligence artificielle (IA), établissant de nouvelles références en matière de performance de l’IA et démontrant ses capacités supérieures dans un large éventail de tâches.

Ce LLM open source a non seulement dépassé ses prédécesseurs, mais aussi ses principaux concurrents, tels que le modèle GPT-4 d’OpenAI et le modèle Claude 3 Haiku d’Anthropic, en particulier dans des domaines tels que le raisonnement, les mathématiques et le codage.

Les impressionnantes performances de Llama 3 peuvent être attribuées à ses capacités cognitives avancées et à son robuste framework. Lorsqu’il est soumis à diverses évaluations axées sur les compétences de résolution de problèmes du monde réel, Llama 3 démontre constamment sa supériorité dans la gestion de requêtes et de tâches complexes. Sa capacité à relever des défis sophistiqués avec facilité souligne son potentiel à transformer le paysage de l’IA.

L’un des principaux atouts de Llama 3 réside dans sa capacité d’adaptation, qui se manifeste à travers ses diverses configurations de paramètres. Le modèle a été testé à la fois avec 8 milliards et 70 milliards de paramètres, cette dernière configuration montrant une vitesse de traitement et une efficacité exceptionnelles. Llama 3 est donc particulièrement bien adapté au traitement de tâches plus exigeantes et plus complexes, ce qui souligne encore sa polyvalence et son potentiel d’application dans divers domaines.

Llama 3 Performance Comparison d jpg

Les prouesses de Llama 3 vont au-delà de sa puissance de traitement brute, puisqu’il a démontré des capacités remarquables en matière de raisonnement et de codage. Lors de tests destinés à évaluer sa capacité à simplifier des concepts complexes, Llama 3 a réussi à expliquer des théories complexes, telles que la théorie de la relativité, en des termes que même un jeune enfant peut comprendre.

Cette prouesse souligne le potentiel du modèle en tant qu’outil éducatif transformateur, capable de rendre des sujets complexes plus accessibles à un public plus large.

Performance de codage de Llama 3

Dans le domaine du codage, Llama 3 a fait ses preuves en s’attaquant facilement à des défis de programmation avancés. Le modèle a généré avec succès un code fonctionnel pour diverses applications, y compris des jeux populaires comme Snakes and Ladders. Cela souligne non seulement l’utilité pratique de Llama 3 dans le développement de logiciels, mais laisse également entrevoir son potentiel d’innovation dans la conception de jeux et d’autres domaines centrés sur la programmation.

  • Performances supérieures dans les tâches de raisonnement, de mathématiques et de codage
  • Adaptation à diverses configurations de paramètres, avec une efficacité exceptionnelle pour 70 milliards de paramètres
  • Capacité à simplifier des concepts complexes pour en faciliter la compréhension.
  • Génère du code fonctionnel pour diverses applications, y compris des jeux.

Alors que l’équipe de développement de Llama 3 se fixe des objectifs encore plus ambitieux, tels que la création d’un modèle de 400 milliards de paramètres, l’avenir de l’IA semble de plus en plus prometteur. Cette prochaine itération devrait repousser encore plus loin les limites des performances de l’IA, ce qui pourrait influencer le développement de modèles ultérieurs tels que GPT-4.5 ou GPT-5.

Pour les développeurs et les chercheurs désireux d’exploiter la puissance de Llama 3, des plateformes telles que Hugging Face et Meta AI offrent l’infrastructure nécessaire pour des tests et des développements approfondis. Ces plateformes fournissent aux utilisateurs les outils et les ressources nécessaires pour explorer pleinement les capacités du Llama 3 dans des scénarios pratiques, ce qui leur permet de tirer parti de son potentiel d’innovation et de progrès dans leurs domaines respectifs.

Façonner l’avenir de l’IA

Alors que Llama 3 continue de redéfinir l’excellence dans le domaine des Large Language Model, son impact sur l’avenir de l’intelligence artificielle ne peut être surestimé. Grâce à ses performances inégalées en matière de raisonnement, de codage et de résolution de problèmes, ce modèle révolutionnaire est en passe de façonner la trajectoire du développement de l’intelligence artificielle pour les années à venir.

Les améliorations et les applications potentielles du Llama 3 sont vastes et d’une grande portée, offrant de précieuses opportunités aux développeurs, aux chercheurs et aux industries. À mesure qu’un plus grand nombre d’individus et d’organisations commencent à reconnaître le pouvoir de transformation de ce modèle, nous pouvons nous attendre à une augmentation des projets innovants et des percées qui tirent parti de ses capacités.

Lire plus
Intelligence Artificielle

Adobe intègre l’IA générative pour révolutionner la conception numérique

Adobe intègre l'IA générative pour révolutionner la conception numérique

Adobe Systems Incorporated, l’un des piliers des outils de créativité numérique, est à l’origine d’une transformation du monde de la conception en mettant en œuvre de manière stratégique l’intelligence artificielle générative (IA). Cette initiative améliore la gamme de produits Adobe et stimule considérablement la productivité et les flux de revenus en répondant aux besoins évolutifs des designers professionnels et des spécialistes du marketing.

Au cours de l’année écoulée, Adobe a méthodiquement intégré l’IA générative dans ses produits phares, notamment le mastodonte Photoshop et le polyvalent Adobe Express. Ces améliorations sont spécifiquement adaptées aux workflows créatifs des professionnels, permettant une personnalisation et une efficacité sans précédent dans la création de contenu.

David, porte-parole d’Adobe, a souligné l’ampleur de ces intégrations lors d’une récente discussion. « L’introduction de modèles d’IA pour l’imagerie, les vecteurs et la conception a révolutionné la façon dont nos applications Creative Cloud améliorent la productivité », a-t-il noté. Cette suite d’outils permet aux professionnels de la création de produire rapidement un contenu de haute qualité adapté aux exigences spécifiques d’un projet, réduisant ainsi les délais d’exécution et augmentant la réactivité du marché.

L’une des avancées les plus significatives est l’intégration de l’IA dans Photoshop. Cela a permis aux utilisateurs de manipuler et de créer facilement des images complexes, en tirant parti de l’IA pour automatiser les parties fastidieuses du processus créatif. Pour les designers, cela signifie qu’ils consacrent moins de temps aux tâches routinières et plus de temps à l’exploration créative, repoussant ainsi les limites de l’art numérique.

En outre, Adobe est pionnier dans la gestion et l’utilisation des données pour la formation à l’IA. Contrairement à certains concurrents qui s’appuient sur des données synthétiques ou des contenus sans licence, Adobe a construit ses modèles d’IA à partir d’une vaste bibliothèque d’images et de ressources exclusives. Cette approche éthique garantit le respect des lois sur la propriété intellectuelle et fait d’Adobe un leader en matière de développement responsable de l’IA.

Adobe garanti une approche éthique

« Nous adhérons strictement à un cadre que nous appelons ART (accountability, responsibility, transparency) », explique David. Ce processus rigoureux garantit que tous les modèles d’IA expédiés par Adobe ont fait l’objet d’une évaluation et d’une modération approfondies, ce qui permet de s’assurer que le contenu généré est conforme à la législation et de la plus haute qualité.

À l’avenir, Adobe s’apprête à dévoiler des fonctionnalités révolutionnaires de conversion de texte en vidéo, afin d’améliorer encore son écosystème de logiciels créatifs. Cette nouvelle fonctionnalité permettra de traduire des descriptions écrites en contenus vidéo riches et détaillés, une aubaine pour les professionnels de la publicité, du cinéma et des médias. En outre, la collaboration d’Adobe avec des innovateurs tiers dans le domaine de l’IA, tels que Sora, Runway et PCA, devrait élargir les possibilités créatives offertes aux utilisateurs, garantissant ainsi que les outils d’Adobe restent à la pointe de la technologie.

media 1657fb6b6f86cd50d86b7984b1 jpg

Ces avancées représentent un grand pas en avant pour les concepteurs qui s’appuient sur la gamme complète d’outils Adobe. L’intégration de l’IA générative rationalise le workflow et enrichit le processus créatif, permettant aux concepteurs d’en faire plus avec moins d’efforts. En outre, l’engagement d’Adobe en faveur d’une utilisation éthique de l’IA rassure à une époque où les questions de confidentialité des données et de droits d’auteur sont primordiales.

Adobe continue d’innover et d’intégrer l’IA

Alors qu’Adobe continue d’innover et d’intégrer l’IA dans sa gamme de produits, les professionnels de la conception peuvent s’attendre à des outils encore plus performants qui facilitent la créativité et l’efficacité. L’avenir de la conception est là, et Adobe en écrit les premières ébauches grâce aux coups de pinceau intelligents de l’IA générative.

Lire plus
Intelligence Artificielle

Apple présente les modèles OpenELM pour booster l’IA sur ses appareils

59025 120458 SiriGPT xl

Apple est restée discrète sur ses projets en matière d’IA générative, mais avec la publication de nouveaux modèles d’IA OpenELM aujourd’hui, il semble que les ambitions immédiates de l’entreprise se situent résolument dans le domaine de l’exécution locale de l’IA sur les appareils Apple.

Apple a récemment fait une incursion remarquée dans le domaine des modèles de langage avec le lancement d’OpenELM, une série de Large Language Model mais efficaces, conçus pour fonctionner entièrement sur des appareils individuels. Cette démarche représente un changement de stratégie pour la firme, traditionnellement réputée pour sa culture du secret et ses systèmes fermés.

OpenELM, qui signifie « Open-source Efficient Language Models », comprend 8 versions de modèles, chacune conçue pour des tâches spécifiques de génération de texte et d’instruction. Il existe quatre tailles : 270 millions de paramètres, 450 millions de paramètres, 1,1 milliard de paramètres et 3 milliards de paramètres.

Les paramètres désignent le nombre de variables qu’un modèle comprend pour prendre des décisions à partir de ses ensembles de données d’apprentissage. Par exemple, le modèle Phi-3 de Microsoft, récemment publié, se limite à 3,8 milliards de paramètres, tandis que Gemma de Google propose une version à 2 milliards de paramètres. Les petits modèles sont moins coûteux et optimisés pour fonctionner sur des appareils tels que les smartphones et les ordinateurs portables.

Quatre tailles d’OpenELM

Screen Shot 2024 04 24 at 11.09 jpg

Les modèles OpenELM ont été pré-entraînés sur des ensembles de données publics comprenant des sources telles que Reddit, Wikipedia et arXiv, atteignant un impressionnant total de 1,8 trillion de tokens. Apple a utilisé une stratégie de mise à l’échelle par couche dans la construction de ces modèles, permettant une utilisation optimisée des ressources de calcul tout en améliorant l’exactitude des résultats.

Les benchmarks publiés montrent que les modèles, en particulier la variante de 450 millions de paramètres, réalisent des performances respectables, mais pas révolutionnaires, sur des benchmarks tels que ARC-C, MMLU et HellaSwag. Cela positionne OpenELM comme une alternative viable pour les applications ne nécessitant pas les capacités extrêmes des modèles plus grands et plus gourmands en ressources.

Screen Shot 2024 04 24 at 10.54 jpg

Applications et implications de OpenELM

L’approche d’Apple, permettant l’exécution de ces modèles sur des dispositifs individuels comme les MacBook et les smartphones, sans nécessiter de connexion à des serveurs cloud, souligne une avancée vers plus d’autonomie dans le traitement des tâches d’IA.

Les poids des modèles OpenELM sont disponibles sous une licence sample code, ce qui encourage leur utilisation et modification dans des projets commerciaux, tout en respectant certaines conditions de redistribution.

Avec OpenELM, Apple ne cherche pas seulement à rattraper ses concurrents comme Google ou Microsoft, qui ont également leurs propres modèles pouvant fonctionner sur des appareils. La firme cherche plutôt à pousser les limites de ce qui est possible avec l’IA en open source, tout en restant fidèle à ses principes de performance et d’efficacité. Les modèles OpenELM représentent donc une étape significative vers des applications d’IA plus accessibles et éthiquement responsables.

Apple mise beaucoup sur l’IA

Tim Cook, le PDG d’Apple, a laissé entendre que des fonctions d’IA générative allaient être intégrées aux appareils de la société, déclarant en février qu’Apple consacrait « énormément de temps et d’efforts » à ce domaine. Cependant, Apple n’a pas encore donné de détails sur ce que pourrait être son utilisation de l’IA.

La société a déjà lancé d’autres modèles d’IA, mais elle n’a pas encore publié de modèle de base d’IA pour une utilisation commerciale, comme l’ont fait ses concurrents.

Lire plus
Intelligence Artificielle

Phi-3 : Le nouveau modèle d’IA abordable et efficace de Microsoft

Phi-3 : Le nouveau modèle d'IA abordable et efficace de Microsoft

Microsoft a lancé son plus petit modèle d’IA, Phi-3, le premier d’un trio de modèles légers. Alors que de plus en plus de modèles d’IA arrivent sur le marché, Microsoft s’oriente vers des modèles formés sur des ensembles de données plus petits qu’à l’accoutumée.

The Verge rapporte que Phi-3 Mini dispose de 3,8 milliards de paramètres (le nombre d’instructions complexes qu’un modèle peut comprendre) et est désormais disponible sur Azure, Hugging Face et Ollama, avec des projets de lancement de deux autres modèles. Phi-3 Small dispose de 7 milliards de paramètres et Phi-3 Medium 14 milliards de paramètres. Pour donner une idée de l’échelle, on pense que GPT-4 a plus de 1 000 milliards de paramètres.

Le Phi-2 de Microsoft a été lancé en décembre 2023, avec 2,7 milliards de paramètres, mais avec la capacité d’atteindre des niveaux de performance analogue à ceux de certains modèles plus grands. L’entreprise affirme aujourd’hui que Phi-3 peut surpasser son prédécesseur, en offrant des réponses proches de celles de 10x sa taille.

Les avantages de Phi-3 Mini ?

Les petits modèles d’IA sont généralement moins coûteux à créer et à exploiter. Leur taille réduite signifie qu’ils fonctionnent bien sur des appareils personnels tels que les smartphones et les ordinateurs portables, ce qui facilite leur adaptation et leur lancement sur le marché de masse.

Microsoft dispose d’une équipe chargée de développer des modèles d’IA plus petits, chacun d’entre eux étant conçu pour cibler des domaines spécifiques. Orca-Math, par exemple, se concentre sur la résolution de problèmes mathématiques, comme son nom l’indique.

phi 3 model benchmark jpg

Ce n’est pas la seule entreprise à cibler ce domaine, avec Gemma 2B et 7B de Google centrés sur le langage et les chatbots, Claude 3 Haiku d’Anthropic conçu pour lire et résumer de longs articles de recherche (similaire à CoPilot de Microsoft), et Llama 3 8B de Meta prêt à aider au codage.

Si les modèles d’IA de petite taille conviennent mieux aux appareils personnels, ils peuvent également être utilisés par les entreprises. Les ensembles de données internes des entreprises étant généralement plus petits, ces modèles d’IA sont bien adaptés à une utilisation interne, car ils sont plus faciles et plus rapides à installer et à utiliser, tout en étant plus abordables.

L’IA responsable au premier plan

Microsoft a développé Phi-3 en tenant compte dès le départ de ses principes d’IA responsable. Les données d’entraînement du modèle ont été examinées pour détecter toute toxicité et tout biais, et des mesures de sécurité supplémentaires ont été mises en place avant la publication. Cela permet aux entreprises, en particulier celles des secteurs réglementés, d’exploiter en toute confiance les capacités de Phi-3.

D’un point de vue technique, Phi-3 fonctionne sur le ONNX Runtime optimisé pour les GPU NVIDIA et peut être déployé de manière distribuée sur plusieurs GPU ou machines afin d’optimiser le débit. L’architecture du modèle utilise des mécanismes d’attention efficaces et une précision numérique optimisée pour atteindre des performances élevées avec un nombre relativement faible de paramètres.

Lire plus
Intelligence Artificielle

Nouvelle ère de créativité : Adobe intègre l’IA Firefly 3 dans Photoshop 2024

Nouvelle ère de créativité : Adobe intègre l'IA Firefly 3 dans Photoshop 2024

La version 2024 de Photoshop CC d’Adobe était une mise à jour importante. Bien qu’Adobe ait déjà commencé à jouer avec les fonctions d’IA, la version de l’année dernière a été la première à être correctement équipée pour l’ère de l’IA générative. La nouvelle fonction de « remplissage génératif » vous permet d’utiliser l’IA pour modifier des parties d’une image, agrandir des images et, de manière générale, modifier des images à votre guise à l’aide de l’IA. Aujourd’hui, une version améliorée de cette fonctionnalité est prévue pour la prochaine version 2025 de Photoshop.

Lors de la MAX London, le grand événement annuel d’Adobe, Adobe a dévoilé une nouvelle version bêta de Photoshop, qui présente des avancées en matière de remplissage génératif et apporte des améliorations globales à Photoshop avec un grand nombre de nouveaux ajouts en matière d’IA.

Toutes ces nouveautés sont alimentées par le nouveau modèle d’IA Firefly 3 d’Adobe, plus performant que ses prédécesseurs, et devraient se traduire non seulement par de nouvelles fonctionnalités d’IA, mais aussi par des améliorations de toutes les fonctionnalités auxquelles vous aviez déjà accès. Les images et les résultats générés par le modèle devraient être plus beaux, plus réalistes, plus détaillés, et le modèle devrait également mieux suivre vos instructions. Ce n’est pas le seul ajout d’IA par Adobe à ses logiciels ces dernières années, mais les fonctions d’IA de Photoshop sont peut-être parmi les plus utilisées.

L'image de référence téléchargée guide les résultats générés par l'IA de Photoshop, évitant ainsi aux utilisateurs d'effectuer des ajustements fréquents aux prompts textuels.
L’image de référence téléchargée guide les résultats générés par l’IA de Photoshop, évitant ainsi aux utilisateurs d’effectuer des ajustements fréquents aux prompts textuels.

Les générations d’IA de Photoshop n’étaient pas mauvaises, loin de là, mais lorsque d’autres modèles de génération d’images comme DALL-E 3 ont commencé à débarquer, les résultats de Photoshop ont commencé à paraître un peu faibles en comparaison, et cette amélioration était donc plus que nécessaire. Elle permet également d’utiliser de nouvelles fonctionnalités telles que Image de référence, Générer une image, Générer similaire, Générer un arrière-plan et Améliorer le degré de détail, offrant ainsi aux utilisateurs des outils leur permettant de donner rapidement vie à leurs visions créatives.

Adobe présente Générer un arrière-plan comme un outil permettant d'ajouter rapidement de la variété aux photographies de produits sans avoir à refaire les prises de vue.
Adobe présente Générer un arrière-plan comme un outil permettant d’ajouter rapidement de la variété aux photographies de produits sans avoir à refaire les prises de vue.

Générer une image permet aux utilisateurs de générer une image entièrement à partir de zéro, comme le fait DALL-E 3, tandis que Image de référence permet de prendre une image existante comme référence pour la génération d’une IA. Par exemple, au lieu de modifier à plusieurs reprises la description d’un prompt comme « un camion vintage bleu avec des autocollants de fleurs », les utilisateurs peuvent fournir une image de référence que Photoshop utilisera comme guide. Les fonctions Générer similaire et Améliorer les détails se décrivent également d’elles-mêmes.

Les outils Firefly produisent trois résultats générés à choisir dans Photoshop - si vous souhaitez voir des versions similaires de l'un d'entre eux, Générer similaire s'en chargera.
Les outils Firefly produisent trois résultats générés à choisir dans Photoshop – si vous souhaitez voir des versions similaires de l’un d’entre eux, Générer similaire s’en chargera.

De la génération d’image assistée par l’IA sur Photoshop

En dehors de l’IA générative, Adobe ajoute également à Photoshop de nouveaux outils standard susceptibles d’accélérer les processus créatifs. Il s’agit notamment d’un pinceau de réglage qui permet aux utilisateurs de Photoshop d’apporter des modifications non destructives, telles que des ajustements de couleur, à des sections spécifiques d’une image. Il existe également un nouveau préréglage d’ajustement qui permet de modifier rapidement une image à l’aide de filtres, ainsi qu’un navigateur de polices amélioré qui permet aux utilisateurs d’accéder en temps réel à plus de 25 000 polices dans le cloud d’Adobe sans quitter l’application Photoshop.

Plutôt que de recourir au masquage ou à d'autres processus laborieux, les utilisateurs peuvent modifier rapidement des éléments tels que la couleur à l'aide du nouveau pinceau de réglage.
Plutôt que de recourir au masquage ou à d’autres processus laborieux, les utilisateurs peuvent modifier rapidement des éléments tels que la couleur à l’aide du nouveau pinceau de réglage.

Ces fonctionnalités sont désormais disponibles dans la version bêta de Photoshop, et si vous souhaitez vous y essayer, vous pouvez le faire sur votre ordinateur dès maintenant. La version « finale » de ces améliorations sera disponible dans le courant de l’année. Si vous ne souhaitez pas jouer avec un logiciel de niveau bêta, il est donc préférable d’attendre.

Lire plus
Intelligence Artificielle

Apple prépare un coup de maître en IA pour iOS 18 avec l’acquisition de Datakalab

Apple prépare un coup de maître en IA pour iOS 18 avec l'acquisition de Datakalab

Apple aurait acquis Datakalab, une startup d’intelligence artificielle basée à Paris, dans le cadre de son projet de fournir des outils d’intelligence artificielle sur les appareils. Cette nouvelle intervient juste après que Mark Gurman a rapporté qu’Apple développait un Large Language Model (LLM) propriétaire afin d’apporter des fonctionnalités d’IA aux iPhone.

Ne nous voilons pas la face, 2024 est l’année de l’IA. Si votre smartphones n’est pas doté de capacités d’IA, vous pourriez tout aussi bien vivre à côté des Pierrafeu. C’est évidemment une exagération, mais vous savez que la WWDC 2024 sera scrutée comme jamais auparavant, car Apple dévoilera la plus grande mise à jour de l’histoire d’iOS.

Selon le magazine économique Challenges, cette acquisition a été finalisée en décembre 2023. Bien que les détails financiers n’aient pas été divulgués, cette décision intervient alors qu’Apple devrait intégrer une série de fonctions d’IA à la prochaine version d’iOS 18 et à la série d’iPhone 16.

En ce qui concerne la startup acquise, Datakalab est réputée pour son expertise en matière de compression d’algorithmes et de développement de systèmes d’IA embarqués. Elle a été fondée en 2016 par Xavier et Lucas Fischer.

Depuis, la société a fait des progrès notables dans la technologie de l’IA en se concentrant sur les algorithmes de faible puissance, efficaces en termes de temps d’exécution et d’apprentissage profond qui fonctionnent sur l’appareil, sans s’appuyer sur des systèmes basés sur le cloud. Un bon exemple d’outil d’IA basé sur le cloud est la fonction de fond d’écran génératrice d’IA sur les smartphones Pixel, Samsung et Nothing.

Cette approche est étroitement liée à l’engagement d’Apple de fournir des performances fiables tout en préservant la confidentialité des utilisateurs et la sécurité des données. Lorsque les données sont traitées, cela garantit des réponses plus rapides et minimise le risque de violation des données. L’intérêt d’Apple est probablement motivé par la compétence de la startup en matière d’optimisation des réseaux neuronaux pour les appareils portables tels que les smartphones et les tablettes.

Une grosse expérience pour Datakalab

Avant d’être supprimé, le site Web de Datakalab indiquait : « Datakalab est une société technologique française qui développe des algorithmes d’analyse d’images informatiques pour mesurer les flux dans l’espace public. Les images sont instantanément transformées en données statistiques anonymes traitées localement en 100 ms. Datakalab ne stocke aucune image ou donnée personnelle et ne conserve que des données statistiques. Les produits Datakalab sont construits selon le principe du “Privacy by Design” ». Avant l’accord avec Apple, l’entreprise comptait entre 10 et 20 employés.

dlab jpg

En mai 2020, Datakalab s’est associée au gouvernement français pour déployer des outils d’IA dans les systèmes de transport parisiens afin de vérifier si les usagers portaient des masques de protection. L’entreprise a également fait ses preuves auprès de Disney et d’autres acteurs.

Datakalab a également développé une technologie capable d’analyser les émotions humaines par le biais de la reconnaissance faciale et des données visuelles. Plus tard, ces technologies ont été utilisées pour surveiller en temps réel les réactions du public lors des projections au cinéma.

Il convient de mentionner que ni Apple ni DatakaLab n’ont encore reconnu l’acquisition. Selon Challenges, l’opération a été signalée ce mois-ci à l’Union européenne. Selon le rapport, les deux fondateurs de Datakalab n’ont pas rejoint Apple, mais plusieurs autres employés ont changé de poste.

Un LLM exécuté en local

Récemment, Mark Gurman a rapporté qu’Apple développait un LLM qui fonctionnera sur l’appareil, contrairement à la plupart des services d’IA existants qui fonctionnent sur le cloud. Étant donné que le LLM sur appareil d’Apple pourrait être moins puissant que ses rivaux directs basés sur le cloud, le géant technologique de Cupertino pourrait “combler les lacunes” en accordant des licences sur la technologie de Google ou d’autres fournisseurs de services d’IA.

Nous saurons tout sur la stratégie d’Apple en matière d’IA lors de la conférence annuelle WWDC (Worldwide Developers Conference), qui se tiendra du 10 au 14 juin 2024.

Lire plus
Intelligence Artificielle

Google pousse Gemini dans l’ère du streaming musical

Google pousse Gemini dans l'ère du streaming musical

Cela fait un moment que Google a lancé Gemini sur les appareils Android. Si son IA générative et son intégration à la suite d’applications de Google sont louables, il lui manquait l’intégration aux applications de streaming musical. La bonne nouvelle, c’est que Gemini permettra bientôt aux utilisateurs de sélectionner une application de streaming musical par défaut.

En effet, Gemini est sur le point de devenir beaucoup plus utile grâce à la prise en charge de services de streaming musicaux tiers comme Spotify et Apple Music.

La source AssembleDebug, via Piunika Web, a repéré la fonction cachée dans les paramètres de Gemini. Cette fonction vous permet de « Choisir votre fournisseur de médias par défaut ». Selon sa description, l’option Musique dans les paramètres de Gemini permet de « sélectionner les services préférés utilisés pour lire de la musique ».

Bien que l’écran « Choisissez votre fournisseur de médias par défaut » semble vide pour l’instant, Google pourrait bientôt y ajouter une liste de populaires applications de streaming musicales. Les utilisateurs pourront ainsi sélectionner une application de streaming comme service par défaut. Cela permettra à Gemini de commencer à accepter des commandes liées au streaming musical, comme « Jouer mes chansons préférées ».

Google Assistant, quant à lui, prend en charge cette fonction depuis des années, et c’est l’une des caractéristiques qui empêchent les utilisateurs de passer à Gemini. Jusqu’à récemment, le chatbot de Google ne pouvait pas exécuter les commandes liées aux Rappels et à Google Maps.

Gemini va bientôt se doter de réponses en temps réel sur mobile

AssembleDebug rapporte également que Google travaille à l’ajout d’un bouton « Réponses en temps réel ». Cela permettrait à Gemini d’envoyer des réponses en temps réel plutôt que de prendre le temps de les traiter et de les envoyer ensuite.

Il semble que la version actuelle de Gemini soit loin de l’idéal souhaité par Google, mais le rythme auquel Google ajoute de nouvelles fonctionnalités, combiné à la fusion de ses équipes d’intelligence artificielle et de matériel, devrait permettre d’accélérer le développement des fonctionnalités et leur diffusion sur les appareils.

Lire plus
Intelligence Artificielle

L’intégration de Llama 3 de Meta sur Snapdragon : Une nouvelle ère pour l’IA mobile

Qualcomm 1320x880 1

Si vous êtes à la recherche de votre prochain produit phare Android — ou si vous envisagez d’abandonner l’iPhone et d’essayer quelque chose de différent — il y a de fortes chances que votre prochain appareil soit équipé d’une puce Snapdragon, un chipset de la société de semi-conducteurs de renommée mondiale Qualcomm.

Dans un avenir pas si lointain, ceux qui choisissent de rejoindre l’équipe Snapdragon pourraient utiliser le dernier modèle d’IA de Meta : Llama 3.

La semaine dernière, Meta a annoncé que le modèle Llama 3 alimentait le nouvel assistant Meta AI que l’on trouve sur WhatsApp, Instagram, Facebook et Messenger dans certains pays du monde. Le modèle Llama 3 est censé posséder des capacités de raisonnement impressionnantes et une meilleure aptitude à suivre les instructions.

Qualcomm et Meta viennent d’annoncer un partenariat visant à optimiser l’exécution du Llama 3 de Meta directement sur les smartphones, les PC, les casques VR/AR, les véhicules, etc. Cette collaboration permet au nouveau modèle d’IA de fonctionner sur les appareils, offrant des avantages tels qu’une meilleure réactivité, une plus grande confidentialité, une plus grande fiabilité et des expériences personnalisées pour les utilisateurs.

Nous célébrons l’approche ouverte de Meta avec Meta Llama 3, et nous partageons son engagement à donner aux développeurs les moyens d’agir et à stimuler l’innovation en matière d’IA. Notre leadership dans le domaine de l’IA sur les appareils, associé à notre vaste portée sur différents appareils en périphérie, nous permet d’étendre les avantages de l’écosystème Llama dans le monde entier et de permettre aux clients, partenaires et développeurs de créer une nouvelle génération d’expériences révolutionnaires en matière d’IA.

Intégration de Llama 3

C’est ce qu’a déclaré Durga Malladi, Vice-président senior et Directeur général de Qualcomm en charge de la technologie, de la planification et des solutions de périphérie.

Cette collaboration vise à démocratiser l’accès aux capacités d’IA générative en permettant aux OEM et aux développeurs d’intégrer Llama 3 dans les appareils équipés des prochaines plateformes phares Snapdragon. Les développeurs auront accès aux ressources et aux outils nécessaires pour optimiser Llama 3 sur les plateformes Snapdragon grâce au Qualcomm AI Hub, qui propose environ 100 modèles d’IA optimisés.

L’iPhone pourrait bénéficier du soutien de Google en matière d’IA

Alors que les modèles phares d’Android vont intégrer le modèle d’IA de Meta grâce aux futures puces Snapdragon, les prochains iPhone pourraient bénéficier d’un coup de pouce en matière d’IA de la part de… Google. Le mois dernier, nous avons entendu des rumeurs sur le fait qu’Apple était en pourparlers pour obtenir une licence de l’IA Gemini de Google afin d’améliorer Siri et d’ajouter de nouvelles fonctionnalités à iOS.

En bref, Apple serait en pourparlers avec Google pour obtenir une licence de son IA Gemini, dans le but d’améliorer Siri et d’introduire de nouvelles fonctionnalités d’IA dans iOS 18.

Les négociations entre Apple et Google ont progressé, mais tout accord impliquant Gemini nécessiterait probablement l’approbation des organismes de réglementation en raison des enquêtes en cours sur le partenariat existant entre Apple et Google, qui fait de Google le moteur de recherche par défaut sur Safari et qui verserait à Apple près de 20 milliards de dollars par an.

Lire plus