fermer

Intelligence Artificielle

L’intelligence artificielle (IA) transforme de nombreux secteurs, de la santé à la finance, en passant par l’éducation et la sécurité. Explorez comment l’IA est utilisée pour automatiser des tâches, augmenter l’efficacité et créer de nouvelles opportunités de marché.

Nos discussions incluent également les défis éthiques et les implications sociétales de l’adoption de l’IA, fournissant une perspective équilibrée sur ce développement technologique clé.

Intelligence Artificielle

CES 2024 : l’intelligence artificielle en vedette malgré l’absence de Sam Altman

97a1852b 52d3 4362 8404 3393b3291c0e

Sam Altman, à l’origine du boom de l’intelligence artificielle, ne sera pas présent au Consumer Electronics Show (CES) 2024. Pourtant, l’événement devrait présenter les derniers gadgets que les entreprises technologiques les plus importantes peuvent offrir, en se concentrant sur l’engouement pour l’IA dont il est à l’origine, rapporte Reuters.

Wired prédit la même chose pour le bazar technologique le plus important, affirmant que la technologie centrée sur l’IA, en particulier l’IA générative, sera présente au salon plus que jamais, même plus que le CES de l’année dernière. Selon Anshel Sag, analyste principal chez Moor Insights & Strategy, par rapport à 2023, le public n’a pas eu droit à une véritable douche d’annonces sur l’IA au CES.

L’analyste affirme qu’un « tsunami » d’annonces et de présentations de GenAI sera présent au salon.

Maribel Lopez, analyste technologique chez Lopez Research, fait écho à cette notion, affirmant que c’est l’année de l’IA dans tout. Lopez ajoute que les entreprises ne vaudront pas la peine de parler de leurs produits si elles n’utilisent pas l’IA.

Reuters compare l’influence de Sam Altman sur le salon technologique à celle de Steve Jobs, affirmant que l’influence d’Apple et de son fondateur s’est fait sentir malgré l’absence de ce dernier, car de nombreuses entreprises auraient rivalisé pour présenter des appareils fonctionnant avec les produits élégants d’Apple.

L’IA dans tout

Wired ajoute qu’au CES 2024, l’intelligence artificielle sera présente dans tout, des véhicules aux scooters en passant par les écouteurs, les caméras, les haut-parleurs et les téléviseurs. Ces solutions d’IA fourniront des méthodes et des supports supplémentaires pour utiliser des services de questions-réponses de type ChatGPT pour les instructions vocales.

Les avancées en matière d’IA pourraient également être plus significatives, puisque des entreprises telles qu’AMD, Qualcomm et Intel devraient mettre sur le marché des processeurs permettant d’offrir des services d’IA et d’être plus efficaces. La vision par ordinateur, les services de synthèse vocale et l’informatique générative semblent mieux adaptés à ces puces, car Wired affirme qu’elles pourraient exécuter des tâches d’IA localement plutôt que d’envoyer une demande à un serveur dans le nuage et d’attendre ensuite une réponse.

L’entreprise allemande Bosch devrait présenter un dispositif de détection d’armes à feu presque indétectable qui combine l’intelligence artificielle auditive et visuelle pour une sécurité proactive dans les écoles. La société japonaise NEC présentera un logiciel d’intelligence artificielle (IA) qui permet aux appareils mobiles d’évaluer l’état des élèves et les traits du visage afin de prédire les signes vitaux et l’état mental d’une personne.

Les fabricants de PC et de smartphones devraient également montrer comment l’IA est utilisée dans leurs appareils — Microsoft a annoncé que l’événement inclurait des PC dotés d’un nouveau bouton d’intelligence artificielle sur le clavier Windows.

L’IA banalisée

Selon Gary Shapiro, PDG de la Consumer Technology Association, l’organisation qui organise le CES, les gadgets pilotés par l’IA seront salués cette année, mais Shapiro s’attend à ce que cette technologie devienne bientôt banale et passe à l’arrière-plan.

Selon le PDG, l’intelligence artificielle est un élément majeur qui est là pour durer, mais comme pour l’Internet, les entreprises ne se présenteront pas au CES pour distribuer l’Internet. Shapiro ajoute qu’il sera intéressant de voir comment elles utilisent l’IA générative.

Les puces informatiques alimentées par l’IA qui imitent les interactions humaines pourraient être le point fort du CES, mais le rapport indique qu’il y a beaucoup d’autres tendances à surveiller.

Le CES 2024 va se tenir du 9 au 12 janvier à Las Vegas, mais des retransmissions en direct auront lieu dès le lundi 8 janvier, avec de nombreux points de presse parmi les plus connus qui seront diffusés en direct pour le public.

Lire plus
Intelligence Artificielle

Le GPT Store de OpenAI sera lancé la semaine prochaine

lp logo 3.0

OpenAI semble prête à démarrer l’année 2024 en fanfare. La société à l’origine de ChatGPT et sans doute la plus responsable de l’introduction de l’IA générative auprès des masses se prépare à lancer son GPT Store, où les créateurs de GPT personnalisés par des tiers et construits avec le nouveau GPT Builder d’OpenAI pourront vendre et monétiser leurs créations, la semaine prochaine — du 8 au 13 janvier 2024.

OpenAI a envoyé aujourd’hui un e-mail à ceux qui ont déjà créé et lancé des GPT personnalisés par le GPT Builder. Le texte de l’e-mail est le suivant :

Cher développeur de GPT,

Nous tenons à vous informer que nous lancerons le GPT Store la semaine prochaine. Si vous souhaitez partager vos GPT dans la boutique, vous devrez.. :

  • Examiner nos politiques d’utilisation mises à jour et les lignes directrices de la marque GPT pour vous assurer que vos GPT sont conformes.
  • Vérifier votre profil de développeur (settings> builder profile> enable your name or a verified website).
  • Publier votre GPT en tant que « Public » (les GPT pour lesquels l’option « Anyone with a link » est sélectionnée ne seront pas affichés dans la boutique).

Merci d’avoir investi du temps pour construire un GPT.

– L’équipe ChatGPT

La date exacte de lancement, l’heure, la région et la disponibilité des utilisateurs n’ont pas été communiquées, et un porte-parole d’OpenAI s’est contenté de répondre à notre demande par : « Merci de nous avoir contactés. Nous en saurons plus la semaine prochaine ».

Qu’est-ce que le GPT Store et pourquoi est-il si populaire ?

Dévoilé pour la première fois par le PDG et cofondateur d’OpenAI, Sam Altman, et ses compatriotes lors de la conférence des développeurs DevDay d’OpenAI en novembre, le GPT Store a été présenté comme un endroit sur le site Web ChatGPT pour ceux qui construisent avec les outils d’OpenAI afin de gagner de l’argent tout en partageant leurs créations avec un large public.

Vous devez utiliser le GPT Builder d’OpenAI pour construire des GPT personnalisés à partir du puissant Large Language Model (LLM) GPT-4 d’OpenAI, mais cette opération est relativement simple et directe, surtout si on la compare à la programmation d’autres logiciels.

Le GPT Builder d’OpenAI vous permet de saisir les capacités que vous souhaitez que votre GPT offre en langage clair, et il essaiera de créer une version simplifiée de ChatGPT conçue pour exécuter ces fonctions en votre nom ou au nom de tout autre utilisateur avec lequel vous partagez votre GPT. Cela peut se faire à l’aide d’un lien de partage ou de la boutique à venir.

Screen 2024 01 04 21.42.39 jpg

Cela rappelle immédiatement le succès de l’App Store d’Apple pour l’iPhone lancé à l’été 2008, puis pour l’iPad et les appareils Mac, qui a généré des milliards de dollars de recettes annuelles pour les développeurs tiers et, bien sûr, pour Apple elle-même, qui prélève une part de 30 % sur toutes les ventes. Il a également été la cible de procès antitrust intentés par des sociétés telles qu’Epic Games, bien qu’il ait jusqu’à présent largement résisté à ces procès.

Pourtant, à l’instar de l’App Store d’Apple, le GPT Store d’OpenAI n’est pas exempt de controverses.

OpenAI avait initialement promis de le lancer à la fin de l’année 2023, mais s’est retrouvée dans une situation dramatique après que l’ancien conseil d’administration de l’organisation à but non lucratif qui la détenait a brièvement renvoyé Altman avant de le réembaucher et de se retirer lui-même de ses fonctions.

Toute cette agitation — et l’attention démesurée portée au GPT Builder, ainsi qu’une attaque par déni de service distribué (DDoS) signalée sur les serveurs d’OpenAI, ont probablement ralenti le lancement du magasin GPT.

Des questions cruciales demeurent

Mais lorsque le GPT Store d’OpenAI sera finalement lancé, la question clé sera : combien OpenAI prendra-t-elle pour sa part des ventes/souscriptions de GPT personnalisés ? Autre point important : quelles options et mécanismes de tarification seront autorisés, combien les développeurs pourront-ils facturer et cela deviendra-t-il l’App Store de l’ère de l’IA ?

D’ores et déjà, le GPT Store d’OpenAI présente un avantage par rapport aux autres boutiques de logiciels tiers : il ne nécessite pas de compte de développeur ni d’expérience en matière de logiciels pour y participer. Tout ce qu’il faut, c’est une idée et un moyen de la saisir dans le ChatGPT Builder, et bien sûr, un abonnement à ChatGPT Plus ou Enterprise d’OpenAI, qui commence à 20 dollars par mois.

Lire plus
Intelligence Artificielle

Bard de Google évolue : plus intelligent avec Gemini Ultra, mais à quel prix ?

google bard extensions 1 jpg

Le chatbot Bard de Google devrait bientôt bénéficier d’une mise à jour importante. Cette mise à jour améliorera ses capacités de traitement du langage naturel, ce qui lui permettra de générer des conversations encore plus réalistes et attrayantes. Toutefois, il se peut que cette mise à jour ne soit pas disponible gratuitement pour tous les utilisateurs.

La prochaine itération du chatbot, Bard Advanced, sera alimentée par Gemini Ultra, le modèle d’intelligence artificielle de pointe et très avancé de Google. Le lancement très attendu de Gemini Ultra est imminent et promet des avancées révolutionnaires dans le domaine de la compréhension et de la génération de langage naturel.

D’après des informations cachées sur le site Web de Bard, il semblerait que Bard Advanced ne soit pas gratuit pour tous les utilisateurs. Comme l’indique Android Authority, Bedros Pamboukian, développeur et passionné de cybersécurité, est récemment tombé sur d’intrigantes lignes de code suggérant que Bard Advanced offrira une généreuse période d’essai gratuite de trois mois, avec un niveau premium payant une fois la période d’essai terminée.

En outre, Pamboukian a découvert un lien Google One brisé (https://one.google.com/explore-plan/bard-advanced) qui laisse entrevoir un potentiel lien entre Bard Advanced et Google One, le service d’abonnement de Google qui fournit un stockage sur le cloud, une assistance premium et divers avantages. L’inclusion de Bard Advanced dans les plans Google One reste incertaine. Il reste à déterminer s’il sera proposé sous la forme d’un abonnement séparé ou s’il sera intégré au service existant.

Il reste à voir si Google confirmera officiellement ces résultats, mais il semble que le chatbot fasse actuellement l’objet de tests internes. Il semble que l’annonce officielle et le lancement de Bard Advanced auprès du public soient imminents.

L’IA Gemini Pro comme moteur

En décembre, Google a dévoilé Bard Advanced parallèlement à l’introduction de son modèle d’IA Gemini — une collection polyvalente de modèles d’IA qui excellent dans un large éventail de tâches en langage naturel. Le futur Bard Advanced devrait présenter une série de nouvelles fonctionnalités intéressantes, notamment la saisie et la sortie vocales, la prise en charge multilingue et la possibilité d’engager des conversations personnalisées. En outre, il sera capable de couvrir un large éventail de sujets complexes et variés, notamment la politique, la science et le divertissement.

Bard Advanced a le potentiel d’être un chatbot incroyablement impressionnant et révolutionnaire, mais il pourrait y avoir quelques inconvénients à prendre en compte. Il reste à déterminer si les utilisateurs seront prêts à payer pour l’acquérir.

Lire plus
Intelligence Artificielle

Assistant avec Bard : l’évolution attendue de Google Assistant est proche

Email Demo Full 3

Préparez-vous à découvrir un Google Assistant plus intelligent et plus polyvalent. Une plongée dans le code de l’application révèle des détails passionnants sur « Assistant avec Bard », la fusion de l’assistant classique et de la puissante IA de Google, Bard, qui a été annoncée lors de l’événement Made by Google en début d’année.

Alors que Google n’a pas encore annoncé de date de lancement ferme pour son assistant amélioré par l’IA avec Bard, qui devrait complètement remplacer l’expérience existante de l’assistant sur les appareils Android pris en charge, un examen approfondi du code effectué par 9to5Google a révélé que le travail pourrait être presque terminé sur ce projet.

Les résultats révèlent que l’application Google a été mise à jour avec de nouveaux designs, y compris un regard sur sa fenêtre contextuelle et son sélecteur d’onglets. L’entreprise est également en train de peaufiner son widget sur les actions et la finance, récemment lancé.

L’analyse de l’APK a également révélé que Assistant avec l’expérience Bard sera placé en évidence sur la page Découvrir de l’application Google Recherche. Le nouveau bouton rappelle un bouton physique et se trouve en haut de la page, au-dessus du logo Google, plutôt que dans l’actuelle barre inférieure. On ne sait pas si ce bouton est destiné à devenir un élément permanent de l’onglet Découvrir ou un rappel temporaire de découvrir Assistant avec Bard si vous ne l’avez pas encore fait.

9to5Google a également réussi à activer la fenêtre contextuelle que vous utiliserez pour soumettre de nouveaux prompts/questions à Assistant avec Bard. Les trois boutons situés en bas de la fenêtre permettent de taper ou de prononcer un message et/ou de partager une photo avec Assistant. Ce design a été vu pour la première fois dans les premiers aperçus de l’outil d’IA de Google lors de l’événement Pixel 8 en octobre.

Une mise à jour attendue

Google Recherche prépare également un message plus proéminent vous encourageant à mettre à jour votre Assistant pour inclure les fonctionnalités d’IA de Bard. Apparaissant au-dessus de la fiche typique de Assistant, un nouveau popup suggère quelques façons dont Assistant avec Bard peut vous aider.

Assistant avec Bard est conçu pour être accessible de la même manière que l’actuelle version de Assistant, par exemple en appuyant longuement sur le bouton Allumer ou en disant « Hey Google ». Il sera intéressant de voir le produit final et comment il s’articulera avec le reste du système d’exploitation Android ou même le Pixel Launcher une fois qu’il sera mis en ligne.

Lire plus
Intelligence Artificielle

La touche Copilot de Microsoft, une innovation majeure pour les claviers PC en 2024

WIN24 CESRender Copilot RGB 1920

Microsoft souhaite que 2024 soit « l’année de l’IA PC » et donne le coup d’envoi avec un changement important du clavier des nouveaux ordinateurs portables et PC. En effet, Microsoft et ses partenaires PC prévoient d’ajouter une touche « Copilot » à vos claviers PC, ce qui permettra de lancer facilement et intuitivement l’IA Copilot de Microsoft — et d’éviter d’utiliser une solution d’IA d’un concurrent.

Les fabricants de PC semblent se préparer à remplacer l’une des touches existantes du no man’s land situé à droite de la barre d’espacement du PC par une touche qui lancera Copilot sur commande. Actuellement, vous pouvez utiliser le raccourci Win + C.

« Au cours des prochains jours avant et pendant le CES, vous commencerez à voir la touche Copilot sur de nombreux nouveaux PC Windows 11 de nos partenaires de l’écosystème, avec une disponibilité à partir de la fin février jusqu’au printemps, y compris sur les prochains appareils Surface », a écrit Yusuf Mehdi, qui supervise maintenant les activités Windows et Surface après le départ de Panos Panay, dans un article de blog.

Bien sûr, Copilot est disponible sous Windows, et il est maintenant officiellement disponible sur iOS et Android.

D’après les premières impressions des nouveaux PC, la nouvelle touche pourrait potentiellement remplacer la touche « menu » sur certains PC Windows, comme les appareils Microsoft Surface, qui sont rarement utilisés. Elle pourrait également remplacer toute touche « Alt » existant au même endroit, en fonction du fabricant et de la disposition de son clavier. Si Windows Copilot n’est pas encore disponible dans votre pays (pas le cas en France), la touche Copilot lancera Windows Search à la place.

« Le premier changement significatif du clavier Windows PC »

Microsoft se prépare pour 2024 à une refonte de Windows, probablement connue sous le nom de Windows 12, qui s’appuiera fortement sur l’IA. Mehdi s’est fait l’écho de cette attente. « Alors que nous entamons cette nouvelle année, nous sommes remplis d’optimisme et d’excitation », a écrit Mehdi. « Nous continuerons à construire Windows pour qu’il soit la destination des meilleures expériences en matière d’IA. Cela nécessitera un système d’exploitation qui brouille les lignes entre le traitement local et le traitement dans le cloud. L’année à venir promet d’être tout simplement extraordinaire ! ».

Selon Mehdi, l’introduction de la touche Copilot « marque le premier changement significatif du clavier Windows PC depuis près de trois décennies ».

Ce n’est pas tout à fait vrai. Microsoft a elle-même tenté d’inciter les fabricants d’ordinateurs portables à intégrer une touche Cortana à leurs appareils, ce que Toshiba a fait. Malheureusement, l’ajout de la touche Cortana n’a pas été retenu et Toshiba a disparu (dans Sharp), tout comme Cortana elle-même. Quant à la touche Copilot ? Nous verrons bien.

Lire plus
Intelligence Artificielle

Galaxy AI prévu pour briller au prochain Unpacked de Samsung le 17 janvier

Galaxy AI

Plus tôt dans la journée, le compte de Samsung a confirmé la date du prochain Galaxy Unpacked. Ce dernier aura lieu le 17 janvier à 19 heures, heure de Paris, sera la première fois que nous verrons la série Galaxy S24, sur laquelle nous nous attendons à ce que cet Unpacked se concentre.

En plus de la date de son événement Unpacked, le message confirme également que nous verrons les débuts de Galaxy AI. Samsung a déjà annoncé ce nouveau système en novembre. Cependant, il a seulement dit que nous le verrons « au début de l’année prochaine », ce qui nous a fait supposer que nous le verrions avec le lancement du Galaxy S24. Aujourd’hui, grâce à la publication de Samsung, nous sommes sûrs qu’il va s’agir d’un point central de l’annonce.

Vous pouvez voir le teaser du Galaxy AI dans la vidéo ci-dessous :

Samsung Galaxy Unpacked 2024 invite

En outre, dans sa page promotionnelle de l’événement, Samsung indique :

Ouvrez la voie à la nouvelle ère de l’AI*. Libérez votre créativité et votre productivité grâce à l’appareil le plus important de votre vie : votre smartphone.

Dans le clip vidéo, nous voyons le logo de Galaxy AI, qui, de manière intéressante, ressemble beaucoup au logo de Bard de Google. Cependant, il est peu probable qu’il y ait un lien direct entre les deux.

Les petits caractères du clip réaffirment également qu’au moins certaines des fonctionnalités de Galaxy AI nécessiteront une connexion Internet. Pour être clair, Samsung a déjà confirmé qu’au moins certaines fonctions d’IA fonctionneront sur l’appareil, mais que d’autres utiliseront l’informatique sur le cloud — de la même façon que ce dont Google fait avec son Pixel 8 Pro et ses fonctionnalités d’IA.

Une concurrence dans l’IA

Galaxy AI sera basé sur Samsung Gauss, sur lequel nous n’avons que peu d’informations à ce jour. Nous savons qu’il aura trois niveaux (Samsung Gauss Language, Samsung Gauss Code et Samsung Gauss Image) et qu’il est actuellement utilisé pour la « productivité des employés ». Cependant, nous nous attendons à ce que Galaxy AI soit en concurrence directe avec des outils analogues, tels que Bard, Copilot de Microsoft et, bien sûr, ChatGPT.

Lire plus
Intelligence Artificielle

Apple rejoint l’espace open source IA avec le lancement du LLM Ferret

742f2576 de5f 4723 b77e 25a319cad54a

En octobre 2023, des chercheurs d’Apple et de l’université de Columbia ont publié, sans coup de projecteur, un LLM multimodal open source, appelé Ferret. À l’époque, la publication — qui comprenait le code et les poids, mais pour un usage de recherche uniquement, sans licence commerciale — n’a pas suscité beaucoup d’intérêt. Mais aujourd’hui, cela pourrait changer : les modèles open source de Mistral ayant récemment fait la une des journaux et le modèle Gemini de Google arrivant sur le Pixel Pro et éventuellement sur Android, on parle de plus en plus du potentiel des LLM locaux pour alimenter de petits appareils.

Cette discussion s’est intensifiée récemment parce qu’Apple a annoncé qu’elle avait fait une percée clé dans le déploiement des LLM sur les iPhone : l’entreprise a publié deux nouveaux documents de recherche présentant de nouvelles techniques pour les avatars 3D et l’inférence efficace des modèles de langage. Ces avancées ont été saluées comme pouvant permettre des expériences visuelles plus immersives et l’exécution de systèmes d’IA complexes sur des appareils grand public tels que l’iPhone et l’iPad.

De nombreux membres de la communauté de l’IA qui ont remarqué tardivement la sortie de Ferret se sont réjouis de l’entrée inattendue d’Apple dans le paysage du LLM open source, d’autant plus qu’Apple est traditionnellement connu pour être un « jardin clos ».

Il y a quelques jours, Bart de Witte, qui dirige une association européenne à but non lucratif axée sur l’IA open source en médecine, a publié un message sur X : « J’ai en quelque sorte manqué cela », a-t-il écrit. « Apple a rejoint la communauté de l’IA open source en octobre. L’introduction de Ferret témoigne de l’engagement d’Apple en faveur d’une recherche sur l’IA ayant un impact, consolidant ainsi sa place de leader dans l’espace de l’IA multimodale… ps : J’attends avec impatience le jour où les Local Large Language Models (LLLM) fonctionneront sur mon iPhone en tant que service intégré à un iOS repensé ».

Le blogueur technologique Ben Dickson a quant à lui écrit sur LinkedIn : « Quel est le développement de l’IA en 2023 que vous attendiez le moins ? Pour moi, c’est Apple qui a publié des LLM open source (bien qu’avec une licence non commerciale) ». Apple, ajoute-t-il, « a longtemps été le parangon des systèmes fermés, du développement en jardin clos, du secret, des accords de confidentialité à toute épreuve, de la divulgation de zéro détail et du brevetage de la moindre parcelle de ses produits ».

Un changement pour Apple

Mais rétrospectivement, poursuit-il, « il est logique pour Apple (comme pour Meta) d’entrer sur le marché du LLM avec des modèles open source. Pour rivaliser avec des modèles comme ChatGPT, il faut être un hyperscaler ou être en partenariat avec un hyperscaler. Apple a peut-être beaucoup de ressources, mais son infrastructure n’est pas conçue pour servir les LLM à grande échelle. L’alternative serait de devenir dépendant d’un fournisseur de cloud comme Microsoft ou Google (deux ennemis acharnés) ou de commencer à publier ses propres modèles open source, à la manière de Meta ».

Il est intéressant de noter que les nouvelles concernant les développements de machine learning locaux et open source d’Apple surviennent alors qu’Anthropic et OpenAI seraient en train de négocier de nouvelles levées de fonds massives pour leurs efforts de développement LLM propriétaires. Reuters a rapporté mercredi que Anthropic est en discussion pour lever 750 millions de dollars auprès de Menlo Ventures, tandis que Bloomberg a rapporté hier qu’OpenAI « est en discussions préliminaires pour lever un nouveau cycle de financement à une valeur égale ou supérieure à 100 milliards de dollars ».

Lire plus
Intelligence Artificielle

Google Bard : l’IA qui simplifie et dynamise le développement logiciel pour 2024

7649e417 a643 4e88 be2f 6c37dc64ae46

Le paysage du développement logiciel est en pleine effervescence avec les progrès de l’intelligence artificielle, de l’informatique sur le cloud et de l’automatisation.

Les développeurs, architectes infatigables de notre monde numérique, s’adaptent en permanence pour garder une longueur d’avance. Et s’il existait un moyen de simplifier leur charge de travail, de rationaliser leurs processus et de libérer leur potentiel créatif ?

Voici Google Bard, le compagnon de codage innovant qui devrait révolutionner le développement de logiciels au cours de l’année à venir.

Bard : au-delà des mots à la mode

Bard n’est pas un simple mot à la mode : il s’agit d’un vaste modèle de langage développé par Google et entraîné sur un ensemble massif de données de texte et de code. Cela lui permet de comprendre les subtilités du langage humain, les nuances des langages de programmation et la logique complexe qui sous-tend le développement de logiciels.

Contrairement à un simple outil de complétion de code, Google Bard est un partenaire collaboratif, un sherpa numérique qui guide les développeurs sur le terrain inconnu des projets complexes.

La symphonie de la collaboration

Imaginez un peu : vous êtes bloqué sur un problème de codage particulièrement épineux. Vous avez passé des heures à déboguer, la frustration monte et l’échéance se profile à l’horizon. C’est alors que vous vous adressez à Bard. Vous décrivez votre problème dans un langage simple et Bard vous écoute attentivement. Il analyse votre code, suggère des solutions potentielles et génère même des bouts de code à tester. C’est comme si un développeur chevronné vous chuchotait des conseils avisés à l’oreille, vous guidant vers l’insaisissable solution.

C’est la symphonie de la collaboration qu’orchestre Bard. Elle amplifie vos forces, en comblant les lacunes de vos connaissances. Il peut :

  • Comprendre vos besoins : expliquez les objectifs de votre projet et Bard en saisira les fonctionnalités essentielles, en vous suggérant des bibliothèques, des frameworks et des meilleures pratiques.
  • Démystifier le code : vous êtes bloqué sur un bug ? Bard peut analyser votre code, signaler les potentielles erreurs et même suggérer des corrections.
  • Générer du code standard : libérez-vous de la fastidieuse tâche d’écrire du code répétitif. Bard peut créer du code de base, ce qui vous permet de vous concentrer sur la logique de base.
  • Offrir des perspectives diverses : vous êtes coincé dans une ornière de codage ? Bard peut suggérer des approches alternatives, en s’inspirant d’un vaste répertoire de projets open source et de forums de développeurs.
  • Rédiger une documentation complète : Plus besoin de se démener pour documenter votre code. Bard peut générer automatiquement une documentation claire et concise, ce qui vous permet de gagner un temps précieux et d’assurer la maintenabilité du projet.

Au-delà des corrections de bugs : libérer la créativité

Mais les capacités de Bard vont bien au-delà de la correction de bugs et de l’achèvement du code. C’est un catalyseur créatif qui repousse les limites du développement logiciel. Il peut :

  • Prototyper rapidement : vous avez besoin de tester rapidement une nouvelle idée ? Bard peut vous aider à construire des prototypes de base, vous permettant d’itérer et d’affiner votre concept avant de plonger dans un développement complet.
  • Générer des interfaces utilisateur créatives : vous êtes bloqué sur la conception d’une interface utilisateur ? Bard peut vous suggérer des mises en page innovantes, des palettes de couleurs et des éléments interactifs, afin de stimuler votre créativité.
  • Écrire des tests unitaires sans effort : vous redoutez la corvée d’écriture des tests unitaires ? Bard peut générer automatiquement des tests complets, garantissant la robustesse et la qualité de votre code.
  • Collaborez avec diverses équipes : comblez le fossé de la communication entre les développeurs, les designers et les chefs de produit. Bard peut traduire le jargon technique en anglais simple et vice versa, garantissant ainsi une collaboration sans faille.

L’avenir du développement : les humains et l’IA en harmonie

ffe79456 daca 4bff bad4 df2c97d8d11e

L’essor de l’IA dans le développement de logiciels ne signifie pas que les développeurs humains vont sombrer dans la sinistrose. Au contraire, c’est l’occasion de travailler plus intelligemment, et non plus durement. Bard responsabilise les développeurs en les libérant des tâches banales et répétitives, ce qui leur permet de se concentrer sur les aspects véritablement créatifs du développement logiciel. Il s’agit d’une relation symbiotique où l’ingéniosité humaine et la puissance de traitement de l’IA se combinent pour créer des expériences logicielles remarquables.

Accepter le changement : se préparer à un avenir alimenté par Bard

Alors, comment pouvez-vous, en tant que développeur, vous préparer à cet avenir alimenté par l’IA ?

Voici quelques conseils :

  • Adopter l’apprentissage tout au long de la vie : à mesure que les outils d’IA évoluent, l’apprentissage continu devient crucial. Tenez-vous au courant des dernières avancées en matière d’IA et des capacités de Bard pour en exploiter tout le potentiel.
  • Mettez l’accent sur les compétences non techniques : Si Bard peut se charger des tâches techniques, de solides compétences en matière de communication, de collaboration et de résolution de problèmes resteront essentielles dans les équipes de développement humain-IA de demain.
  • Expérimentez et explorez : n’ayez pas peur d’expérimenter les fonctionnalités de Bard. Jouez, repoussez les limites et découvrez comment il peut rationaliser votre workflow et stimuler votre créativité.

Résumé

L’année 2024 marque l’avènement d’une nouvelle ère dans le développement de logiciels, où les humains et l’IA collaborent dans une symphonie de créativité et d’efficacité. Bard, le compagnon de codage, se trouve à l’avant-garde de cette révolution, prêt à donner du pouvoir aux développeurs et à remodeler le tissu même de la création de logiciels.

Adoptez le changement, explorez les possibilités et libérez l’immense potentiel qui se trouve à l’intersection de l’ingéniosité humaine et de l’IA.

Lire plus
Intelligence Artificielle

Midjourney V6 : un pas de géant pour les créateurs d’images

aed6174d 029a 4067 a23a ca351dc241c6

C’était un cadeau pour les fêtes de fin d’année. L’arrivée de la version 6 de Midjourney a suscité l’enthousiasme de tous ceux qui créent et manipulent des images numériques. Cette version alpha est le fruit de 9 mois de développement, et elle apporte une foule de nouvelles fonctionnalités qui promettent d’améliorer la qualité et la complexité des images que vous pouvez produire. Pour ceux qui attendaient cette mise à jour avec impatience, le moment est venu de se plonger dans les nouvelles fonctionnalités et de voir à quel point vous pouvez mieux contrôler votre production créative.

Pour tirer le meilleur parti de la version 6 de Midjourney, il est essentiel de se familiariser avec les nouvelles commandes qui ont été introduites. Ces commandes sont conçues pour être conviviales, mais il faut s’y habituer. Une fois que vous les aurez maîtrisées, vous constaterez que la création d’images d’une clarté et d’un détail époustouflants est plus simple que jamais.

L’amélioration de la qualité par rapport à la version précédente est immédiatement visible. Les images produites sont désormais plus nettes, avec un texte plus précis et des détails plus fins, grâce à des algorithmes et à une puissance de traitement améliorés. Il s’agit d’une avancée significative par rapport à la version 5.2, que les utilisateurs ne manqueront pas d’apprécier.

Pour en savoir plus sur les nouvelles commandes et fonctionnalités de Midjourney 6, consultez la présentation, le tutoriel et la démonstration ci-dessous, créés par Future Tech Pilot.

Pour ceux qui aiment peaufiner leurs prompts, la nouvelle version a également mis à jour les techniques de prompts. Cela signifie que vous devrez adapter votre approche pour tirer le meilleur parti du système. Cela peut demander un peu d’expérimentation, mais une fois que vous l’aurez maîtrisé, vous serez en mesure de créer des images complexes avec des couleurs riches et des éléments complexes qui semblaient auparavant hors de portée.

Que le début

Imaginez un portrait ou une scène d’action ; la version 6 de Midjourney garantit la cohérence de vos personnages dans tous les styles. Que vous recherchiez un aspect photoréaliste ou quelque chose de plus abstrait, le logiciel conserve les caractéristiques uniques de vos sujets.

L’ajout de fonctionnalités telles que les options de mise à l’échelle et les variations vous donne encore plus de liberté créative. L’augmentation de la résolution de vos images est désormais un processus simple, et la fonction de variations vous permet d’explorer différentes interprétations de votre idée initiale.

Alors que vous commencez à explorer tout ce que la version 6 de Midjourney a à offrir, n’oubliez pas que ce n’est que le début. Il est conseillé de se tenir au courant des futurs tutoriels et versions pour s’assurer d’être toujours à la pointe de la technologie en matière de génération d’images. Cela vous aidera à continuer à développer vos compétences et à vous préparer à n’importe quel projet créatif.

La sortie de la version 6 de Midjourney est un moment important pour tous ceux qui sont impliqués dans la génération d’images, qu’ils soient passionnés ou professionnels. Le nouveau niveau de contrôle, la qualité améliorée et les fonctionnalités innovantes marquent le début d’un nouveau chapitre passionnant pour les créateurs. En adoptant les nouvelles commandes et techniques, vous pouvez porter votre créativité à de nouveaux sommets avec Midjourney Version 6.

Lire plus
Intelligence Artificielle

COLE combine plusieurs IA pour générer des dessins modifiables à la demande

0d7194f1 71fd 4bcd b563 61950cd9ceda

Avis aux graphistes et à ceux qui en dépendent : un nouvel outil est apparu, qui pourrait bien bouleverser la profession pour de bon.

Baptisé COLE, en l’honneur d’Henry Cole, reconnu comme le créateur de la première carte de Noël graphique en 1843, ce nouvel outil permet aux utilisateurs de saisir une idée de projet de conception graphique, et de demander à une IA de générer non seulement l’image, mais aussi le texte qui l’accompagne, le tout intégré.

COLE est en fait une combinaison de différents modèles d’IA, notamment des versions affinées de Llama2-13B de Meta, DeepFloyd IF, LLaVA1.5-13B (lui-même une variante de Llama) et GPT-4V, ainsi que le moteur de rendu graphique open source Skia. Il a été développé par une équipe de 12 chercheurs de Microsoft Research Asia et de l’Université de Pékin.

La combinaison de différents modèles a été choisie en raison de la complexité de la conception graphique et de la pénurie de données de formation disponibles sur l’un des principaux formats du domaine, à savoir les fichiers .SVG. Les chercheurs ont donc opté pour une approche différente : « consolider tous les éléments SVG et les embellissements supplémentaires dans une couche d’image unifiée », puis demander à l’IA d’extraire la couche d’arrière-plan et de la décrire sous forme de texte.

L’équipe COLE a formé son modélisateur d’arrière-plan à l’IA sur « 100 000 images graphiques brutes de haute qualité provenant d’Internet ».

Un framework, pas un produit… pour l’instant

Pour l’instant, COLE s’apparente davantage à un framework qu’à un produit. Mais, les résultats que l’équipe a obtenus en entraînant et en combinant ces différents produits d’IA au service de la conception graphique sont assez stupéfiants : il suffit de taper des invites textuelles, comme le font d’autres générateurs texte-image actuels tels que DALL-E 3 d’OpenAI ou Midjourney, pour que COLE soit capable de générer des conceptions graphiques nettes, organisées et combinant des images et du texte stylisé.

Ce dernier produit n’est pas une mince affaire : la plupart des générateurs d’art IA, y compris les leaders tels que Midjourney et Stable Diffusion, ont eu du mal à intégrer du texte dans l’image. DALL-E 3 peut produire du texte intégré, mais il n’est pas précis à 100 %.

Plus impressionnant encore, COLE produit des images avec des blocs éditables distincts pour les textes et les objets au sein de l’image.

Screen 2023 12 02 14.11.28 jpg

Cela permet aux programmes d’IA en chaîne de produire une image à partir de zéro et, si l’utilisateur humain n’aime pas le résultat final, il n’a pas besoin de revenir en arrière et d’essayer de réviser l’ensemble de la conception, ni de l’exporter vers un autre programme tel qu’Adobe Photoshop ou InDesign pour effacer certains éléments et en introduire d’autres.

Ils peuvent le faire à l’intérieur même du framework COLE, en cliquant sur la zone de texte pour modifier le texte affiché ou la police, ainsi qu’en tapant de nouvelles invites pour différents éléments visuels, transformant un sac d’épicerie d’une image photoréaliste en un dessin animé, par exemple.

Des résultats compétitifs et prometteurs

En outre, les chercheurs ont montré que les résultats produits par COLE sont « d’une qualité très compétitive… même par rapport au dernier DALL-E 3“.

Les chercheurs ont testé COLE sur 200 projets de conception graphique différents, allant de la publicité à la promotion d’événements et au matériel de marketing, en publiant ici toutes les invites qu’ils ont utilisées dans une feuille de calcul.

En outre, COLE « atteint la meilleure qualité lors de la création de couvertures, d’en-têtes ou d’affiches » et est bien entendu plus performant que DALL-E 3 et d’autres logiciels concurrents lorsqu’il s’agit de modifier des éléments spécifiques de l’image, tels que du texte ou des objets distincts.

Cependant, COLE n’est pas une solution miracle pour la conception graphique — du moins, pas encore. Le système ne permet pas aux utilisateurs de modifier la « disposition » ou l’emplacement de ses blocs typographiques, il ne permet pas encore de placer plusieurs blocs typographiques et il n’autorise qu’une seule couleur de typographie par image. Cependant, les chercheurs écrivent « qu’aborder ces questions est une direction que nous aimerions poursuivre dans nos travaux futurs ».

Pour l’instant, COLE n’est pas accessible au public, mais les chercheurs affirment qu’une démo sera bientôt disponible sur la page Web de leur projet GitHub.

Lire plus
Intelligence Artificielle

GatorTronGPT : l’IA qui écrit des notes médicales indiscernables de celles des médecins humains

f35a39a9 4af3 4d1d a113 a45cdc89e552

Imaginez un système d’intelligence artificielle si perfectionné qu’il peut créer des notes médicales avec une telle précision que même des médecins expérimentés se trompent en pensant qu’elles ont été écrites par un collègue. Cette scène n’est pas tirée d’un roman de science-fiction ; elle se déroule actuellement à l’université de Floride (UF).

Des chercheurs de l’UF, en collaboration avec NVIDIA, ont développé GatorTronGPT, un programme d’IA qui modifie la façon dont la documentation médicale est traitée.

La création de GatorTronGPT marque une avancée significative dans le domaine de l’IA. Ce modèle innovant a été entraîné sur un vaste ensemble de données, qui comprend 82 milliards de mots provenant de dossiers de patients anonymes de l’UF Health. Pour s’assurer que l’IA puisse comprendre les complexités du langage médical et des soins aux patients, les chercheurs ont ajouté 195 milliards de mots supplémentaires. Le résultat est une IA capable de reproduire les compétences des médecins en matière de rédaction de notes avec une précision remarquable.

Au cœur de GatorTronGPT se trouve GPT-3 d’OpenAI, le framework d’IA de pointe connu pour générer des textes qui ressemblent beaucoup à l’écriture humaine. Cela s’avère particulièrement utile lorsqu’il s’agit de traiter la terminologie spécialisée que l’on trouve dans les dossiers médicaux. L’une des principales caractéristiques de GPT-3, et par extension de GatorTronGPT, est l’importance qu’il accorde à la protection de la vie privée, en veillant à ce que les informations sensibles des patients restent protégées.

Le développement de GatorTronGPT est un élément clé de l’initiative plus large de l’UF visant à intégrer l’IA dans ses différentes disciplines académiques. L’université s’est engagée à tirer parti de l’IA pour améliorer différents secteurs, dont celui des soins de santé. En intégrant l’IA dans la documentation médicale, l’UF ouvre la voie à une nouvelle frontière dans l’innovation en matière de soins de santé.

Pour entraîner une IA aussi complexe que GatorTronGPT, il faut une puissance de calcul considérable. C’est là que le superordinateur HiPerGator de l’UF entre en jeu. Avec le soutien de NVIDIA, le superordinateur fournit les capacités robustes nécessaires pour gérer les grands ensembles de données et les algorithmes sophistiqués qui font partie du processus de formation de l’IA.

Rationaliser la documentation des soins de santé

67917369 5bd0 493b b457 4a654a7fd35d

L’un des aspects les plus intéressants de GatorTronGPT est sa capacité à rationaliser la documentation des soins de santé. L’IA peut automatiser la création de notes médicales, en élaborant des documents presque identiques à ceux rédigés par des cliniciens humains. Cette innovation devrait permettre aux professionnels de la santé de gagner un temps précieux et de réduire l’épuisement professionnel, ce qui leur permettra de se concentrer davantage sur les soins aux patients.

Le succès de GatorTronGPT témoigne de la puissance de la recherche collaborative. Le projet a rassemblé 14 membres du corps enseignant de l’UF et de l’UF Health, couvrant un large éventail de disciplines. Cette collaboration met en évidence la nature interdisciplinaire de la recherche en IA, en particulier dans le domaine de la médecine.

Le financement du projet provient de plusieurs sources, dont le Patient-Centered Outcomes Research Institute, le National Cancer Institute et le National Institute on Aging. La diversité de ces sources de financement souligne le potentiel reconnu de l’IA pour améliorer de manière significative les soins aux patients et l’efficacité des services de santé.

GatorTronGPT est un excellent exemple de la manière dont l’IA peut être adaptée pour répondre aux besoins spécifiques du secteur de la santé. Sa capacité à générer des notes médicales qui ne se distinguent pas de celles rédigées par des médecins humains n’est pas seulement une réalisation technologique impressionnante ; c’est le signe d’un avenir plus efficace pour la documentation des soins de santé.

Lire plus
Intelligence Artificielle

2023 a été l’année de l’IA : voici les 7 moments qui l’ont définie

82b7f02a 4257 49d3 af19 2d82203dc46d

ChatGPT a peut-être été lancé à la fin de l’année 2022, mais 2023 a sans aucun doute été l’année où l’IA générative s’est imposée dans l’esprit du public.

Non seulement le ChatGPT a atteint de nouveaux sommets (et de nouveaux bas), mais une pléthore de changements sismiques ont secoué le monde, des produits rivaux incroyables aux scandales choquants, en passant par tout ce qui se trouve entre les deux.

Alors que l’année touche à sa fin, revenons sur les 7 événements les plus importants de l’IA qui se sont déroulés au cours des 12 derniers mois. Cette année n’a pas été comme les autres pour l’IA — voici tout ce qui l’a rendue mémorable, en commençant par le début de l’année 2023.

Les rivaux de GPT se précipitent sur le marché

Aucune liste de ce type ne commence sans l’ascension sans précédent de ChatGPT. Le chatbot gratuit d’OpenAI a pris le monde d’assaut, se développant rapidement et captant l’imagination de tout le monde, des leaders de la technologie aux personnes ordinaires dans la rue.

Le service a été lancé en novembre 2022, mais il a commencé à se développer au cours des premiers mois de l’année. Le succès fulgurant de ChatGPT a laissé ses rivaux dans l’embarras pour trouver une réponse. Personne n’était plus terrifié que Google, semble-t-il, qui craignait que l’IA ne rende sa lucrative activité de recherche pratiquement obsolète. En février, quelques mois après l’entrée en bourse de ChatGPT, Google a riposté en lançant Bard, son propre chatbot IA. Puis, un jour plus tard, Microsoft a dévoilé sa propre tentative avec Bing Chat.

chatgpt quest ce que cest et com jpg

Les choses se sont un peu gâtées pour Bing Chat, le chatbot étant sujet à ce que l’on a appelé des « hallucinations », c’est-à-dire des incidents au cours desquels il mentait, inventait de faux faits et, de manière générale, n’était pas fiable.

Les choses se sont un peu mieux passées pour Google Bard — il n’était pas aussi conflictuel et évitait complètement l’utilisation dérangée d’emojis par Bing Chat — mais il avait toujours tendance à ne pas être fiable. Les réponses rapides de Google et de Microsoft à ChatGPT ont montré à quel point leurs tentatives étaient précipitées et à quel point le penchant de l’IA pour la désinformation pouvait être dangereux.

GPT-4 fait parler de lui

Lorsque ChatGPT a été lancé, il était alimenté par un Large Language Model (LLM) appelé GPT-3.5. Ce modèle était très performant, mais présentait certaines limites, comme le fait de ne pouvoir utiliser que du texte comme méthode d’entrée. Une grande partie de cette situation a changé avec GPT-4, qui a été rendu public en mars.

Le développeur de ChatGPT, OpenAI, a déclaré que le nouveau LLM GPT-4 était meilleur sur trois points essentiels : la créativité, l’entrée visuelle et un contexte plus long. Par exemple, GPT-4 peut utiliser des images en entrée et peut également collaborer avec les utilisateurs sur des projets créatifs tels que la musique, les scénarios et la littérature.

À l’heure actuelle, GPT-4 est uniquement disponible derrière un abonnement payant à ChatGPT Plus, qui coûte 20 dollars par mois. Mais même avec cette portée limitée, il a eu un impact considérable sur l’IA. Lorsque Google a annoncé son LLM Gemini en décembre, il a affirmé qu’il était capable de battre GPT-4 dans la plupart des tests. Pourtant, le fait qu’il n’ait pu le faire qu’à quelques points de pourcentage près d’un an après le lancement de GPT-4 vous dit tout ce que vous devez savoir sur l’avancée du modèle d’OpenAI.

Les images générées par l’IA commencent à tromper le public

Peu d’incidents ont illustré le pouvoir de l’IA pour tromper et désinformer autant qu’une seule image publiée au début de l’année 2023 : celle du pape François vêtu d’un grand blouson blanc.

FsEy5bVWcAAs4xN jpg

Cette image improbable avait été créée par un certain Pablo Xavier à l’aide de l’IA Midjourney, mais elle était si réaliste qu’elle a facilement trompé un grand nombre de spectateurs sur les réseaux sociaux. Cela a mis en évidence le caractère convaincant des générateurs d’images d’IA et leur capacité à tromper les gens et à leur faire croire des choses qui ne sont pas réelles.

En fait, la semaine précédant l’apparition de l’image du pape, une autre série d’images a fait la une des journaux pour une raison analogue. Elles montraient l’ancien président Donald Trump en train de se faire arrêter, de se battre avec des policiers et de purger une peine de prison. Lorsque des générateurs d’images puissants sont associés à des sujets sensibles, qu’ils soient liés à la politique, à la santé, à la guerre ou à d’autres domaines, les risques peuvent être extrêmes. Alors que les images générées par l’IA deviennent de plus en plus réalistes, la création du pape François est un exemple amusant de la rapidité avec laquelle nous devrions tous améliorer notre éducation aux médias.

Les images générées par l’IA sont devenues de plus en plus courantes tout au long de l’année, apparaissant même dans les résultats de recherche de Google avant les images réelles.

Une pétition commence à tirer la sonnette d’alarme

L’IA a progressé à une telle vitesse — et a déjà eu des conséquences si alarmantes — que de nombreuses personnes ont exprimé de sérieuses inquiétudes quant à ce que l’IA pourrait engendrer. En mars 2023, ces craintes ont été exprimées par certains des plus éminents leaders technologiques du monde dans une lettre ouverte.

Cette lettre appelait « tous les laboratoires d’IA à interrompre immédiatement, pendant au moins 6 mois, la formation de systèmes d’IA plus puissants que le GPT-4 », afin de donner à la société dans son ensemble le temps d’évaluer les risques. Dans le cas contraire, le développement à grande échelle de l’IA pourrait « poser des risques profonds pour la société et l’humanité », notamment la potentielle destruction d’emplois, l’obsolescence de la vie humaine et la « perte de contrôle de notre civilisation ».

La lettre a été signée par les leaders de la technologie, du cofondateur d’Apple, Steve Wozniak, au patron de Tesla, Elon Musk, en passant par une série de chercheurs et d’universitaires. Quant à savoir si les entreprises spécialisées dans l’IA ont pris conscience de l’importance des potentiels bénéfices à court terme, c’est une autre affaire — il suffit de regarder Google Gemini, qui, selon ses créateurs, surpasse GPT-4. Espérons que cette lettre ne se révélera pas prophétique.

ChatGPT se connecte à l’Internet

Lors de son lancement, ChatGPT s’est appuyé sur son énorme réservoir de données de formation pour aider à fournir des réponses aux gens. Le problème, c’est que ces données ne pouvaient pas être mises à jour et qu’elles étaient peu utiles si quelqu’un voulait les utiliser pour réserver un restaurant ou trouver un lien pour acheter un produit.

Tout a changé lorsque OpenAI a annoncé une série de plugins qui aideraient ChatGPT Plugins pouvant se connecter à l’Internet. Soudain, une nouvelle façon d’utiliser l’IA pour faire avancer les choses s’est ouverte. Ce changement a également permis d’actualiser et d’élargir considérablement les possibilités du chatbot par rapport à ce qu’il était auparavant. En termes de capacité et d’utilité, il s’agissait d’une amélioration considérable.

Mais ce n’est qu’en mai que ses capacités de navigation ont été étendues lorsque le plugin Browsing through Bing a été annoncé lors de la conférence des développeurs Microsoft Build. Le déploiement a été lent jusqu’en septembre, lorsqu’il est devenu disponible pour tous les utilisateurs de ChatGPT Plus.

Windows se dote d’un nouveau Copilot

Microsoft a lancé Bing Chat au début de l’année, mais l’entreprise n’est pas restée inactive. Elle a enchaîné avec Copilot, une utilisation beaucoup plus étendue de l’IA qui a été incorporée dans les produits de Microsoft, et qui a d’abord été annoncée pour Microsoft 365 Copilot.

Copilot Microsoft jpg

Alors que Bing Chat était un simple chatbot, Copilot est davantage un assistant numérique. Il est intégré à plusieurs applications Microsoft, comme Word et Teams, ainsi qu’à Windows 11 lui-même. Il peut créer des images, résumer des réunions, trouver des informations et les envoyer à vos autres appareils, et bien d’autres choses encore. L’idée est de vous faire gagner du temps et de l’énergie sur des tâches longues en les automatisant pour vous. En fait, Bing Chat a même été intégré à Copilot en novembre.

En intégrant Copilot aussi étroitement dans Windows 11, Microsoft a non seulement indiqué sa philosophie en matière d’IA, mais a également relégué au second plan Apple et son système d’exploitation rival macOS. Jusqu’à présent, l’avantage revient à Microsoft, surtout si l’on considère le lancement de Windows 12 en 2024.

La saga de Sam Altman

Sam Altman, PDG d’OpenAI, a été le visage très visible de toute l’industrie de l’IA depuis que ChatGPT a explosé dans la conscience du monde. Pourtant, tout s’est effondré un jour de novembre lorsqu’il a été renvoyé sans ménagement d’OpenAI, à sa plus grande surprise et à celle du monde entier.

Le conseil d’administration d’OpenAI l’a accusé de ne pas avoir été « toujours franc » dans ses relations avec l’entreprise. La réaction a été rapide et forte, la majorité des employés de l’entreprise menaçant de démissionner si Altman n’était pas réintégré. Microsoft, investisseur d’OpenAI, a proposé des emplois à Altman et à tous les autres employés d’OpenAI qui le souhaitaient, et pendant un moment, il a semblé que la société de Altman était sur le point de s’effondrer.

1x 1 1 jpg
Dustin Chambers/Bloomberg

Puis, aussi rapidement qu’il était parti, Altman a été réintégré, de nombreux membres du conseil d’administration exprimant leurs regrets pour l’ensemble de l’incident. L’Internet a suivi en temps réel le déroulement des événements, avec une question singulière en filigrane de tout ce cirque : pourquoi ? Altman est-il vraiment tombé sur un développement de l’IA qui posait de sérieux problèmes éthiques ? Le projet était-il sur le point d’aboutir à l’AGI ? Y avait-il une lutte pour le pouvoir digne de Game of Thrones, ou Altman était-il simplement un mauvais patron ?

Nous ne connaîtrons peut-être jamais toute la vérité. Mais aucun autre moment de 2023 n’a résumé l’hystérie, la fascination et l’esprit de conspiration suscités par l’IA cette année.

Lire plus
Intelligence Artificielle

Le New York Times poursuit OpenAI et Microsoft pour violation du droit d’auteur

9caafe33 8336 47ac 8b52 c111a82e267c

Le New York Times a intenté une action en justice contre OpenAI et Microsoft pour avoir violé ses droits d’auteur afin d’entraîner les modèles d’IA de ChatGPT.

C’est la première fois qu’un grand journal américain s’attaque à OpenAI et à son principal partenaire financier, Microsoft. Cela pourrait constituer un précédent crucial dans la manière dont l’industrie de l’IA traitera le développement de l’IA générative dans les années à venir.

Le 27 décembre 2023, le New York Times a intenté une action en justice devant la Cour fédérale de district de New York, alléguant qu’OpenAI avait utilisé des millions d’articles du Times pour entraîner ses modèles d’IA. Le Times a ajouté qu’il s’agissait d’une utilisation non autorisée de travaux publiés, sans paiement de droits de licence. Dans le procès, le NYT a montré 100 exemples de GPT-4 mémorisant le contenu textuellement à partir des articles du Times.

GPT-4 n’a pas attribué le contenu à la source. Il est intéressant de noter que le New York Times a tenté de parvenir à un accord négocié avec OpenAI en avril et au cours des mois suivants, mais que cet accord n’a abouti à rien. Le New York Times a donc dû intenter une action en justice pour avoir utilisé des œuvres protégées par le droit d’auteur afin d’entraîner les chatbots d’IA.

L’action en justice ne fixe pas de montant pour les dommages, mais affirme que OpenAI et Microsoft devraient payer des « milliards » pour l’utilisation illégale de leur précieux travail. L’organe de presse affirme que cette situation entraîne une perte de revenus car les potentiels clients sont dissuadés de souscrire un abonnement, tandis que les revenus générés par les visites sur son site Web sont également perdus.

Une bataille juridique intéressante

Dans une déclaration officielle partagée avec The Verge, un porte-parole d’OpenAI a déclaré :

Nos conversations en cours avec le New York Times ont été productives et ont progressé de manière constructive, c’est pourquoi nous sommes surpris et déçus par ce développement. Nous espérons que nous trouverons un moyen mutuellement bénéfique de travailler ensemble, comme nous le faisons avec de nombreux autres éditeurs.

Maintenant que la plainte a été déposée, il semble que le développement de l’IA générative pourrait se heurter à un autre obstacle, en plus des obstacles réglementaires accrus. Les conséquences seront plus importantes non seulement pour OpenAI et Microsoft, mais aussi pour l’ensemble de l’industrie de l’IA et le journalisme tel que nous le connaissons.

Lire plus
Intelligence Artificielle

Apple planifie de former un chatbot d’IA avec des contenus de médias réputés

22730ee5 77a6 4ef7 8320 cac52f50e092

Selon le New York Times, Apple a discuté de « contrats pluriannuels d’une valeur d’au moins 50 millions de dollars » avec des éditeurs de presse tels que NBC News, Condé Nast (éditeur de Vogue et The New Yorker) et IAC (éditeur de People, Better Homes and Gardens et The Daily Beast).

Apple souhaite utiliser le contenu de ces organismes de presse pour former un chatbot d’IA générative.

À titre informatif, OpenAI aurait conclu des accords avec l’agence de presse Associated Press et la société mère de Politico pour aider à former ChatGPT. De son côté, Google a déclaré qu’elle travaillait sur des outils alimentés par l’IA pour aider les journalistes.

Apple tente de rattraper son retard en matière d’IA générative et dépenserait des millions de dollars par jour dans ce domaine. Apple a de grands projets en matière d’IA et des rapports indiquent que le géant de la technologie travaille sur une version améliorée de l’assistant virtuel Siri pour iOS 18, ce qui devrait réjouir les utilisateurs d’iPhone. L’entreprise espère également ajouter de nouvelles fonctionnalités d’IA à l’iPhone avec iOS 18.

De nombreux utilisateurs d’iPhone aimeraient voir Apple réorganiser Siri à l’aide d’une technologie basée sur l’IA. Malgré l’avantage d’avoir introduit Siri sur l’iPhone 4 s en 2011, l’assistant virtuel est resté à la traîne par rapport à Google Assistant et Alexa d’Amazon.

La réponse des éditeurs semble mitigée

Les éditeurs de presse visés par la rumeur ne sont pas tous ravis de voir leurs archives utilisées pour entraîner l’IA générative, même si cela signifie pour eux une grosse somme d’argent grâce à Apple. Selon le Times, les éditeurs intéressés par un accord avec Apple pourraient craindre de s’exposer à des poursuites judiciaires en cas d’utilisation de leur contenu par Apple. Cette réaction pourrait s’expliquer en partie par le fait qu’Apple est resté vague sur ses projets en matière d’IA. Toutefois, d’autres responsables de l’information se sont montrés plus positifs quant à la possibilité d’un partenariat avec Apple.

Les dirigeants d’Apple auraient cherché à savoir comment obtenir les données nécessaires à un produit d’IA générative. L’un des principaux défauts de l’IA est que certaines réponses sont complètement inventées et fausses. C’est ce qu’on appelle une « hallucination » et Apple pense qu’en utilisant des archives d’actualités pour entraîner son IA, elle peut offrir une fonction d’IA plus fiable.

 

Lire plus
Intelligence Artificielle

L’IA Gemini de Google pourrait bientôt arriver sur les autres smartphones Android

72e7e912 3d42 4c82 9ec8 84370b41c810

Après le lancement de ChatGPT en novembre 2022, Google a été contraint d’accélérer ses technologies d’IA. Il y a quelques mois, Google a dévoilé Google Bard, alimenté par LaMDA, en mars de cette année. En mai, l’entreprise a amélioré son modèle d’IA en lançant PaLM en mai.

Cette semaine, Google a dévoilé un modèle de base encore plus puissant sous la forme de Gemini. Ce modèle alimente désormais Google Bard, qui est beaucoup plus performant. L’IA Gemini arrive également sur d’autres smartphones Android.

Gemini se décline en trois versions : Gemini Ultra, Gemini Pro et Gemini Nano. La version Gemini Ultra est la plus puissante et nécessite le Web pour fonctionner. Google affirme qu’elle est plus performante que GPT-4, qui alimente ChatGPT et d’autres chatbots. Google Bard est désormais alimenté par Gemini Pro.

Gemini Nano est une version plus petite qui peut fonctionner sur l’appareil. Gemini Nano alimente désormais plusieurs fonctionnalités du smartphone Pixel 8 Pro. Par exemple, l’appli Enregistreur vocal propose désormais une fonction de résumé, même sans connexion Internet. Ainsi, les enregistrements vocaux de conversations et d’interviews peuvent être résumés même si le Pixel 8 Pro n’est pas connecté à Internet. Gemini Nano alimente également la fonctionnalité Réponse suggérée de Gboard, qui peut désormais être testée avec WhatsApp. Elle connaît le contexte de la discussion et suggère des réponses de haute qualité. Cette fonction sera bientôt disponible sur d’autres applications de messagerie.

L’IA Gemini alimente également l’assistant avec l’expérience Bard sur certains smartphones Pixel. Google a également parlé d’Android 14 et de la manière dont le service AI Core permet aux développeurs d’utiliser des fonctions d’IA comme Gemini Nano sur des smartphones équipés du Tensor G3 de Google et d’autres processeurs de smartphones phares de MediaTek, System LSI de Samsung (qui conçoit les processeurs Exynos) et Qualcomm. La société a déclaré qu’elle annoncerait bientôt la prise en charge d’autres appareils et des partenariats avec d’autres partenaires silicium. Bien que la société n’ait pas révélé grand-chose, il semble que Gemini puisse fonctionner sur les puces des smartphones phares modernes, y compris le Dimensity 9300 récemment annoncé, le Exynos 2400 et le Snapdragon 8 Gen 3.

Samsung travaille également sur l’IA

La série Galaxy S24 devrait, selon les rumeurs, être équipée des processeurs Exynos 2400 et Snapdragon 8 Gen 3. Étant donné que Gemini Nano peut fonctionner sur les smartphones équipés de ces puces, il est très probable qu’ils offriront des fonctions d’IA analogues, notamment des réponses plus intelligentes, une translittération en temps réel et des réponses plus intelligentes de la part des assistants vocaux numériques dotés d’IA.

Samsung a déjà annoncé Galaxy AI, qui offrira une traduction en temps réel lors des appels vocaux, et qui sera disponible sur le Galaxy S24. Nous nous attendons à ce que Samsung annonce d’autres fonctions d’IA lors de l’événement de lancement de la série Galaxy S24.

Lire plus