fermer

Intelligence Artificielle

L’intelligence artificielle (IA) transforme de nombreux secteurs, de la santé à la finance, en passant par l’éducation et la sécurité. Explorez comment l’IA est utilisée pour automatiser des tâches, augmenter l’efficacité et créer de nouvelles opportunités de marché.

Nos discussions incluent également les défis éthiques et les implications sociétales de l’adoption de l’IA, fournissant une perspective équilibrée sur ce développement technologique clé.

Intelligence Artificielle

Le monde n’est pas prêt pour ChatGPT-5, déclare un employé de OpenAI

raw 5

OpenAI, un important laboratoire de recherche en intelligence artificielle responsable de la création des modèles d’IA ChatGPT, a suscité des inquiétudes quant à l’état de préparation de la société à des systèmes d’IA avancés, tels que l’hypothétique ChatGPT-5. La déclaration, faite par un employé d’OpenAI, suggère que l’organisation a l’intention de ne pas partager largement certaines technologies d’IA, dans l’espoir de susciter une réponse sociale pour se préparer à des systèmes plus avancés.

Au cours des 18 derniers mois, l’intelligence artificielle (IA) a repoussé les limites de ce que les ordinateurs peuvent faire. OpenAI, l’entreprise responsable de l’explosion des applications d’IA grâce à la sortie de ChatGPT 3 l’année dernière, a récemment pris une mesure qui a suscité un vif débat sur la manière dont la société devrait gérer les progrès rapides des technologies d’IA.

Elle a suggéré de ralentir la diffusion de certaines capacités d’IA, telles que celles que l’on pourrait trouver dans une future version de ses modèles d’IA, afin de permettre à la société de rattraper son retard et de se préparer à ce qui se profile à l’horizon.

Cette approche prudente a divisé l’opinion publique. D’un côté, il y a l’enthousiasme suscité par le potentiel de l’IA à transformer nos vies, comme le montre le dernier modèle de conversion de texte en vidéo d’OpenAI. D’un autre côté, il y a un sentiment d’inquiétude. Pour les employés, les progrès de l’IA soulèvent d’importantes questions sur la sécurité de l’emploi et les implications éthiques de la prise en charge par les machines de rôles traditionnellement occupés par des humains.

L’émergence de contenus générés par l’IA pose également des dilemmes moraux auxquels la société doit faire face. Ces préoccupations ne sont pas seulement hypothétiques ; il s’agit de questions urgentes qui doivent être abordées à mesure que l’IA continue d’évoluer.

ChatGPT-5 sommes-nous prêts ?

Les progrès réalisés par OpenAI à huis clos font l’objet de nombreuses spéculations. Étant donné les améliorations constantes enregistrées, certains pensent que l’organisation est sur le point de réaliser une percée majeure, peut-être dans le domaine de l’intelligence artificielle générale (AGI). Toutefois, les communications de OpenAI ont été quelque peu ambiguës, ce qui laisse place à l’interprétation et alimente les spéculations sur ses capacités.

Le développement rapide des technologies de l’IA et le lancement imminent du ChatGPT-5 ont conduit certains experts à suggérer qu’une diffusion progressive de modèles d’IA mis à jour pourrait être la meilleure façon d’intégrer ces systèmes dans la société. Cette approche pourrait atténuer le choc provoqué par l’introduction simultanée de modèles entièrement nouveaux et avancés. Malgré les potentiels avantages de l’IA, l’opinion publique est souvent sceptique ou carrément négative. En témoignent les réactions hostiles aux véhicules autonomes sur les réseaux sociaux, ainsi que les appels à des réglementations strictes, voire à l’interdiction pure et simple de l’IA.

L’impact sociétal de l’IA est une question complexe qui va au-delà de la technologie. Certains craignent que l’IA n’aggrave les troubles sociaux et n’accroisse les inégalités. Ces préoccupations ont incité les décideurs politiques à prendre des mesures proactives pour veiller à ce que les avantages de l’IA soient répartis de manière juste et équitable.

Une autre préoccupation pressante est la possibilité d’une « course vers le bas » de l’IA. Selon ce scénario, les entreprises rivalisent pour mettre sur le marché de puissants modèles d’IA sans se demander si la société est prête à les accueillir. Une telle précipitation pourrait conduire à des systèmes d’IA qui dépassent les cadres éthiques et réglementaires nécessaires pour les gérer de manière sûre et responsable.

Inquiétudes liées à la diffusion de GPT-5

L’intégration de technologies d’IA avancées dans divers secteurs peut conduire à une efficacité accrue et à des économies pour les entreprises, mais elle pose également un risque important de déplacement d’emplois. À mesure que les systèmes d’IA tels que GPT-5 deviennent capables d’effectuer des tâches allant du service à la clientèle à la création de contenu et même à l’analyse technique, les rôles traditionnellement occupés par des humains dans ces domaines peuvent être réduits ou éliminés.

Cette évolution peut avoir des répercussions économiques et sociales considérables, notamment une augmentation du taux de chômage, une réduction des dépenses de consommation et une aggravation des inégalités économiques. Le tissu social pourrait être mis à rude épreuve, car les communautés qui dépendent des industries les plus touchées par l’IA sont confrontées à des ralentissements économiques, ce qui pourrait entraîner des troubles sociaux et des difficultés de réintégration de la main-d’œuvre.

Implications éthiques et morales

La capacité de l’IA à générer des contenus réalistes pose d’importants problèmes éthiques. Par exemple, la création de « deepfakes » peut compromettre l’authenticité des informations, en rendant difficile la distinction entre un contenu réel et un contenu artificiel.

Cette capacité pourrait être utilisée à mauvais escient pour diffuser des informations erronées, manipuler des élections ou mener des activités frauduleuses, ce qui constituerait une menace pour la démocratie, la vie privée et la confiance du public. Le dilemme éthique s’étend à la responsabilité des développeurs et des plateformes dans la prévention des abus tout en garantissant la liberté d’expression et d’innovation.

Sécurité et contrôle

À mesure que les systèmes d’IA deviennent plus complexes, il devient de plus en plus difficile de garantir leur alignement sur les valeurs humaines et les principes éthiques. Il existe un risque que l’IA développe des comportements nuisibles ou involontaires non prévus par ses créateurs, potentiellement en raison de la complexité de ses processus de prise de décision ou des propriétés émergentes de ses algorithmes d’apprentissage.

Cela soulève des inquiétudes quant aux mesures de sécurité mises en place pour prévenir de tels résultats et à la capacité de contrôler ou de corriger les systèmes d’IA une fois qu’ils sont opérationnels.

Progrès technologique et état de préparation de la société

Le rythme auquel les technologies de l’IA progressent pourrait dépasser la capacité de la société à comprendre, réguler et intégrer ces systèmes de manière efficace. Ce décalage peut entraîner des perturbations, car les cadres juridiques, éthiques et réglementaires existants risquent d’être inadaptés pour relever les défis posés par l’IA avancée.

L’introduction rapide des technologies d’IA pourrait entraîner des problèmes sociétaux, notamment des violations de la vie privée, des dilemmes éthiques et la nécessité de nouvelles lois et réglementations, qu’il pourrait être difficile d’élaborer et de mettre en œuvre en temps voulu.

Transparence et responsabilité

Le développement de systèmes d’IA tels que GPT-5 implique des décisions qui peuvent avoir de vastes implications. La transparence des processus utilisés pour former ces modèles, les sources de données et les critères de prise de décision suscitent des inquiétudes. La responsabilité des organisations qui développent des technologies d’IA est cruciale, en particulier dans les cas où les actions de l’IA conduisent à des préjudices ou à des préjugés.

Il est essentiel de veiller à ce que ces systèmes soient développés et déployés de manière transparente, avec des lignes de responsabilité claires, afin de maintenir la confiance du public et de garantir une utilisation éthique.

Une course vers le bas

La nature concurrentielle de l’industrie de l’IA pourrait pousser les entreprises à donner la priorité au progrès technologique plutôt qu’à la sécurité, à l’éthique et à l’impact sociétal, ce qui conduirait à une « course vers le bas ». Cette concurrence peut entraîner la mise sur le marché de technologies d’IA puissantes sans garanties suffisantes, sans surveillance ni prise en compte des effets à long terme, ce qui accroît le risque de conséquences négatives. La pression exercée pour rester en tête peut compromettre l’engagement en faveur de normes éthiques et d’une innovation responsable.

IA et inégalités

Les technologies avancées d’IA peuvent profiter de manière significative à ceux qui y ont accès, ce qui risque d’exacerber les inégalités existantes. La « fracture numérique » entre les individus et les pays qui ont accès à l’IA avancée et ceux qui n’y ont pas accès pourrait se creuser, entraînant des disparités en matière d’opportunités économiques, d’éducation, de soins de santé, etc. Cette fracture n’affecte pas seulement la prospérité individuelle et nationale, mais soulève également des questions éthiques sur la répartition équitable des avantages de l’IA et la gestion mondiale de ses impacts.

Pour répondre à ces préoccupations, les gouvernements, l’industrie, le monde universitaire et la société civile doivent coordonner leurs efforts afin d’élaborer des stratégies globales comprenant des lignes directrices éthiques, des cadres réglementaires solides, l’engagement du public et la coopération internationale. Il est essentiel de veiller à ce que le développement de l’IA soit guidé par des principes d’équité, de sécurité et de transparence afin d’exploiter ses avantages potentiels tout en atténuant les risques et les incidences négatives.

Les récentes déclarations de OpenAI ont mis en lumière les défis multiples posés par l’évolution rapide de l’IA.

Lire plus
Intelligence Artificielle

Reddit : de la controverse API à un accord d’IA de 60 millions de dollars

reddit logo

Pendant des années, Reddit a fonctionné comme son célèbre slogan l’indique : « La première page d’Internet ». Cependant, l’année dernière, tout a changé lorsque la direction du site a annoncé qu’elle passait à un modèle d’API payant, ce qui a entraîné la disparition de plus de 6 000 subreddits en signe de protestation et la fermeture de nombreuses applications tierces. Aujourd’hui, d’autres changements sont en vue, qui pourraient provoquer encore plus de réactions négatives à l’encontre du site populaire.

Après les changements apportés par le site l’année dernière, lorsqu’il a commencé à faire payer son API, des rapports ont commencé à faire surface, indiquant qu’il prévoyait d’empêcher les sites de récupérer ses données. Cela a bien sûr inquiété ceux qui cherchaient normalement du contenu sur le site en ajoutant « reddit » à leurs recherches sur Google. Alors que le scrapping de données par des chatbots d’intelligence artificielle a été critiqué par des personnes telles qu’Elon Musk, de X, Reddit n’a pas vraiment réjoui ses utilisateurs, car cela a eu une incidence sur l’expérience utilisateur.

Aujourd’hui, comme le rapporte Bloomberg, Reddit vend l’accès à son énorme contenu généré par les utilisateurs à une grande entreprise d’IA (qui n’est pas nommée). L’accord vaut 60 millions de dollars par an en prévision de l’introduction en bourse très attendue de Reddit, qui, selon les rumeurs, devrait avoir lieu dès le mois prochain.

Le fait de permettre à une société d’IA d’accéder aux rouages du contenu pourrait être considéré comme un moyen d’attirer davantage d’investisseurs avant que la plateforme n’entre dans le domaine du commerce public, comme rapporté le mois dernier. L’initié de Bloomberg a déclaré que « la société basée à San Francisco a dit aux investisseurs potentiels de son introduction en bourse qu’elle avait signé l’accord, d’une valeur d’environ 60 millions de dollars sur une base annualisée, plus tôt cette année ».

Cette démarche illustre l’importance que revêtent les licences de contenu pour les entreprises d’IA qui utilisent le matériel source pour alimenter les algorithmes qui créent leurs résultats.

À la suite de plusieurs débats très médiatisés sur la validité des sources des résultats de l’IA, de plus en plus d’entreprises cherchent à établir des partenariats officiels avec des entreprises enregistrées auxquelles les algorithmes d’IA espèrent apporter leur expertise.

Qu’en est-il de l’introduction en bourse de Reddit ?

Steve Huffman, le PDG de Reddit, a évoqué la possibilité d’une introduction en bourse à la fin de l’année dernière et a mentionné que les personnes qui tentent d’utiliser la plateforme pour lancer des entreprises pourraient être au cœur du besoin d’expansion. « Les gens essaient de créer des entreprises sur Reddit, mais la plateforme n’a pas été conçue pour cela », a déclaré Huffman à Fast Company lors d’une interview l’année dernière, « Je pense donc que le simple fait d’essayer d’étoffer cet écosystème sera très puissant ».

Selon Bloomberg, 16 banques sont impliquées dans l’introduction en bourse de Reddit, dirigée par Morgan Stanley et Goldman Sachs Group Inc. et comprenant également « JPMorgan Chase & Co, Bank of America Corp et Citigroup Inc ». Une introduction en bourse est le processus d’offre d’actions d’une société privée au public après que la société a satisfait aux exigences de la Securities and Exchange Commission (SEC). C’est de là que vient l’expression « faire appel public à l’épargne ».

À ce stade du cycle de vie d’une entreprise, les premiers investisseurs et actionnaires conviennent qu’ils ont besoin de plus d’argent pour se développer. Ils s’appuient alors sur l’expertise des institutions bancaires pour faire entrer le prix des actions d’une entreprise dans le domaine public et dans les mers concurrentielles du marché boursier.

Cela permet à ces entreprises d’être mieux exposées et d’obtenir des prêts et des investissements, mais cela s’accompagne également d’une plus grande transparence dans la comptabilité qui doit être divulguée publiquement.

Lire plus
Intelligence Artificielle

Découvrez AnyGPT : le futur LLM multimodal de l’IA open source

b362d1eb f303 441f be67 fe2e2ef78376

AnyGPT est un Large Language Model (LLM) multimodal innovant capable de comprendre et de générer du contenu à partir de différents types de données, notamment la parole, le texte, les images et la musique. Ce modèle est conçu pour s’adapter à différentes modalités sans modification significative de son architecture ou de ses méthodes d’apprentissage.

Le LLM multimodal open source AnyGPT peut être entraîné de manière stable sans aucune modification de l’architecture ou des paradigmes d’entraînement des LLM actuels. Au lieu de cela, il repose exclusivement sur le prétraitement au niveau des données, ce qui facilite l’intégration transparente de nouvelles modalités dans les LLM, à l’instar de l’incorporation de nouveaux langages. Nous construisons un ensemble de données multimodales centrées sur le texte pour le pré-entraînement à l’alignement multimodal.

Il utilise la modélisation de séquences discrètes pour traiter et comprendre diverses informations de manière structurée. Cet outil polyvalent attire l’attention des développeurs et des chercheurs, car il offre un aperçu d’un avenir où l’IA peut s’engager de manière transparente avec nous à travers de multiples sens. L’approche unique d’AnyGPT réside dans sa technique de modélisation de séquences discrètes, qui décompose des informations complexes en éléments plus petits et plus faciles à gérer, appelés « tokens ». Cela permet au modèle de traiter un large éventail de types de données avec une précision impressionnante. Qu’il s’agisse d’analyser une image détaillée ou de composer un morceau de musique, AnyGPT peut gérer la tâche avec facilité.

model scaled

Le développement d’AnyGPT a été une entreprise considérable, impliquant la création d’un ensemble de données diversifié qui comprend différentes formes de discours, de texte, d’images et de musique. C’est cette formation approfondie qui donne à AnyGPT sa remarquable capacité à comprendre les nuances des différents types de données et la manière dont elles peuvent être combinées ou transformées. Le résultat est une IA qui peut interagir avec les humains de manière plus naturelle et intuitive.

Un aspect clé du développement d’AnyGPT est la création de son ensemble de données, qui ne consiste pas seulement à recueillir du contenu multimodal, mais aussi à enrichir les interactions textuelles avec des dialogues riches et multimodaux. Cela signifie qu’AnyGPT n’est pas seulement un interprète, mais aussi un créateur, capable de générer des résultats qui peuvent stimuler nos sens de différentes manières.

Caractéristiques d’AnyGPT

L’une des caractéristiques les plus intéressantes d’AnyGPT est sa technologie de clonage de la voix. Celle-ci permet au modèle de reproduire le discours de n’importe quelle personne, offrant ainsi de nouvelles possibilités de communication personnalisée. Mais, les talents d’AnyGPT ne s’arrêtent pas là ; il peut également écrire de la poésie, traduire des émotions en musique et créer de l’art visuel, démontrant ainsi son potentiel en tant qu’outil puissant d’expression créative.

data construction scaled

Capacités multimodales unifiées 

  • Peut comprendre et travailler avec différents types d’informations, y compris la parole, le texte, les images et la musique.
  • Il démontre sa capacité à traiter différentes modalités de données sans nécessiter de modifications significatives de son architecture ou de sa méthodologie de formation.

Modélisation de séquences discrètes 

  • Emploie une méthode de décomposition de l’information en séquences plus petites ou en jetons, ce qui lui permet de traiter et de comprendre divers types de données.
  • Il utilise la tokenisation discrète pour la parole, le texte, les images et la musique, ce qui facilite son intégration multimodale.

Génération automatique de contenu 

  • Capable de générer du contenu couvrant plusieurs types de données, y compris l’art visuel, la musique et les sorties textuelles, grâce à une approche automatique, étape par étape.
  • Les exemples incluent le dessin d’images, la création de musique, l’écriture de poèmes et l’élaboration de lignes de personnages dramatiques, mettant ainsi en évidence sa polyvalence.

Démonstrations d’applications pratiques 

  • Fournit des exemples tels que la conversion de la sensation de la musique en images, la traduction des émotions des images en musique et la génération de contenu basé sur la voix.
  • Démonstration de la capacité à cloner la parole pour la création de contenu, comme la rédaction d’un poème avec la voix clonée.

Traitement efficace des données 

  • L’architecture est conçue pour être simple et efficace, en maintenant l’efficacité du traitement des données d’entrée et de la génération des données de sortie sans nécessiter de préparation extensive des données avant ou après leur traitement.

Un riche ensemble de données de formation

  • Il utilise un ensemble de données complet contenant des informations mixtes (parole, texte, images, musique) pour former le modèle au traitement des entrées multimodales
  • L’ensemble de données comprend une grande variété d’exemples pour s’assurer qu’Any-GPT peut gérer et comprendre les nuances de différents types de données.

Processus de création d’un ensemble de données en deux étapes 

  • Il s’agit de générer des dialogues multimodaux à partir de conversations textuelles et d’incorporer diverses modalités telles que des images et des sons pour enrichir l’ensemble de données de formation.
  • L’accent est mis sur la création d’un contenu multimodal riche, améliorant la capacité du modèle à comprendre et à générer des réponses multimodales complexes.

Pour ceux qui souhaitent approfondir le fonctionnement de cette IA, le code d’AnyGPT est disponible en open source. Cela signifie que toute personne intéressée par l’IA peut accéder au modèle, le modifier et éventuellement améliorer sa fonctionnalité. C’est une invitation à la communauté à participer au développement continu de cette technologie de pointe.

AnyGPT est plus qu’un simple modèle d’IA ; c’est une plateforme sophistiquée qui élargit les possibilités d’interaction multimodale avec l’IA. Sa capacité à s’adapter à différents types de données, sa nature open source et sa communautée en font un atout inestimable pour quiconque s’intéresse à l’avenir de l’IA. AnyGPT représente une avancée significative dans le domaine, offrant une plateforme polyvalente à ceux qui souhaitent repousser les limites de ce que la technologie peut faire.

Lire plus
Intelligence Artificielle

Des hackers nord-coréens exploitent ChatGPT pour le phishing sur LinkedIn

b3134ada 19a7 4253 aa99 50527f840a27

Selon un rapport, des pirates nord-coréens utiliseraient ChatGPT pour inciter les utilisateurs de LinkedIn et d’autres réseaux sociaux à fournir des informations et des données sensibles.

La société mère de ChatGPT, OpenAI, et l’investisseur Microsoft ont révélé la semaine dernière qu’ils avaient « perturbé 5 acteurs affiliés à des États qui cherchaient à utiliser des services d’IA pour soutenir des activités cybernétiques malveillantes ».

Grâce à Microsoft Threat Intelligence, les comptes associés à deux acteurs affiliés à la Chine et connus sous le nom de Charcoal Typhoon et Salmon Typhoon, à l’acteur affilié à l’Iran et connu sous le nom de Crimson Sandstorm, à l’acteur affilié à la Corée du Nord et connu sous le nom d’Emerald Sleet, et à l’acteur affilié à la Russie et connu sous le nom de Forest Blizzard, ont été identifiés et supprimés.

Microsoft, qui possède LinkedIn, a noté qu’Emerald Sleet, également connu sous le nom de Kimsuky, s’est fait passer pour « des institutions académiques et des ONG réputées afin d’inciter les victimes à répondre avec des idées et des commentaires d’experts sur les politiques étrangères liées à la Corée du Nord ».

Dans son article de blog, elle indique qu’elle n’a pas trouvé de preuves que ces acteurs ont mené des cyberattaques importantes, mais que la plupart de ses découvertes sont « représentatives d’un adversaire explorant les cas d’utilisation d’une nouvelle technologie ».

OpenAI a indiqué que le compte Emerald Sleet de la Corée du Nord a utilisé ses services « pour identifier des experts et des organisations axés sur les questions de défense dans la région Asie-Pacifique, comprendre les vulnérabilités accessibles au public, aider à effectuer des tâches de script de base et rédiger des contenus susceptibles d’être utilisés dans des campagnes de phishing ».

Featured image jpg

Comment les pirates nord-coréens ciblent LinkedIn ?

Selon Yonhap, l’agence de renseignement de l’État sud-coréen a détecté des signes indiquant que la Corée du Nord essayait d’intégrer l’IA générative dans ses attaques de piratage et autres cyberactivités illicites.

« Récemment, il a été confirmé que les pirates nord-coréens utilisent l’IA générative pour rechercher des cibles de piratage et des technologies nécessaires au piratage », a déclaré à la presse un haut responsable du Service national de renseignement (NIS). Le NIS a déclaré avoir constaté une moyenne quotidienne de 1,62 million de tentatives de piratage dans le secteur public sud-coréen l’année dernière, soit une augmentation de 36 % par rapport à l’année précédente.

Le NIS a ajouté qu’il est également soupçonné d’utiliser ses travailleurs informatiques à l’étranger pour trouver des emplois dans des entreprises informatiques afin d’implanter des codes malveillants dans les programmes logiciels qu’ils ont développés dans les entreprises pour voler des crypto-monnaies.

Erin Plante, vice-président des enquêtes de Chainalysis, une société de cybersécurité spécialisée dans les cryptomonnaies, a déclaré au Financial Times que « des groupes de pirates nord-coréens ont été vus en train de créer des profils de recruteurs d’apparence crédible sur des sites de réseautage professionnel tels que LinkedIn ».

« L’IA générative aide à discuter, à envoyer des messages, à créer des images et de nouvelles identités — toutes les choses dont vous avez besoin pour établir une relation étroite avec votre cible », a-t-elle ajouté.

GPT-4 peut-il aider les hackers ?

OpenAI a déclaré que ses conclusions s’alignaient sur les évaluations externes, indiquant que les capacités de GPT-4 à aider les « tâches malveillantes de cybersécurité » sont limitées à ce qui peut déjà être accompli à l’aide d’outils accessibles au public qui n’utilisent pas l’IA.

L’année dernière, il a été rapporté que des pirates soutenus par la Corée du Nord avaient ciblé des clients de crypto-monnaies en infiltrant les systèmes de la société américaine de logiciels d’entreprise JumpCloud.

Lire plus
Intelligence Artificielle

Innovation publicitaire chez Google : l’IA Gemini pour transformer la création d’annonces

ed562e5d 221d 4c9d 8019 2919bf6e5e7c

Google a annoncé jeudi son intention d’améliorer ses produits publicitaires en y intégrant ses modèles d’intelligence artificielle Gemini, dans le but d’offrir des capacités d’IA avancées à un plus grand nombre de ses clients.

Selon un rapport de Reuters, cette initiative s’inscrit dans le cadre d’une stratégie plus large de Google visant à intégrer la technologie d’intelligence artificielle générative, capable de produire du texte et des images réalistes, dans un plus grand nombre de ses services. Après avoir annoncé que Gemini serait appliqué aux outils d’entreprise de Google, le géant technologique a révélé que le modèle d’IA viendrait également renforcer Performance Max, un produit conçu pour optimiser le placement des annonces sur les plateformes de Google, notamment la messagerie électronique, la recherche et YouTube.

Afin de rendre la publicité plus efficace et plus créative, Google a introduit des outils d’IA dans Performance Max en novembre dernier, permettant la génération automatique d’images et de textes pour les annonces.

Avec l’intégration de Gemini, les annonceurs auront désormais la possibilité de créer des annonces plus attrayantes avec des titres plus longs pouvant aller jusqu’à 90 caractères, ce qui représente une augmentation significative par rapport à la limite précédente de 30 caractères.

En outre, l’outil de génération d’images de Google sera amélioré avec son modèle d’IA, Imagen 2, ce qui permettra aux marques de créer des images mettant en scène des personnes. Cette évolution ouvre de nouvelles possibilités pour les annonceurs, par exemple pour un fleuriste qui génère rapidement des images d’une personne en train d’arranger des fleurs. Brendon Kraham, vice-président de Google chargé des solutions publicitaires mondiales pour la recherche et le commerce, a souligné le potentiel de ces outils pour produire du contenu en quelques secondes seulement.

Éviter les « deepfakes »

Pour répondre aux inquiétudes concernant l’utilisation abusive de l’IA générative pour créer des contenus trompeurs ou des « deepfakes », Google a mis en place des mesures de sécurité. Celles-ci comprennent des restrictions concernant la génération d’images de personnes connues, de célébrités, de personnalités publiques ou de contenus représentant la violence ou des activités illégales.

En outre, les photos générées par l’IA seront marquées d’un filigrane pour indiquer clairement qu’il s’agit d’images synthétiques, afin de garantir la transparence et de prévenir toute utilisation abusive potentielle.

Lire plus
Intelligence Artificielle

Google et Reddit : un partenariat IA pour révolutionner la recherche en ligne

file QL9VhXdNQ4JRznoeVgw47Et0

Dans une ère où l’intelligence artificielle (IA) redéfinit continuellement notre interaction avec le contenu en ligne, Google et Reddit ouvrent un nouveau chapitre de leur collaboration.

Cette initiative vise à intégrer les capacités avancées d’IA de Vertex AI dans la plateforme de Reddit, avec l’objectif d’améliorer divers aspects de Reddit, notamment sa fonction de recherche.

Google a observé une tendance croissante des utilisateurs se tournant vers ses services pour découvrir du contenu de valeur sur Reddit, allant des recommandations de produits aux conseils de voyage. L’objectif de cette collaboration est d’enrichir l’affichage des informations de Reddit, rendant les produits Google plus conviviaux et facilitant l’engagement au sein des communautés de Reddit.

À travers ce partenariat, Google obtient un accès à l’API de données de Reddit, lui permettant de récupérer du contenu structuré en temps réel de la vaste plateforme de Reddit. Cet accès améliore la capacité de Google à comprendre, afficher et utiliser le contenu de Reddit efficacement, sans modifier ses pratiques existantes concernant le contenu disponible publiquement.

Reddit souligne que cette collaboration permet un accès programmatique à une large gamme de posts publics et de commentaires sur Reddit à travers différents produits Google. Cet accès structuré simplifie l’intégration du contenu, permettant à Google d’améliorer ses produits et services, avançant ainsi la mission de Reddit de favoriser la communauté, l’appartenance et l’empowerment à l’échelle mondiale.

Maintien des termes et conditions

Reddit assure que les termes et conditions régissant l’utilisation de son API de données restent inchangés. L’utilisation commerciale du contenu accessible via l’API nécessite l’approbation de Reddit, tandis que l’utilisation non commerciale reste gratuite sous certaines conditions. Cela réaffirme l’engagement de Reddit à maintenir la transparence et l’équité dans ses partenariats.

Rajan Patel, Vice-président de l’expérience de recherche Google, a commenté le partenariat :

Nous attendons avec impatience les possibilités qui s’ouvrent à nous avec ce partenariat et nous nous engageons à simplifier l’accès au contenu exceptionnellement utile de Reddit, tant sur leur plateforme que sur la nôtre, garantissant ainsi des avantages accrus pour les utilisateurs.

Annonçant la collaboration, Reddit a posté :

Au cours des 18 dernières années, Reddit est devenu l’un des dépôts les plus vastes d’interactions humaines authentiques et en constante évolution et de récits sur Internet. Conformément à notre conviction que chacun mérite d’accéder aux connaissances et aux rencontres qu’ils recherchent en ligne, nous avons étendu notre collaboration avec Google pour rationaliser l’exploration et l’accessibilité des communautés diverses et des discussions recherchées sur Reddit.

Cette alliance entre Google et Reddit illustre parfaitement comment la technologie IA peut améliorer notre façon de découvrir et d’interagir avec le contenu en ligne, en favorisant une expérience utilisateur plus riche et plus connectée.

Le montant du partenariat n’est pas encore connu, mais il serait de l’ordre de 60 millions de dollars par an.

Lire plus
Intelligence Artificielle

Nvidia et Huawei : la nouvelle course à la suprématie des puces d’IA

file qWAXBUWwKdAktmJcAf1yBAoU

L’ascension de l’intelligence artificielle (IA) dans notre quotidien est presque magique, évoquant des comparaisons avec des œuvres classiques. Au cœur de cette magie se trouvent les puces d’IA, éléments vitaux de l’infrastructure qui alimente les outils d’IA dans nos appareils, tels que la série Pixel 8 de Google et la série Galaxy S24 de Samsung. Actuellement, Nvidia est en tête du marché de l’IA, mais la concurrence se fait de plus en plus sentir.

Selon Reuters, Nvidia a récemment identifié Huawei comme un concurrent majeur dans la production de puces d’IA, une première pour l’entreprise.

Cette révélation intervient peu après que l’administration Biden a renforcé les restrictions contre SMIC (Semiconductor Manufacturing International Corp), le principal fabricant de puces chinois soumis à des sanctions, en l’empêchant d’accéder aux importations américaines avancées. Cette décision fait suite à la production par SMIC d’une puce sophistiquée pour le Mate 60 Pro de Huawei.

Nvidia a souligné que Huawei est un concurrent dans la fourniture de puces conçues pour l’IA, y compris les unités de traitement graphique (GPU), les unités de traitement central (CPU) et les puces de réseau. Huawei est également reconnu comme une entreprise de services cloud concevant son propre matériel et logiciel pour optimiser le calcul d’IA.

Les puces les plus recherchées de Huawei sont celles de la série Ascend, le 910B étant son principal concurrent au chip A100 de Nvidia, lancé il y a environ 3 ans. Huawei a choisi de privilégier la fabrication de ses puces Ascend pour l’IA plutôt que ses smartphones haut de gamme Mate 60, utilisant la même installation de production pour ses puces Kirin et Ascend. Cette stratégie s’est avérée difficile en raison d’un faible taux de rendement, c’est-à-dire le pourcentage de puces acceptables produites par rapport au nombre maximum de puces pouvant être obtenues à partir d’une seule plaquette de silicium.

Le développement par Huawei des puces de la série Ascend en tant que concurrentes aux puces d’IA de Nvidia montre l’importance croissante du marché chinois des puces d’IA, estimé à 7 milliards de dollars. Cette compétition indique une évolution rapide du paysage technologique, soulignant l’importance stratégique de l’innovation dans le domaine des semi-conducteurs et de l’IA.

Lire plus
Intelligence Artificielle

ChatGPT déraille : une soirée de réponses incohérentes sème le doute

ChatGPT 4 dOpenAI

Mardi soir, ChatGPT s’est mis à dérailler. Des utilisateurs ont signalé que le chatbot d’IA répondait de manière incorrecte et parlait en charabia, comme l’a rapporté 404Media.

Les membres d’un subreddit ChatGPT ont partagé leurs expériences avec des captures d’écran d’échanges extraordinaires avec la technologie, des réponses qui n’avaient aucun sens ou des réponses à des questions qui étaient complètement à côté de la plaque.

L’une des captures d’écran montrait cette réponse à une question : « C’est le travail du service et de tout médecin aujourd’hui dans le domaine des données ». Elle se poursuivait ainsi : « Le 12ème au degré et la piscine à la terre au sommet de la couture, avec le commerce et la fonctionnalité, peut dépenser le grand et le tout avant qu’il ne soit sous les soins ».

Un autre utilisateur a expliqué qu’il avait demandé à ChatGPT « un synonyme de overgrown » et qu’il avait obtenu la réponse : « Un synonyme de “overgrown” est “overgrown” est “overgrown” est “overgrown”… » D’autres utilisateurs ont affirmé que l’application donnait des réponses totalement incorrectes aux questions de base, comme « Tokyo, Japon » lorsqu’on lui demandait de citer la plus grande ville du monde commençant par un « A ».

OpenAI, les créateurs de ChatGPT, a confirmé avoir résolu le problème dans un message sur sa page de statut. Il s’agit néanmoins d’un nouveau rappel que, bien que nous soyons en plein boom de l’IA, la technologie n’est pas encore à l’abri d’une défaillance ou, tout simplement, d’une erreur.

Les modèles d’IA comme ChatGPT ont encore un long chemin à parcourir

Il s’agit là d’un nouvel exemple de technologie d’IA qui prouve qu’elle n’est pas encore capable de gagner la confiance totale de ses utilisateurs, malgré les craintes que l’intelligence artificielle ait le potentiel de remplacer les humains dans une variété de tâches quotidiennes, à la fois à la maison et sur le lieu de travail.

Il y a déjà eu plusieurs cas où des avocats se sont retrouvés en difficulté pour avoir cité des cas fictifs générés par l’IA. Le mois dernier, Reuters a rapporté qu’un avocat new-yorkais faisait l’objet de mesures disciplinaires après avoir utilisé ChatGPT à des fins de recherche dans le cadre d’un procès pour faute professionnelle médicale et n’avoir pas confirmé que le cas cité était valide.

Lire plus
Intelligence Artificielle

Lancement de Gemini for Workspace : Google intensifie l’IA pour les entreprises

Google One AI Premium Blog Post

Aujourd’hui, Google a annoncé le lancement de Gemini for Workspace, une nouvelle offre centrée sur les entreprises qui apporte la puissance de Gemini Ultra 1.0 — le modèle le plus performant de l’entreprise — dans les applications Workspace telles que Docs et Meet avec des protections de données de niveau entreprise.

Google a récemment franchi une étape importante dans le domaine de l’intelligence artificielle avec la transformation de Bard en Gemini, ainsi que le lancement de la nouvelle application Android Gemini et d’un nouveau forfait Google One conçu spécialement pour ceux souhaitant exploiter les capacités avancées de Gemini Advanced et son modèle d’IA le plus performant, Ultra 1.0.

Ce nouveau niveau d’abonnement, nommé « Google One AI Premium », offre également aux utilisateurs un accès à 2 To de stockage, en plus des autres avantages Google One. Malheureusement, ce dernier n’est pas encore disponible en France.

Gemini gmail 022024

La nouveauté marquante est l’extension des fonctionnalités de Gemini aux applications Gmail, Docs, Slides, Sheets et Meet, anciennement connues sous le nom de Duet AI dans l’univers Google Workspace, désormais rebaptisées « Gemini » à l’instar de Bard.

Le modèle LLM Ultra 1.0 de Gemini est salué pour ses avancées significatives dans le monde de l’IA, notamment en termes d’efficacité de traitement, de compréhension avancée des instructions et programmes, ainsi que d’amélioration des compétences de résolution de problèmes.

Ce modèle est capable d’analyser et d’expliquer des données, mais aussi de rédiger du code de haute qualité dans de nombreux langages de programmation, enrichissant ainsi l’expérience utilisateur dans les applications Workspace sans nécessiter de changer d’application ou d’onglet.

Respect de la vie privée

Outre l’intégration de Gemini dans les applications, la nouvelle offre permettra également aux utilisateurs de Workspace de bénéficier d’une expérience de chatbot Gemini autonome afin d’accélérer leurs workflows et leur créativité sans se soucier des risques liés à la confidentialité ou à la sécurité.

Google souligne également que, conformément à ses principes de confidentialité des données liées à l’IA, Gemini dans Google Workspace n’utilise pas vos informations personnelles et/ou professionnelles pour former ou améliorer ses modèles d’IA sans votre permission. Cet aspect est crucial à souligner à une époque où les frontières de la vie privée peuvent parfois sembler floues.

Gemini commence aujourd’hui son déploiement dans Gmail et les applications Workspace (anciennement Duet AI) pour les membres AI Premium dans plus de 150 pays en anglais. Comme lors de son lancement, les abonnés AI Premium bénéficient également de Gemini Advanced, de 2 To de stockage utilisables sur tous les services Google (tels que Google Photos et Drive), ainsi que d’autres avantages Google One pour 19,99 dollars par mois, avec deux mois d’introduction gratuits.

Cette initiative devrait renforcer la position de Google face à Microsoft, qui a déjà fait quelque chose d’analogue avec son expérience Copilot pour les entreprises.

Lire plus
Intelligence Artificielle

Google suspend la génération d’images de personnes par Gemini suite à des réactions négatives

7b0ecf7c comment creer des image

Google a suspendu la possibilité de créer des images de personnes à l’aide de la fonction de génération d’images par l’IA Gemini afin de corriger certaines inexactitudes historiques.

Certains utilisateurs de Gemini ont partagé des captures d’écran montrant des inexactitudes historiques apparentes, Gemini créant des images d’un homme amérindien et d’une femme indienne alors qu’on lui demandait de créer un couple allemand représentatif de l’époque des années 1820. Des images de soldats indigènes ont également été créées pour représenter des membres de l’armée allemande de 1929, entre autres exemples.

Ces résultats ne sont peut-être pas surprenants si l’on se souvient que la génération d’images par l’IA n’apprend que de ce qu’on lui donne. Cela signifie qu’en cas de saisie ou d’erreur humaine, l’IA peut rapidement inventer des réponses ou combler elle-même les lacunes, ce qui se traduit par des résultats inexacts comme ceux-ci. L’IA générative ne peut pas penser par elle-même et fait souvent des sauts rapides pour répondre à une demande.

Google a reconnu pour la première fois les problèmes liés à la génération d’images le mercredi 21 février : « Nous travaillons à l’amélioration immédiate de ce type de représentations. La génération d’images par l’IA de Gemini génère un large éventail de personnes. Et c’est généralement une bonne chose, car des gens du monde entier l’utilisent. Mais dans le cas présent, il n’est pas à la hauteur ».

Réponse de Google aux allégations d’inexactitude historique

Google a annoncé qu’il avait mis en pause la génération d’images de personnes dans Gemini et qu’il prenait des mesures pour résoudre les problèmes. Une version mise à jour devrait être publiée prochainement.

Actuellement, Gemini affiche un message d’erreur lorsqu’on lui demande de générer une image incluant une personne, indiquant : « Nous travaillons à améliorer la capacité de Gemini à générer des images de personnes. Nous prévoyons que cette fonctionnalité reviendra bientôt et vous informerons dans les mises à jour de la version lorsqu’elle le fera ».

La solution à ces problèmes comprendra probablement une forme de contexte historique ou réel dans la génération d’images de Gemini. Il reste à voir ce que Google fera exactement pour combler cette lacune et aucun calendrier n’a été donné pour la mise à disposition d’une nouvelle version améliorée, alors qu’une nouvelle mise à jour du modèle a été effectuée la semaine dernière. Gemini est toujours en ligne et ses fonctions de génération d’images fonctionnent toujours pour les sujets non humains.

Lire plus
Intelligence Artificielle

Vers une IA éthique : Google présente sa boîte à outils pour modèles génératifs

rai overview

Google a publié une sélection d’outils d’IA pour guider le développement de modèles d’IA génératifs responsables. La boîte à outils souligne l’importance de la qualité des données par rapport à la quantité et présente les meilleures pratiques pour créer des ensembles de données de réglage.

C’est une étape importante qui guide les développeurs dans la création éthique de modèles d’intelligence artificielle (IA). Elle est conçue pour garantir que les systèmes d’intelligence artificielle sont sûrs, fiables et exempts de biais. Il s’agit d’une ressource que les développeurs peuvent utiliser pour créer une IA qui respecte les normes éthiques et sert le bien public.

Au cœur de tout système d’IA se trouvent les données à partir desquelles il apprend. La boîte à outils de Google met fortement l’accent sur la nécessité de disposer de données d’entraînement de haute qualité.

Il est entendu que plus les données d’entraînement sont de qualité, plus le modèle d’IA sera robuste et efficace. La boîte à outils fournit des conseils sur la manière de générer des exemples d’entraînement de premier ordre, en particulier pour les Large Language Model (LLM), qui sont essentiels pour le développement de l’IA.

Un aspect innovant de la boîte à outils est sa recommandation d’utiliser des requêtes contradictoires. Il s’agit de prompts stimulants qui mettent à l’épreuve les défenses de l’IA et contribuent à améliorer sa sécurité. En préparant l’IA à gérer une variété de situations réelles, les développeurs peuvent s’assurer que l’IA est robuste et qu’elle peut gérer des entrées inattendues sans compromettre la sécurité.

Boîte à outils d’IA générative responsable de Google

Lorsqu’il s’agit d’affiner les modèles d’IA, les développeurs ont beaucoup de choses à prendre en compte. La boîte à outils souligne l’importance de créer un ensemble de données qui reflète toutes les politiques de contenu et couvre un large éventail de scénarios. Cette couverture complète est essentielle pour un entraînement approfondi des modèles. En outre, la boîte à outils insiste sur la nécessité de diversifier les données utilisées pour affiner le modèle. Cette diversité aide l’IA à répondre avec précision à un large éventail de requêtes.

Un autre point clé de la boîte à outils est l’élimination des données en double. Cette étape est cruciale pour améliorer l’efficacité de l’ensemble de données et les performances du modèle. Elle garantit que l’IA ne se contente pas de répéter les réponses, mais qu’elle fournit des résultats utiles et variés. En outre, la boîte à outils souligne l’importance de séparer les données d’évaluation des données de réglage. Cette séparation est essentielle pour éviter la contamination croisée et pour maintenir une évaluation impartiale du modèle d’IA.

Le traitement éthique des données est également un point important de la boîte à outils. Elle exige des instructions d’identifications claires et l’utilisation de groupes d’évaluateurs diversifiés pour minimiser les préjugés. Cette approche favorise l’équité et l’inclusivité des résultats produits par l’IA.

Pour protéger les données d’entrée et de sortie des modèles d’IA générative, les outils d’IA de Google présentent plusieurs stratégies. Ils suggèrent l’utilisation de modèles de prompts pour orienter l’IA vers des résultats plus sûrs et plus précis. La complexité de la création de prompts efficaces est reconnue et la boîte à outils fournit des conseils à cet égard. Les classificateurs de contenu, tels que l’API Perspective et le service de modération de texte de Google, sont recommandés pour empêcher la génération de contenu préjudiciable. Ces classificateurs agissent comme des gardiens, en veillant à ce que les entrées et les sorties de l’IA respectent les normes de sécurité.

Protocoles de sécurité

La boîte à outils traite également de l’évaluation des protocoles de sécurité. Elle souligne la nécessité de trouver un équilibre entre l’efficacité et l’absence de filtrage excessif, qui pourrait réduire l’utilité de l’application d’IA.

Les outils de Google pour une IA générative responsable offrent un cadre stratégique aux développeurs. Il encourage l’engagement en faveur de la qualité des données, l’utilisation de requêtes contradictoires pour le réglage fin et la mise en œuvre de mesures de sécurité strictes. Cette boîte à outils est prête à façonner l’avenir du développement de l’IA, en promouvant des pratiques éthiques et efficaces qui établissent une référence en matière d’IA responsable.

Lire plus
Intelligence Artificielle

Groq réinvente l’IA avec son processeur LPU ultra-rapide

groq logo

Lorsque vous utilisez ChatGPT, en particulier le modèle GPT-4, vous avez certainement remarqué la lenteur avec laquelle le modèle répond aux requêtes. Sans parler des assistants vocaux basés sur de Large Language Model, comme la fonction Voice Chat de ChatGPT ou la récente version de Gemini, qui a remplacé Google Assistant sur les smartphones Android, qui sont encore plus lents en raison de la latence élevée des LLM. Mais tout cela devrait bientôt changer, grâce au nouveau et puissant moteur d’inférence LPU (Language Processing Unit) de Groq.

Dans un secteur technologique en constante évolution, la rapidité et l’efficacité des traitements informatiques sont au cœur des préoccupations, particulièrement dans le domaine de l’intelligence artificielle (IA).

À cet égard, la société Groq, co-fondée par Jonathan Ross, ancien ingénieur de Google, fait figure de pionnière avec son tout nouveau moteur d’inférence LPU (Language Processing Unit), promettant de révolutionner la vitesse de traitement des modèles de langage.

Contrairement à l’IA conversationnelle ChatGPT d’OpenAI, qui repose sur des puces Nvidia, le LPU de Groq se distingue par sa capacité à générer jusqu’à 500 tokens par seconde pour un modèle de 7 milliards de paramètres, et 250 tokens par seconde pour un modèle de 70 milliards. Cette performance dépasse largement celle des solutions basées sur les GPU Nvidia, qui oscillent entre 30 et 60 tokens par seconde.

L’histoire de Groq commence en 2016, lorsque Jonathan Ross quitte Google pour fonder sa propre entreprise, emmenant avec lui une partie de l’équipe ayant développé le premier TPU (Tensor Processing Unit). L’approche innovante de Groq repose sur un développement logiciel préalable à la conception matérielle, permettant d’atteindre une performance dite « déterministe », essentielle pour des résultats rapides, précis et prévisibles.

Le LPU de Groq : une architecture sur mesure

L’architecture du LPU de Groq, analogue à celle d’un ASIC (circuit intégré spécifique à une application), est optimisée pour le traitement séquentiel des données dans les Large Language Modal (LLM), contrairement aux CPU et GPU traditionnels. Cette spécialisation, combinée à un compilateur sur mesure, réduit considérablement la latence, offrant une efficacité et une performance accrues.

Bien que conçu principalement pour l’inférence IA, le LPU de Groq ne se prête pas à l’entraînement de modèles en raison de l’absence de mémoire à haute bande passante (HBM). Toutefois, son efficacité énergétique et sa capacité à fonctionner avec des modèles de diffusion en font une solution attrayante pour diverses applications, y compris la génération d’images haute résolution en moins d’une seconde.

Bien que je ne l’ai pas testé, les LPU Groq fonctionnent également avec des modèles de diffusion, et pas seulement des modèles de langage. D’après la démo, il peut générer différents styles d’images à 1024 pixels en moins d’une seconde. C’est assez remarquable.

Groq vs Nvidia : que dit Groq ?

Dans son rapport, Groq affirme que ses LPU sont évolutives et peuvent être reliées entre elles par une interconnexion optique sur 264 puces. Il est possible de les faire évoluer en utilisant des commutateurs, mais cela augmentera le temps de latence. Selon Ross, l’entreprise développe des clusters qui peuvent s’étendre sur 4 128 puces qui seront commercialisées en 2025, et qui sont développées sur le nœud de processus 4 nm de Samsung.

Lors d’un benchmark réalisé par Groq à l’aide de 576 LPU sur un modèle 70B Llama 2, l’inférence AI a été réalisée en un dixième du temps pris par une grappe de GPU H100 de Nvidia.

De plus, les GPU Nvidia ont consommé de 10 à 30 joules d’énergie pour générer des jetons dans une réponse, alors que Groq n’a consommé que de 1 à 3 joules. En résumé, la société affirme que les LPU Groq offrent une vitesse 10x supérieure pour les tâches d’inférence de l’IA à un dixième du coût des GPU Nvidia.

Un futur prometteur pour l’interaction instantanée avec les systèmes IA

Avec la mise en place des LPUs de Groq, les utilisateurs peuvent s’attendre à des interactions quasi instantanées avec les systèmes d’IA, ouvrant la voie à des applications multimodales innovantes. La disponibilité de l’accès API par Groq laisse présager une amélioration significative des performances des modèles d’IA dans un avenir proche.

L’initiative de Groq dans l’espace matériel de l’IA représente une avancée significative, promettant des interactions plus rapides et plus fluides avec les technologies d’intelligence artificielle. Alors que le monde technologique continue d’évoluer, les contributions de Groq pourraient bien marquer un tournant décisif dans notre manière d’interagir avec les machines.

Lire plus
Intelligence Artificielle

L’impact caché de ChatGPT : quand l’IA pèse lourd sur la balance énergétique

c5c4d306 18b8 4d55 9d4d 0d1c8925a58b

Alors que l’intelligence artificielle (IA) s’infiltre de plus en plus dans notre quotidien, peu s’interrogent sur l’empreinte énergétique laissée par ces technologies avancées.

Parmi elles, ChatGPT d’OpenAI, un puissant modèle linguistique, est au cœur d’une problématique cruciale : sa consommation énergétique considérable. Josh Gordon, spécialiste chez Geonode, met en lumière cette question en soulignant que derrière les algorithmes et les codes se cache une consommation d’énergie colossale.

ChatGPT est synonyme d’innovation mais aussi de consommation énergétique élevée. Il est estimé que l’énergie annuelle nécessaire pour alimenter cette technologie pourrait fournir de l’électricité à environ 120 foyers américains moyens.

Cette consommation pose des questions essentielles sur la durabilité des technologies IA.

Pourquoi ChatGPT consomme-t-il autant ?

La réponse réside dans la complexité et la puissance des calculs requis par ChatGPT. Formés sur d’énormes bases de données textuelles, ces modèles nécessitent une capacité de calcul importante pour leur apprentissage et leur fonctionnement quotidien. La formation de ChatGPT consomme à elle seule environ 1,287 gigawattheures (GWh), et son fonctionnement quotidien demande près de 1 GWh, équivalent à l’énergie de 33 000 foyers américains.

La consommation énergétique de ChatGPT n’est pas sans conséquence pour l’environnement. La création de GPT-3, la précédente version de ChatGPT, a généré 552 tonnes de CO2, l’équivalent des émissions annuelles de 120 voitures ou de la consommation électrique de 81 foyers américains. Ces chiffres mettent en perspective l’impact environnemental considérable de ces technologies.

Face à ce constat, la recherche de solutions plus éco-responsables devient impérative. Josh Gordon souligne l’importance de développer des modèles IA plus efficaces, consommant moins d’énergie pour des performances similaires ou supérieures. L’optimisation des infrastructures de serveur, l’utilisation d’énergies renouvelables pour alimenter les datacenters et la conception de modèles moins énergivores sont autant de pistes à explorer pour réduire l’empreinte carbone de l’IA.

Un avenir plus vert pour l’IA

L’histoire de la consommation énergétique de ChatGPT et de ses alternatives souligne un enjeu majeur : la nécessité de concilier progrès technologique et durabilité environnementale. Comme le rappelle Josh Gordon, “L’avenir est quelque chose que nous créons“. Il appartient donc aux acteurs de l’IA de développer des technologies non seulement intelligentes et utiles mais également respectueuses de notre planète.

Cet article met en évidence l’urgence d’adopter des pratiques plus durables dans le développement de l’IA. Alors que les progrès technologiques continuent d’évoluer à un rythme effréné, il est crucial de se questionner sur les moyens de minimiser leur impact environnemental, pour marcher vers un avenir où technologie et écologie peuvent coexister harmonieusement.

Lire plus
Intelligence Artificielle

Google défie ChatGPT avec un interpréteur Python dans Gemini Advanced

Screen 2024 02 22 06.39.48

Dans le monde en constante évolution de la programmation et de l’intelligence artificielle, Google fait un grand pas en avant avec Gemini Advanced, en y ajoutant régulièrement de nouvelles fonctionnalités pour rivaliser avec ChatGPT Plus.

La dernière mise à jour majeure de Gemini Advanced est particulièrement intéressante pour les développeurs et étudiants en informatique : l’intégration d’un interpréteur Python directement dans son interface.

Cette innovation signifie que les utilisateurs n’ont plus besoin de transférer leur code vers des plateformes externes telles que Google Colab ou Replit pour exécuter et tester leurs scripts Python. L’interpréteur Python de Gemini fonctionne de manière analogue à l’interpréteur de code de ChatGPT, mais avec un avantage notable : la possibilité d’éditer le code Python directement dans l’interface et de l’exécuter en un clic.

Google affirme que cette fonctionnalité est une aubaine pour les étudiants et les développeurs, leur permettant de vérifier instantanément la validité de leur code. Contrairement à l’interpréteur de ChatGPT, Gemini permet non seulement d’exécuter du code mais aussi de le modifier sur place grâce à une icône « crayon » dédiée.

Screen 2024 02 22 06.39.29 jpg

Un gain de temps précieux

Cette capacité d’édition et d’exécution de code Python au sein de Gemini Advanced représente un gain de temps précieux. Elle offre aux étudiants la possibilité d’apprendre et de comprendre divers concepts de programmation à travers des exemples de code, en observant comment les modifications du code influent sur les résultats obtenus.

Il est important de noter que cet interpréteur est différent de l’« Exécution de code implicite » introduite avec Bard l’année dernière. Bien que Gemini se concentre exclusivement sur les tâches de codage, ChatGPT offre un interpréteur de code plus polyvalent, capable d’effectuer des analyses de données, de générer des graphiques, de convertir divers formats de fichiers, et bien plus, grâce à une bibliothèque de plus de 300 paquets Python.

L’introduction de cet interpréteur Python au sein de Gemini Advanced est une avancée significative. Espérons que Google continuera d’élargir ses capacités. À noter que cette fonctionnalité est exclusivement disponible sur Gemini Advanced, la version payante de Gemini.

Pas encore en France

Gemini Advanced est alimenté par le puissant modèle Gemini 1.0 Ultra et est proposé à 20 dollars par mois. Actuellement, Google offre deux mois d’essai gratuit, accompagnés d’avantages Google One, tels que 2 To de stockage et un accès à l’IA dans Docs, Gmail, et plus encore. Malheureusement, il n’est pas encore disponible en France.

L’innovation continue de Google avec Gemini Advanced souligne l’importance croissante de l’accès facile et immédiat à des outils de programmation avancés, facilitant ainsi le développement et l’apprentissage du code pour une nouvelle génération de créateurs numériques.

Lire plus
Intelligence Artificielle

Google Gemini : un guide pour booster votre productivité

ca395162 40ff 47eb 8c5c 0dd530092fa8

Google Gemini représente une avancée notable dans le monde des modèles de langage développés par Google AI, se positionnant aux côtés de modèles renommés tels que ChatGPT.

Ce qui distingue Gemini est son ancrage dans les données propriétaires de Google et sa technologie avancée, lui conférant une capacité exceptionnelle à comprendre et interagir avec des entrées en langage naturel. Capable de générer un large éventail de textes créatifs et d’offrir des services de traduction, des réponses informatives, et un soutien dans diverses tâches liées à l’écriture, Gemini se montre comme un outil prometteur pour accroître l’efficacité personnelle et professionnelle.

Bien que Gemini ne soit pas encore disponible en tant qu’application autonome, comprendre et anticiper ses fonctionnalités permettra d’exploiter pleinement les produits Google qui intégreront ses capacités avancées.

Il est important de noter que Google Gemini est en phase de développement continu, avec des mises à jour permanentes concernant son intégration dans la suite de produits Google.

Voici comment Gemini peut booster votre productivité

Amélioration des résultats de recherche et des résumés de Google

  • Trouver des informations plus rapidement : Grâce à la compréhension linguistique de Gemini, le moteur de recherche Google sera encore plus à même de saisir les nuances de vos questions. Vous obtiendrez ainsi plus rapidement des résultats précis.
  • Résumer pour vous : Lorsque vous traitez de grandes quantités de texte (articles longs, rapports, etc.), les outils alimentés par Gemini peuvent fournir des résumés concis pour vous aider à extraire rapidement les informations les plus importantes.

Aide à la rédaction d’e-mail

  • Rédiger des e-mails en un clin d’œil : Que vous ne sachiez pas comment commencer un e-mail ou que vous manquiez simplement de temps, Gemini peut vous aider. Il peut vous suggérer des projets d’e-mails entiers ou vous aider à rédiger des phrases individuelles, ce qui accélère le processus et vous permet de vous concentrer sur la transmission de votre message.
  • Répondre aux e-mails de routine : Pour les e-mails simples et répétitifs, les modèles de type Gemini peuvent prendre en charge l’ensemble de l’interaction, ce qui vous permet de gagner du temps et de l’énergie.

Création de contenu et brainstorming

  • Idées à la demande : Vous avez besoin de nouvelles perspectives ou d’une étincelle de brainstorming ? Gemini peut être un collaborateur fantastique pour le brainstorming et la génération d’idées.
  • Rédaction de plans et de structures de base : Si vous avez le syndrome de la page blanche ou si vous ne savez pas comment structurer un document, Gemini peut vous aider à élaborer des schémas et des structures de base pour une plus grande efficacité.

Amélioration de la rédaction et de l’édition

  • Amélioration de la grammaire et du style : Gemini peut vous aider à repérer les erreurs potentielles et vous proposer des suggestions pour affiner votre écriture, ce qui vous permettra d’obtenir des communications soignées et de qualité professionnelle.
  • Suggestions de réécriture pour plus de clarté et d’impact : Parfois, le bon mot ou la bonne phrase nous échappe. Gemini peut vous proposer des solutions de rechange, afin que vos écrits soient clairs, concis et efficaces.

Recherche et vérification des faits

  • Processus de recherche efficace : Utilisez Gemini pour poser des questions de recherche ciblées et recueillir des informations de manière efficace.
  • Vérification des informations : Comme pour tout outil d’intelligence artificielle, il est essentiel de procéder à des vérifications croisées.

Cependant, Gemini peut aider à localiser rapidement des sources fiables pour valider un fait ou explorer une affirmation.

f965dce7 5c1b 41e6 a7a0 11e36713b8e2

Un mot : prudence

  • Les angles morts de l’IA : Google Gemini est puissant, mais comme tout modèle d’IA, il est important de faire preuve d’esprit critique. Vérifiez ses réponses, reconnaissez les potentiels biais et ne prenez pas ses résultats pour la vérité absolue.
  • Protection de la vie privée : Gardez à l’esprit les données que vous partagez avec Google et les informations que vous fournissez lorsque vous sollicitez Gemini.

Perspectives d’avenir

Gemini est une technologie passionnante qui en est encore au stade du développement. Gardez l’œil ouvert car Google étend les capacités de Gemini au sein de son écosystème de produits — cette technologie a un énorme potentiel pour devenir un moteur de productivité encore plus efficace.

Lire plus