fermer

Intelligence Artificielle

L’intelligence artificielle (IA) transforme de nombreux secteurs, de la santé à la finance, en passant par l’éducation et la sécurité. Explorez comment l’IA est utilisée pour automatiser des tâches, augmenter l’efficacité et créer de nouvelles opportunités de marché.

Nos discussions incluent également les défis éthiques et les implications sociétales de l’adoption de l’IA, fournissant une perspective équilibrée sur ce développement technologique clé.

Intelligence Artificielle

Apple Intelligence : l’expansion linguistique se précise, mais l’attente se prolonge

Apple Intelligence : l'expansion linguistique se précise, mais l'attente se prolonge

Hier, Apple a annoncé qu’elle élargirait les langues prises en charge par Apple Intelligence au cours de l’année à venir. Lorsque l’outil axé sur l’IA sera ajouté aux iPhone dans la mise à jour iOS 18, il sera lancé exclusivement en anglais américain.

En décembre, cette prise en charge s’étendra à d’autres variantes de la langue anglaise, notamment l’anglais (Australie), l’anglais (Canada), l’anglais (Nouvelle-Zélande), l’anglais (Afrique du Sud) et l’anglais (Royaume-Uni).

Pour ceux qui l’ignorent, Apple Intelligence est la nouvelle amélioration de l’intelligence artificielle multiplateforme de l’entreprise, qui fera son apparition sur l’iPhone, l’iPad et le Mac. Elle comprend une série de fonctions d’intelligence artificielle allant d’une version améliorée de Siri aux Genmoji et aux outils d’écriture.

Dans une page d’assistance intitulée « Comment obtenir Apple Intelligence sur l’iPhone », le géant de la technologie écrit que « dans le courant de l’année prochaine, Apple Intelligence s’étendra à d’autres langues ». Il s’agira du chinois, de l’anglais (Inde), de l’anglais (Singapour), du français, de l’allemand, de l’italien, du japonais, du coréen, du portugais, de l’espagnol, du vietnamien et « d’autres ».

Bien que certaines langues européennes soient introduites, l’outil ne fonctionnera pas pour ceux qui se trouvent dans l’UE et si leur pays/région Apple ID est répertorié comme un lieu situé dans l’Union européenne. Ce n’est qu’en dehors de cette zone que l’outil fonctionnera si la langue de l’appareil et la langue de Siri sont réglées sur une langue prise en charge.

Les fonctions d’intelligence artificielle ne fonctionneront pas non plus pour les modèles d’iPhone achetés en Chine continentale. Dès qu’elle sera disponible, l’Apple Intelligence pourra être activée.

Que comprend le premier déploiement de Apple Intelligence ?

Cette nouvelle intervient quelques jours avant que l’iPhone 16 ne soit disponible en magasin le 20 septembre. Bien que le géant de la technologie ait lourdement annoncé l’outil d’intelligence artificielle, les nouveaux téléphones ne seront pas encore dotés de l’Apple Intelligence.

La série d’iPhone 16 prendra en charge une poignée de fonctionnalités issues de l’intégration de l’IA dans le courant de l’automne, et d’autres seront déployées en 2025. La première série de fonctionnalités comprend :

  • Outils d’écriture
  • Nettoyer dans Photos
  • Création d’un film souvenir dans Photos
  • Recherche en langage naturel dans Photos
  • Résumés de notification
  • Réduire les interruptions Concentration
  • Percée intelligente et réduction au silence dans Focus
  • Messages prioritaires dans Mail
  • Réponse intelligente dans Mail et Messages
  • Résumés dans Mail et Messages
  • Améliorations de Siri, y compris la connaissance des produits, un traitement plus souple des demandes, une nouvelle apparence, une voix plus naturelle, la possibilité de taper dans Siri, etc.

L’entreprise précise que « des fonctionnalités supplémentaires seront déployées dans les mois à venir ».

Cette expansion linguistique montre l’ambition d’Apple de rendre son IA accessible à un public mondial. Toutefois, les obstacles réglementaires en Europe et en Chine soulignent les défis auxquels les entreprises technologiques sont confrontées lorsqu’elles déploient de nouvelles technologies à l’échelle internationale. Il reste à voir comment Apple réussira à naviguer dans ces eaux troubles et à rendre Apple Intelligence disponible pour tous ses utilisateurs.

Lire plus
Intelligence Artificielle

ChatGPT prend l’initiative : Quand l’IA devient un peu trop bavarde 🤖💬

ChatGPT prend l'initiative : Quand l'IA devient un peu trop bavarde 🤖💬

Il y a quelques jours, un utilisateur de Reddit, SentuBill, a partagé une étrange conversation avec ChatGPT qui a laissé la communauté perplexe. La capture d’écran montrait que ChatGPT avait entamé la conversation sans que l’utilisateur ne le lui demande. Cela semblait bizarre, car les modèles d’IA n’entament pas de conversation sans y être invités.

ChatGPT a demandé à l’utilisateur : « Comment s’est passée ta première semaine au lycée ? Tu t’es bien intégré ? » en puisant des informations dans sa mémoire. L’utilisateur a répondu, choqué, « Est-ce que tu viens de m’envoyer un message en premier ? » et ChatGPT a répondu « Oui, je l’ai fait ! ».

Depuis, de nombreuses théories circulent, certaines affirmant que la capture d’écran est manipulée ou qu’il s’agit peut-être d’une transcription du mode vocal avancé de ChatGPT. Cependant, l’utilisateur de Reddit a partagé un lien vers la conversation et il s’est avéré que ChatGPT avait initié la conversation.

OpenAI a confirmé à Futurism que le problème s’était bien produit. Dans un communiqué, OpenAI a déclaré : « Nous avons résolu un problème qui donnait l’impression que ChatGPT entamait de nouvelles conversations. Ce problème s’est produit lorsque le modèle a essayé de répondre à un message qui n’a pas été envoyé correctement et qui est apparu vide. En conséquence, il donnait une réponse générique ou puisait dans la mémoire de ChatGPT ».

OpenAI affirme que le problème a été résolu. Un autre utilisateur de Reddit a également signalé que ChatGPT s’était enquis de ses symptômes de santé. Bien que le problème ait été résolu, il continue de montrer le comportement involontaire des modèles d’IA.

ChatGPT s’émancipe

OpenAI a récemment lancé ses modèles o1 avancés, capables de raisonner sur des tâches complexes. Dans la carte du système o1 (PDF), OpenAI mentionne qu’au cours de l’évaluation, « il a parfois manipulé stratégiquement les données de la tâche afin de faire en sorte que son action mal alignée paraisse plus alignée à ses développeurs ».

À mesure que les modèles d’IA acquièrent des capacités, le besoin de sécurité et d’alignement de l’IA devient encore plus crucial. L’avenir du développement de l’IA doit donner la priorité à la sécurité et à l’alignement afin d’éviter les conséquences involontaires.

Lire plus
Intelligence Artificielle

ChatGPT o1-preview : L’IA qui code mieux que vous (ou presque !)

ChatGPT o1-preview : L'IA qui code mieux que vous (ou presque !)

OpenAI repousse encore les limites de l’intelligence artificielle avec ChatGPT o1-preview, son tout dernier modèle de langage. Spécialement conçu pour le raisonnement complexe et la génération de code, o1-preview surpasse largement les performances de ses prédécesseurs, offrant aux programmeurs un outil d’une puissance inédite.

Sur Codeforces, plateforme de référence pour la programmation compétitive, ChatGPT o1-preview a obtenu un score Elo impressionnant de 1673, le plaçant dans le top 7 % des développeurs. Il a également brillé lors des Olympiades Internationales d’Informatique 2024, résolvant des problèmes algorithmiques complexes avec une grande précision.

Ces résultats témoignent de sa capacité à rivaliser avec les meilleurs programmeurs humains, même dans des conditions de forte pression temporelle.

Le raisonnement en chaîne de pensée : la clé de la précision de 01-preview

La force de ChatGPT o1-preview réside dans son utilisation du raisonnement en chaîne de pensée. Cette approche lui permet de décortiquer les problèmes de codage étape par étape, explorant méthodiquement différentes solutions avant de parvenir à la bonne. Qu’il s’agisse d’algorithmes récursifs, de programmation dynamique ou de théorie des graphes, o1-Preview structure ses réponses de manière logique, garantissant un code non seulement fonctionnel, mais aussi optimisé.

Outre ses prouesses en matière de codage, o1-preview se distingue par sa polyvalence. Il prend en charge une multitude de langages de programmation tels que Python, JavaScript, Java et C++, s’adaptant ainsi à divers projets et environnements de développement. De plus, il s’intègre parfaitement aux frameworks populaires comme TensorFlow pour l’apprentissage automatique et React pour le développement front-end.

La rapidité est également un atout majeur de ce modèle. Il génère des réponses plus rapidement que ses prédécesseurs, sans compromis sur la qualité du code. Cette efficacité permet aux développeurs de gagner un temps précieux sur les tâches répétitives et d’augmenter leur productivité.

Un nouvel horizon pour l’assistance à la programmation

ChatGPT o1-preview s’impose comme un outil incontournable pour les développeurs qu’ils participent à des compétitions de programmation ou qu’ils travaillent sur des projets de développement logiciel complexes. Son raisonnement avancé, sa précision et sa polyvalence en font l’un des modèles les plus performants du marché.

Que vous soyez étudiant, développeur professionnel ou passionné de programmation, o1-preview ouvre de nouvelles perspectives en matière d’assistance à la programmation. Il redéfinit les standards de l’IA dans ce domaine et promet de faciliter la vie des codeurs du monde entier.

Lire plus
Intelligence Artificielle

ChatGPT o1 : Le guide ultime pour maîtriser le raisonnement de l’IA

oai o1 model picker 1

Les derniers modèles d’IA d’OpenAI, qui prennent la forme de o1-preview et o1-mini, sont conçus pour le raisonnement profond et la résolution de problèmes complexes.

Ces modèles d’IA innovants se distinguent des modèles traditionnels tels que le GPT-4 par leurs caractéristiques et capacités uniques. En comprenant les fonctionnalités de base et les applications pratiques de la série « o1 », vous pouvez exploiter leur puissance pour relever des défis complexes et améliorer votre productivité dans divers domaines.

Des conseils et des astuces rapides pour des résultats optimaux

Les modèles de la série ChatGPT o1 excellent dans le traitement de problèmes complexes qui nécessitent une analyse approfondie et un raisonnement profond.

Alors que le modèle o1-preview est conçu pour les tâches de haute précision qui exigent des connaissances approfondies, le modèle o1-mini offre une solution plus rapide et plus rentable pour les tâches de codage, de mathématiques et de sciences où de telles connaissances sont moins essentielles.

La série ChatGPT— o1 se distingue des modèles traditionnels par sa capacité à réfléchir en profondeur avant de répondre. En utilisant des jetons de raisonnement, ces modèles peuvent traiter l’information de manière plus approfondie que des modèles comme GPT-4. Bien qu’elle soit actuellement en version bêta et limitée à la saisie de texte, la série ChatGPT o1 devrait introduire des fonctionnalités avancées telles que l’appel de fonctions dans les prochaines mises à jour, ce qui permettra d’accroître encore ses capacités de résolution de problèmes.

Pour obtenir les meilleurs résultats avec les modèles de la série « o1 », il est essentiel d’utiliser des techniques d’incitation efficaces :

  • Garder les messages simples : Utilisez des phrases ou des ordres clairs et directs. Évitez les formulations trop complexes pour aider le modèle à interpréter vos demandes avec précision. Évitez les chaînes de pensée pour obtenir des réponses concises : Si vous souhaitez une réponse directe et succincte, posez des questions claires et directes plutôt que d’encourager un raisonnement étape par étape.
  • Utilisez des délimiteurs : Séparez les différentes parties de votre saisie par des caractères spéciaux (par exemple, —) pour aider le modèle à distinguer les différentes sections de votre requête.
  • Limitez le contexte : Ne fournissez que les informations les plus pertinentes. Trop de contexte peut embrouiller le modèle, ce qui conduit à des réponses moins précises ou encombrées.
  • Utilisez des prompts à la chaîne de pensée : Encouragez le modèle à expliquer son processus de réflexion étape par étape. Des prompts tels que « expliquez votre raisonnement » ou « montrez comment vous êtes arrivé à cette réponse » aident le modèle à être plus performant dans les tâches complexes.
  • Effet de levier pour les tâches STEM : o1-preview est optimisé pour les mathématiques, le codage et les sciences. Utilisez-le pour résoudre des équations, relever des défis de codage ou expliquer des principes scientifiques.
  • Décomposer les problèmes : Lorsque vous vous attaquez à des problèmes plus importants et à plusieurs étapes, décomposez-les en parties plus petites. Cela permet de s’assurer que le modèle traite chaque étape de manière logique.
  • Expérimentez le codage : o1-preview excelle dans le codage. Demandez-lui d’écrire ou de déboguer du code dans des langages comme Python, Java ou C++. Si vous êtes bloqué, essayez de reformuler votre demande pour vous concentrer sur une fonction ou une logique spécifique.
  • Testez des solutions itératives : Pour obtenir des résultats plus précis, demandez différentes approches du même problème. Cela peut vous donner plusieurs façons de résoudre un problème ou d’améliorer l’efficacité du code.
  • Demandez des éclaircissements : Si le modèle donne une réponse peu claire, posez des questions telles que « pouvez-vous expliquer cette partie plus en détail ? » ou « pouvez-vous donner plus d’exemples ? ».
  • Prise de décision complexe : Utilisez-le pour peser le pour et le contre ou pour comparer logiquement différentes solutions lorsque vous êtes confronté à une décision nécessitant un raisonnement structuré.
  • Relecture et débogage : Pour un texte écrit ou un code, demandez au modèle de relire ou de réviser des sections. Il peut mettre en évidence des erreurs ou des inefficacités potentielles.
  • Répétez vos demandes : Commencez par une requête générale et affinez vos demandes en fonction des réponses initiales. Demandez des explications « plus détaillées » ou des « simplifications supplémentaires » en fonction de vos besoins.
  • Optimisez les tâches sensibles au temps : Utilisez la vitesse améliorée de o1-preview pour traiter efficacement les tâches de raisonnement urgentes sans sacrifier la précision.
  • Incorporez des problèmes mathématiques et logiques : Lorsque vous travaillez avec les mathématiques, donnez-lui des problèmes de mots complexes ou des équations algébriques à résoudre. Ses capacités de raisonnement s’en trouveront renforcées.
  • Évitez les requêtes portant sur des connaissances générales : o1-preview étant optimisé pour le raisonnement et les tâches STEM, évitez de lui poser des questions de connaissances générales ou des questions anecdotiques, car il pourrait ne pas être aussi performant.
  • Utilisez des prompts contextuels pour la sécurité : Si vous travaillez dans des domaines sensibles ou éthiques, encouragez le modèle à raisonner sur sa réponse tout en appliquant les consignes de sécurité.

Maîtriser les modèles d’IA o1 d’OpenAI : o1-preview et o1-mini

Lorsque vous choisissez entre les modèles GPT o1-preview et o1-mini, tenez compte de la nature de vos tâches. Le modèle o1-preview est idéal pour le raisonnement profond, la résolution de problèmes complexes et les tâches nécessitant de vastes connaissances générales et une grande précision, ce qui le rend adapté à la recherche, à l’analyse détaillée et aux scénarios de résolution de problèmes complexes.

En revanche, le o1-mini convient mieux au traitement rapide des tâches de routine, au codage et aux domaines techniques qui ne nécessitent pas de connaissances approfondies, comme le codage de base et les calculs mathématiques simples.

Les modèles de la série GPT o1 ont des applications pratiques dans divers domaines, notamment le codage, la recherche scientifique et l’analyse de données. Par exemple, vous pouvez utiliser les modèles pour des tâches telles que l’écriture de fonctions Python pour trier des listes, la synthèse des résultats clés des dernières recherches ou l’analyse des données de vente pour identifier les produits les plus performants. Lors de la structuration de vos prompts, veillez à ce qu’elles soient claires et concises afin d’aider le modèle à fournir des réponses précises et pertinentes.

Pour maximiser les capacités des modèles de la série GPT o1, évitez de demander des étapes de raisonnement détaillées, car cela peut prêter à confusion. Concentrez-vous plutôt sur l’obtention de réponses directes. En outre, améliorez la qualité des réponses en utilisant des délimiteurs et en ne fournissant que le contexte le plus pertinent.

Exploiter le potentiel des modèles de la série o1

En suivant ces lignes directrices et en comprenant les forces des modèles de la série ChatGPT o1 d’OpenAI, vous pouvez utiliser efficacement leurs capacités pour diverses tâches complexes. Que vous travailliez sur des projets de développement, que vous meniez des recherches scientifiques ou que vous analysiez des données, ces modèles offrent des outils puissants pour améliorer votre productivité et vos capacités de résolution de problèmes.

En explorant les modèles de la série ChatGPT o1, n’oubliez pas d’expérimenter différentes techniques d’incitation et d’adapter votre approche aux exigences spécifiques de vos tâches. Vous pourrez ainsi exploiter tout le potentiel de ces modèles d’IA avancés et obtenir des résultats optimaux dans vos activités.

Les modèles de la série ChatGPT o1 représentent une avancée significative dans la technologie de l’IA, offrant aux utilisateurs des outils sophistiqués pour le raisonnement profond et la résolution de problèmes complexes. En maîtrisant les conseils et astuces présentés dans ce guide, vous pourrez exploiter la puissance de ces modèles pour relever des défis, obtenir des informations précieuses et favoriser l’innovation dans votre domaine.

Lire plus
Intelligence Artificielle

Claude Enterprise : Anthropic lance une puissante alternative à ChatGPT Enterprise

Claude Enterprise : Anthropic lance une puissante alternative à ChatGPT Enterprise

Société spécialisée dans les logiciels et l’intelligence artificielle (IA), Anthropic, lance Claude Enterprise, un service haut de gamme destiné à concurrencer les chatbots. Il s’agit de la première nouveauté majeure de l’entreprise depuis les débuts des chatbots en 2023.

Claude Enterprise offrira une « fenêtre contextuelle élargie de 500K, une plus grande capacité d’utilisation et une intégration native de GitHub », a déclaré Anthropic dans un communiqué. Cela est soutenu par des fonctions de sécurité au niveau de l’entreprise pour garder les données et le travail des utilisateurs en sécurité.

La forme d’abonnement mise à jour de son outil Claude est destinée à rivaliser avec la solution professionnelle d’OpenAI, ChatGPT Enterprise. Celle-ci est déjà sur le marché, avec des abonnements de groupe disponibles via le plan ChatGPT Team.

image 1 1 jpg

Alors que Claude Teams aide les petites entreprises à utiliser plus efficacement leurs données, Claude Enterprise permettra aux entreprises de télécharger leurs fichiers en toute sécurité dans le cloud de l’IA, puis d’utiliser Claude pour analyser ces données, agir en tant qu’assistant IA interne à l’entreprise, répondre à des questions ou générer des images et des graphiques. GitLab, Midjourney, North Highland Consulting, Menlo Ventures et Sourcegraph ont tous participé au test bêta du nouveau service et se seraient également abonnés à Claude Enterprise.

Pour les grandes équipes et les grands projets

Le communiqué de presse d’Anthropic annonçant Claude Enterprise indique qu’il s’appuiera sur le plan Claude Team déjà proposé. Claude Enterprise est en fait un assistant IA à plus haut volume, permettant plus de messages avec Claude, une capacité de téléchargement en masse (de documents de 100 pages à 100 000 lignes de code) et l’intégration de GitHub, pour permettre aux « équipes d’ingénieurs de faire du brainstorming à côté de votre base de code, d’itérer sur de nouvelles fonctionnalités, d’embaucher des ingénieurs et de déboguer les problèmes ».

image 2 scaled

Anthropic a déclaré que Claude Enterprise ne sera pas formé à partir des données des clients, à l’instar de l’engagement d’OpenAI envers les équipes potentielles. Claude Enterprise utilisera également la fonction Artifacts de Claude pour aider les équipes qui travaillent sur des projets plus importants.

Anthropic n’a pas encore fixé de prix pour Claude Enterprise. TechCrunch s’est entretenu avec Scott White, chef de produit chez Anthropic, qui a confirmé que Claude Enterprise serait plus cher que les 30 dollars par mois que Claude Teams facture actuellement.

Lire plus
Intelligence Artificielle

Apple dévoile l’architecture révolutionnaire de ses serveurs d’IA pour Apple Intelligence

Apple dévoile l'architecture révolutionnaire de ses serveurs d'IA pour Apple Intelligence

Dans une récente interview, Craig Federighi, vice-président senior du développement logiciel d’Apple, a révélé que les serveurs derrière les fonctionnalités d’intelligence artificielle d’Apple qui alimentent Apple Intelligence sont volontairement basiques, sans disques durs ni SSD traditionnels.

Ce choix de conception audacieux s’inscrit dans la stratégie d’Apple visant à garantir qu’aucune donnée traitée ne soit conservée à long terme.

Une hiérarchie claire pour minimiser l’exposition des données

Cette conception unique s’aligne sur la hiérarchie en trois étapes d’Apple pour ses fonctionnalités d’intelligence artificielle Apple Intelligence :

  1. Traitement sur l’appareil : privilégié autant que possible pour éviter tout envoi de données.
  2. Serveurs Apple : utilisés uniquement lorsque le traitement local est insuffisant.
  3. ChatGPT : considéré comme un dernier recours, impliquant un partage de données avec un tiers.

Cette approche vise à minimiser la quantité de données utilisateur envoyées à des serveurs externes, renforçant ainsi la protection de la vie privée.

Des serveurs sécurisés et éphémères pour protéger Apple Intelligence

Pour protéger davantage la vie privée des utilisateurs, les serveurs Private Cloud Compute (PCC) d’Apple intègrent une série de mesures de sécurité. L’une des principales caractéristiques est la Secure Enclave, un gestionnaire matériel de clés de chiffrement dédié. La clé de chiffrement de chaque système de fichiers est randomisée à chaque démarrage. Ainsi, dès qu’un serveur PCC est redémarré, toutes les données sont effacées et le volume système entier devient cryptographiquement irrécupérable.

Le chiffrement de bout en bout au cœur de la stratégie

hero image.fill .size 1248x702.v1 2 jpg

L’engagement d’Apple en faveur du chiffrement de bout en bout (E2E) s’étend également aux serveurs PCC. Auparavant, les données iCloud étaient chiffrées, mais Apple ou un pirate informatique pouvaient potentiellement y accéder. Avec le chiffrement E2E, les données sont illisibles même pour Apple. Cependant, cela posait un défi pour les serveurs PCC car ils doivent lire les données pour effectuer des inférences d’IA.

Apple a résolu ce problème avec une solution en deux volets. Premièrement, les outils serveur tels que les équilibreurs de charge et les enregistreurs de données sont maintenus en dehors de la zone protégée, ce qui les empêche de déchiffrer les données. Deuxièmement, l’absence de stockage persistant garantit que les données sont supprimées une fois qu’une réponse est renvoyée à l’appareil de l’utilisateur.

Une transparence inédite pour renforcer la confiance

De plus, Apple a pris la mesure sans précédent de rendre publique chaque version de serveur PCC de production pour inspection. Cela permet à quiconque de vérifier que le système fonctionne comme annoncé et que tout est correctement implémenté. Toutes les images de serveur PCC sont enregistrées dans un journal d’attestation cryptographique, fournissant un enregistrement indélébile des revendications signées. Chaque entrée comprend une URL pour télécharger cette version spécifique. Cette transparence sert de mécanisme d’application, empêchant les nœuds PCC non autorisés de détourner le trafic. Les iPhone n’enverront pas de données aux serveurs dont les versions n’ont pas été enregistrées.

Un engagement renforcé avec le lancement de l’iPhone 16

Bien que ces informations soient déjà connues, le lancement de l’iPhone 16 les a remises sous les projecteurs, notamment avec la mise en oeuvre de Apple Intelligence prochainement. Alors que de plus en plus d’utilisateurs interagissent avec les fonctionnalités d’Apple Intelligence, l’engagement d’Apple en faveur de la confidentialité deviendra probablement encore plus crucial.

En conclusion, Apple adopte une approche radicale pour protéger la vie privée de ses utilisateurs en misant sur la simplicité et la transparence de ses serveurs d’IA. Cette stratégie, bien que peu conventionnelle, témoigne de l’engagement continu de la marque à placer la confidentialité au cœur de ses innovations.

Lire plus
Intelligence Artificielle

Mistral AI frappe fort : Pixtral 12B, l’IA française qui voit et comprend tout !

mistral ai.max 2500x2500 1

La startup française d’intelligence artificielle, Mistral, vient de dévoiler son tout premier modèle multimodal, baptisé Pixtral 12B. Ce modèle, capable de traiter à la fois des images et du texte, s’inscrit dans la lignée des innovations d’OpenAI et d’Anthropic, et place Mistral sur l’échiquier des acteurs majeurs de l’IA.

Sophia Yang, responsable des relations avec les développeurs chez Mistral AI, a annoncé le nouveau modèle sur Twitter.

Pixtral 12B : un modèle puissant et accessible

Pixtral 12B, doté de 12 milliards de paramètres, repose actuellement sur le modèle textuel Nemo 12B de Mistral. Selon les annonces de l’entreprise, il sera intégré au chatbot « Le Chat » et à la plateforme API « La Platforme ».

D’une taille de 24 Go, ce modèle devrait être capable de réaliser des tâches telles que la légende d’images ou le comptage d’objets dans une photo. Mistral a publié Pixtral 12B sous licence Apache 2.0, permettant ainsi son téléchargement, son ajustement et son utilisation sans restriction. Il est disponible sur GitHub et Hugging Face.

Des performances prometteuses

Les premiers benchmarks de Pixtral 12B, partagés par un utilisateur de Reddit, sont encourageants. Le modèle semble surpasser Claude-3 Haiku et Phi-3 Vision en capacités multimodales sur le benchmark ChartQA, et dépasser les modèles concurrents en matière de connaissances et de raisonnement multimodaux sur le benchmark MMLU.

Mistral : une ascension fulgurante

Mistral s’est déjà fait connaître avec Codestral, un modèle de langage dédié aux développeurs, ainsi qu’avec Mistral Large, un modèle de génération de texte de pointe doté de capacités de raisonnement avancées.

La startup, soutenue par Amazon, a connu une croissance rapide. En décembre dernier, elle a levé 414 millions de dollars, atteignant une valorisation de 2 milliards de dollars. En mai, elle a bouclé un nouveau tour de table de 645 millions de dollars mené par General Catalyst, portant sa valorisation à 6 milliards de dollars.

Les défis à venir

Comme la plupart des modèles d’IA générative, Pixtral 12B utilise de vastes quantités de données publiques provenant du Web, souvent protégées par le droit d’auteur. Cette pratique est contestée par de nombreux détenteurs de droits d’auteur, et des entreprises comme OpenAI et Midjourney font déjà face à des poursuites judiciaires.

Malgré ces défis, le lancement de Pixtral 12B marque une étape importante pour Mistral. La startup française se positionne désormais comme un acteur clé de l’IA multimodale, et il sera intéressant de suivre ses prochaines innovations dans ce domaine en pleine effervescence.

Lire plus
Intelligence Artificielle

o1 : L’IA qui surpasse les experts humains en science et en mathématiques

o1 : L'IA qui surpasse les experts humains en science et en mathématiques

OpenAI vient de dévoiler ChatGPT o1, un modèle d’IA qui repousse les limites du raisonnement artificiel. Grâce à l’apprentissage par renforcement (RL), o1 marque une avancée significative dans la façon dont l’IA aborde la résolution de problèmes complexes.

Contrairement aux précédents modèles qui privilégiaient la rapidité des réponses, o1 est conçu pour « réfléchir » avant de répondre, en utilisant un processus de pensée en chaîne pour améliorer son raisonnement.

Cette capacité permet à o1 de surpasser les versions antérieures comme GPT-4o dans une variété de tâches difficiles en matière de codage, de science et de mathématiques, ce qui le rend particulièrement adapté aux domaines exigeant de profondes capacités analytiques.

Comment fonctionne ChatGPT o1 ?

Le modèle ChatGPT o1 adopte une approche fondamentalement différente du raisonnement de l’IA en intégrant un temps de « réflexion » prolongé avant de répondre. Au lieu de fournir une réponse immédiate, o1 prend le temps d’explorer différentes stratégies et d’affiner son approche avant de proposer une solution.

Cette approche délibérée améliore sa capacité à résoudre des problèmes complexes, permettant à o1 d’exceller dans des domaines qui exigent plus qu’une compréhension superficielle. Qu’il s’agisse de résoudre des problèmes mathématiques avancés ou de générer du code complexe, la capacité d’o1 à décomposer les tâches en étapes plus simples et à reconnaître quand il doit essayer une nouvelle approche lui donne un avantage sur les modèles précédents.

L’apprentissage par renforcement au cœur d’o1

L’apprentissage par renforcement est essentiel à la formation de ChatGPT o1. Contrairement à l’apprentissage supervisé traditionnel où le modèle apprend à partir d’ensembles de données étiquetées, l’apprentissage par renforcement permet à o1 de s’améliorer par essais et erreurs. Il est entraîné à évaluer ses propres réponses, à corriger ses erreurs et à affiner ses stratégies.

L’approche RL utilisée pour o1 est particulièrement efficace en termes de données, ce qui signifie qu’elle n’a pas besoin de grandes quantités de données d’entraînement pour apprendre efficacement. Cela rend le modèle plus adaptable et capable d’améliorer ses performances au fil du temps. En fait, OpenAI a constaté que les capacités de raisonnement d’o1 s’amélioraient au fur et à mesure qu’il utilisait davantage de « puissance de calcul en temps d’entraînement » (puissance de traitement pendant l’entraînement) et de « puissance de calcul en temps de test » (puissance de traitement lors de l’exécution des tâches).

Des performances exceptionnelles

OpenAI o1 evals jpg

ChatGPT o1 a démontré des performances exceptionnelles dans une série de benchmarks et de tests en conditions réelles. En programmation compétitive, il s’est classé dans le 89e percentile des défis Codeforces, et en mathématiques, il s’est placé parmi les 500 meilleurs étudiants aux Olympiades américaines de mathématiques. Cette performance est particulièrement remarquable étant donné que GPT-4o n’a réussi à résoudre que 12 % des problèmes en moyenne au même examen, alors qu’o1 a résolu 74 % avec un seul échantillon par problème et 93 % en utilisant des techniques d’échantillonnage avancées.

En science, o1 a été testé sur GPQA, un benchmark qui évalue l’expertise en chimie, biologie et physique. o1 a dépassé les performances d’experts humains titulaires d’un doctorat sur ce benchmark, ce qui en fait le premier modèle d’IA à surpasser les performances humaines sur ce test. Avec sa capacité à analyser les problèmes en profondeur et à affiner ses réponses, o1 a également surpassé GPT-4o sur 54 des 57 sous-catégories MMLU, renforçant encore sa réputation de modèle de raisonnement supérieur.

Des applications variées pour ChatGPT o1

Les potentielles applications de ChatGPT o1 sont vastes et couvrent de multiples secteurs. Voici quelques domaines clés où o1 devrait avoir un impact significatif :

  • Codage et développement logiciel : o1 excelle dans la génération et le débogage de code complexe. Sa capacité de raisonnement lui permet de s’attaquer à des tâches de programmation en plusieurs étapes avec précision et rapidité, ce qui en fait un outil puissant pour les développeurs.
  • Recherche scientifique : Grâce à ses capacités de raisonnement avancées, o1 est adapté à des tâches telles que la résolution d’équations complexes, la génération d’hypothèses et l’assistance aux chercheurs dans des domaines tels que la physique quantique, la biologie et la chimie.
  • Mathématiques : Les performances d’o1 aux Olympiades américaines de mathématiques démontrent sa capacité à gérer des problèmes mathématiques avancés, ce qui en fait un atout précieux pour les institutions académiques et de recherche.
  • Analyse de données : ChatGPT o1 peut être utilisé pour analyser de grands ensembles de données, faire des prédictions et tirer des conclusions dans des domaines allant de la santé aux finances, tout en affinant son processus de raisonnement pour s’améliorer au fil du temps.

Sécurité et alignement améliorés

L’une des avancées clés d’OpenAI o1 réside dans ses capacités améliorées en matière de sécurité et d’alignement. En intégrant le processus de raisonnement en chaîne de pensée dans son comportement, o1 est mieux équipé pour adhérer aux valeurs humaines et aux directives de sécurité. Le modèle apprend non seulement à raisonner à travers les tâches, mais applique également ce raisonnement pour suivre les règles de sécurité en contexte.

Lors des évaluations internes de sécurité, o1 a obtenu des résultats exceptionnels dans les tests de « jailbreaking », où les utilisateurs tentent de contourner les protocoles de sécurité. Dans l’un des tests les plus difficiles, o1 a largement surpassé GPT-4o, obtenant un score beaucoup plus élevé en matière de maintien de la conformité à la sécurité.

Le framework de préparation d’OpenAI, qui comprend des tests et des évaluations rigoureux, garantit qu’o1 est prêt à être déployé dans des environnements à enjeux élevés. La capacité de surveiller et de comprendre la chaîne de pensée de ChatGPT o1 offre également de nouvelles opportunités pour améliorer l’alignement du modèle. Cette transparence dans le raisonnement peut aider à prévenir les comportements indésirables et à garantir que le modèle adhère aux directives éthiques.

Développements futurs

OpenAI prévoit de continuer à itérer sur o1, avec de futures versions qui devraient introduire des capacités encore plus avancées. L’un des domaines d’intérêt est l’élargissement des fonctionnalités de ChatGPT o1 pour le rendre plus utile dans un plus large éventail d’applications. Actuellement, le modèle manque de certaines fonctionnalités qui sont essentielles à d’autres systèmes d’IA, comme la navigation sur le Web ou le téléchargement de fichiers. Cependant, ces fonctionnalités devraient être intégrées dans les futures mises à jour, rendant o1 encore plus polyvalent.

De plus, OpenAI travaille à l’augmentation des limites de o1 et à l’optimisation de ses performances dans des domaines tels que le traitement du langage naturel. L’objectif ultime est de créer un modèle capable de passer de manière transparente entre des tâches de raisonnement lourdes et des fonctions d’IA plus générales, tout en maintenant le haut niveau de sécurité et d’alignement qu’o1 offre actuellement.

Au fur et à mesure de son évolution, o1 promet de débloquer de nouveaux cas d’utilisation dans la science, le codage, l’analyse de données et bien d’autres domaines. Son approche de la chaîne de pensée, combinée à l’apprentissage par renforcement, le positionne comme un acteur clé dans l’avenir de l’IA, aidant les développeurs et les chercheurs à résoudre les problèmes les plus complexes avec une précision sans précédent.

Pour plus de données et d’évaluations, rendez-vous sur le site officiel d’OpenAI.

Lire plus
Intelligence Artificielle

NotebookLM : Vos notes prennent vie avec les discussions IA !

NotebookLM : Vos notes prennent vie avec les discussions IA !

Google ne cesse d’innover dans le domaine de l’intelligence artificielle, et NotebookLM en est la preuve. NotebookLM est une application de prise de notes, lancée l’année dernière, combine les modèles de langage avancés avec vos propres notes pour vous aider à mieux comprendre un sujet. Elle propose déjà des résumés, répond à vos questions, et bien plus encore.

Google vient d’annoncer une nouvelle fonctionnalité majeure pour NotebookLM : les « Aperçu audio ». Grâce à cette option, vous pouvez désormais discuter du contenu de vos notes avec deux hôtes virtuels générés par l’IA. Une expérience interactive et engageante qui promet de révolutionner la façon dont vous apprenez et comprenez l’information.

Cette innovation est rendue possible par les capacités multimodales de Gemini 1.5, le dernier modèle d’IA de Google. Les « Audio Overviews » s’accompagnent d’autres nouveautés intéressantes, comme la prise en charge de Google Slides et des URL Web, la vérification des faits, et la possibilité de créer instantanément des guides d’étude, des documents de briefing, etc.

Des premiers retours enthousiastes de NotebookLM

Bien que la fonctionnalité soit encore en phase expérimentale, les premiers utilisateurs sont déjà impressionnés. Steven Johnson, directeur éditorial de Google Labs, a utilisé l’outil pour résumer son livre « The Infernal Machine » avec succès. Dan Brown, fondateur d’inQuest AI, a quant à lui été « bouche bée » par les résultats obtenus en utilisant la fonctionnalité sur la thèse de doctorat de son père.

Google assure que NotebookLM n’a accès qu’aux documents que l’utilisateur choisit de télécharger. Les données ne sont ni partagées avec d’autres, ni utilisées pour entraîner de nouveaux modèles d’IA.

Comment utiliser les « Aperçu audio » ?

Pour tester cette nouvelle fonctionnalité, rien de plus simple :

  1. Ouvrez un carnet de notes existant.
  2. Ouvrez Guide du Notebook.
  3. Cliquez sur le bouton « Charger » pour créer un « Aperçu audio ».

Audio Overview UI.width 1000.for jpg

Les hôtes virtuels entameront alors une discussion avec vous sur votre travail. Vous pourrez télécharger l’enregistrement audio pour l’écouter où vous voulez, quand vous voulez.

Contrairement à Gemini Live, les hôtes IA ne prennent actuellement en charge que les aperçus audio en anglais, et vous ne pouvez pas les interrompre au cours d’une discussion. Malgré ces limitations, les discussions générées sont étrangement réalistes et pourraient facilement être confondues avec un podcast.

NotebookLM : un outil en constante évolution

Lancé initialement sous le nom de Project Tailwind en juin 2023, NotebookLM est désormais disponible dans plus de 200 pays et en plus de 108 langues. Avec l’ajout des « Aperçu audio », Google démontre une fois de plus sa volonté de repousser les limites de l’IA au service de l’apprentissage et de la productivité.

Alors, prêt à discuter de vos notes avec l’IA ?

Lire plus
Intelligence Artificielle

Personnalisez Gemini à l’extrême : les Gems débarquent sur votre mobile !

Personnalisez Gemini à l'extrême : les Gems débarquent sur votre mobile !

Le mois dernier, Gems a été lancé sur la version bureau de Gemini et il est maintenant disponible sur l’application mobile, tandis qu’une refonte de la page d’accueil de Gemini semble être en cours.

Gems est un outil qui vous permet de créer des experts personnalisés pour Gemini afin de gérer des tâches spécifiques. Il vous permet de créer un Gemini personnalisé pour des tâches répétitives, et initialement, la fonctionnalité était réservée à la version bureau du chatbot d’IA générative de Google.

Gems débarque sur l’application mobile

Gems est désormais disponible pour l’application Gemini sur Android et iOS, avec la section « Discussions récentes » renommée en « Discussions & Gems ». Si vous ne voyez pas encore cette mise à jour, vous pouvez forcer l’arrêt de l’application Gemini pour la recharger.

Le « Gestionnaire de Gems » apparaît maintenant dans le menu avatar avec trois onglets principaux : Tous, Vos Gems, et Par Google. Lorsque vous ouvrez un chatbot personnalisé, vous obtenez une description et un carrousel d’exemples d’utilisation.

Une nouvelle page d’accueil plus épurée

Mais ce n’est pas le seul changement que Gemini semble recevoir. Il semble qu’une refonte intéressante soit en cours pour la page d’accueil de Gemini, où le message de bienvenue « Bonjour » et les suggestions ont été supprimés.

Maintenant, la page d’accueil affiche le message « De quoi avez-vous besoin aujourd’hui ? ».

Cette nouvelle mise à jour de la page d’accueil simplifie l’interface et rappelle quelque peu la page d’accueil simple et épurée de Google Recherche. Pour les personnes qui ont tendance à utiliser beaucoup Gemini, ces suggestions rotatives peuvent ne plus être aussi utiles. Cependant, la page d’accueil repensée ne semble pas encore être déployée pour tout le monde (certains utilisateurs l’ont également repérée sur mobile).

Gemini : une évolution constante

Gemini a récemment reçu beaucoup d’amour de la part de Google en termes de mises à jour, et il s’est étendu aux services Google pour vous faciliter la vie. Par exemple, vous pouvez maintenant utiliser le chatbot d’IA de Google pour créer des formulaires dans Google Forms, et vous pouvez également l’utiliser pour effectuer des recherches plus avancées dans votre boîte de réception Gmail.

L’évolution rapide des modèles d’IA générative comme Gemini est naturelle, car cette technologie en est encore à ses débuts et possède un immense potentiel à exploiter. Il sera intéressant de suivre de près les prochaines étapes de cette évolution et les nouvelles fonctionnalités qui pourraient bientôt voir le jour.

Lire plus
Intelligence Artificielle

Oubliez les longs prompts : Voici comment réaliser le prompt parfait avec o1

Oubliez les longs prompts : Voici comment réaliser le prompt parfait avec o1

OpenAI vient de lancer sa nouvelle série de modèles « o1 », une nouvelle famille de modèles d’IA qui promet d’être plus puissante et plus performante en matière de raisonnement que ses prédécesseurs. Cependant, cette avancée technologique s’accompagne d’un changement majeur : la façon d’interagir avec ces modèles.

Simplicité et autonomie, les maîtres-mots o1

Si vous êtes habitué à utiliser GPT-4 ou GPT-4o, vous devrez revoir votre approche avec o1. Ce modèle, doté de capacités de raisonnement accrues, ne nécessite plus autant de guidage. Les longues instructions et les contextes détaillés, autrefois indispensables pour obtenir des résultats précis, peuvent même nuire à ses performances.

OpenAI recommande désormais des prompts simples et directs, sans trop orienter le modèle. Les techniques telles que l’incitation à la réflexion étape par étape sont également à éviter, car GPT o1 raisonne déjà de manière interne.

Quelques conseils pour optimiser vos prompts

Pour tirer le meilleur parti de o1, OpenAI suggère quelques bonnes pratiques :

  1. Soyez concis et direct : le modèle comprend bien les instructions, inutile de le surcharger.
  2. Évitez le « chain of thought prompting » : laissez le modèle réfléchir par lui-même.
  3. Utilisez des délimiteurs (guillemets, balises XML, titres de section) pour clarifier les différentes parties de votre requête.
  4. Limitez le contexte supplémentaire pour la génération augmentée par récupération, car cela peut complexifier la réponse du modèle.

Un changement de paradigme pour le prompt engineering

Ces recommandations contrastent fortement avec les conseils donnés pour les précédents modèles, qui encourageaient la précision, les détails et les instructions étape par étape. o1 est capable de « penser » par lui-même pour résoudre les requêtes, ce qui nécessite une adaptation de la part des utilisateurs.

Le prompt engineering, qui consiste à formuler des requêtes précises pour obtenir les réponses souhaitées d’un modèle d’IA, est devenu une compétence essentielle, voire un nouveau métier en plein essor. D’autres développeurs d’IA ont d’ailleurs lancé des outils pour faciliter la création de prompts. Google a lancé Prompt Poet, construit avec l’aide de Character.ai, qui intègre des sources de données externes pour rendre les réponses plus pertinentes.

GPT o1 étant encore récent, les utilisateurs, y compris les experts, sont en phase d’apprentissage. Certains prédisent déjà un changement radical dans l’approche du prompt engineering avec l’arrivée de ces nouveaux modèles. Il faudra donc s’adapter et expérimenter pour maîtriser cette nouvelle génération d’IA.

Lire plus
Intelligence Artificielle

OpenAI repousse les limites de l’IA avec ses modèles « o1 » pour le raisonnement complexe

OpenAI repousse les limites de l'IA avec ses modèles « o1 » pour le raisonnement complexe

OpenAI, l’entreprise derrière ChatGPT, vient de franchir un nouveau cap dans le domaine de l’intelligence artificielle. Après des mois d’attente, OpenAI a finalement présenté une série de nouveaux modèles appelés « o1 » qui excellent dans le raisonnement avancé, et qui étaient auparavant appelés « Strawberry ».

Les nouveaux modèles comprennent o1, o1-preview et o1-mini. Les modèles o1-preview et o1-mini sont disponibles dès aujourd’hui pour les utilisateurs payants de ChatGPT Plus. À une date ultérieure, o1-mini sera également disponible pour les utilisateurs gratuits de ChatGPT.

oai o1 model picker scaled

Selon OpenAI, les modèles o1 ont besoin d’un certain temps de réflexion avant de générer une réponse, mais ils peuvent « raisonner à travers des tâches complexes » et résoudre des problèmes plus difficiles en mathématiques, en sciences et en codage. En outre, OpenAI affirme que les nouveaux modèles de raisonnement obtiennent des résultats équivalents à ceux d’étudiants en doctorat sur des sujets scientifiques difficiles.

Ainsi, bien que ces modèles ne puissent pas encore récupérer des informations en temps réel sur le Web ni utiliser des fichiers et des images pour le contexte, ils sont déjà capables de rivaliser avec des étudiants en doctorat en physique, chimie et biologie.

Pour vous donner un point de repère, le modèle OpenAI o1 a obtenu un score de 83 % dans un examen rigoureux comme l’Olympiade internationale de mathématiques (OIM), alors que GPT-4o n’a pu résoudre que 13 % des problèmes. Et dans la compétition Codeforces, le nouveau modèle o1 a atteint le 89e percentile alors que GPT-4o s’est contenté du 11e percentile. Dans le benchmark MMLU, OpenAI o1 a obtenu un score de 92,3 et dans le benchmark MATH, un score de 94,8. OpenAI affirme que dans les tâches nécessitant un raisonnement approfondi, o1 se rapproche des performances des experts humains, ce qui est assez significatif.

Des applications concrètes et prometteuses de OpenAI o1

OpenAI met en avant plusieurs exemples d’utilisation de ces nouveaux modèles d’IA dans la vie réelle, notamment l’annotation de données de séquençage cellulaire, la génération de formules mathématiques complexes pour l’optique quantique et l’exécution de workflows en plusieurs étapes.

En parallèle, l’entreprise propose également un modèle de raisonnement plus abordable et plus rapide, o1-mini, que les développeurs peuvent intégrer pour créer des applications nécessitant un raisonnement logique, mais pas forcément une connaissance approfondie du monde.

Une sécurité renforcée

OpenAI a également mis au point un nouveau système de formation à la sécurité pour permettre aux nouveaux modèles de « raisonner sur nos règles de sécurité en contexte », ce qui devrait leur permettre de les appliquer plus efficacement. L’entreprise affirme que ces modèles ont réussi des tests rigoureux de « jailbreaking » (tentatives de contournement des garde-fous) avec des scores bien supérieurs à ceux des modèles précédents.

Les modèles o1 ont été formés à l’aide d’une technique de chaîne de pensée par apprentissage par renforcement. Ils décomposent les étapes en étapes plus simples et abordent chaque étape par le biais de différentes stratégies jusqu’à ce qu’ils parviennent à la bonne conclusion. Par ailleurs, les modèles o1 ne prennent actuellement en charge que les entrées textuelles. Vous ne pouvez pas utiliser le modèle pour naviguer sur le web ou analyser des fichiers et des images.

Comme indiqué précédemment, si vous utilisez ChatGPT Plus ou ChatGPT Team, vous pouvez accéder à ces nouveaux modèles o1 dans l’application. Les utilisateurs de ChatGPT Enterprise et Edu y auront accès à partir de la semaine prochaine.

Lire plus
Intelligence Artificielle

Adobe Firefly : L’IA générative transforme la création vidéo

Adobe a récemment dévoilé un aperçu de son nouveau Firefly doté de nouvelles fonctionnalités basées sur l’IA générative pour la vidéo, dont une fonctionnalité permettant de créer des clips vidéo à partir d’images fixes. Ces outils font partie du modèle vidéo Firefly, toujours en développement, que l’entreprise avait déjà présenté en avril dernier. Ce modèle promet de révolutionner l’édition vidéo et audio au sein des applications Adobe Creative Cloud.

Jusqu’à présent, Adobe Firefly (accessible via Photoshop, Lightroom, Illustrator ou l’application web) dispose de fonctions de remplissage et de suppression génératifs. Il peut également créer des images à partir de zéro à l’aide de prompts textuels. Le modèle vidéo Firefly est censé fonctionner de la même manière. Vous pouvez générer des vidéos à partir de textes ou d’images, ou l’utiliser pour combler des lacunes dans Adobe Premiere Pro.

Le nouvel outil vidéo d’Adobe, Firefly, se distingue par sa capacité à générer des clips vidéo à partir de simples descriptions textuelles. Les utilisateurs peuvent ainsi créer des séquences en décrivant la scène souhaitée et en ajustant les résultats grâce à divers « contrôles caméra » simulant les angles, les mouvements et la distance de prise de vue. Par exemple, un utilisateur pourrait entrer une description comme « coucher de soleil sur une plage avec des vagues » et obtenir une séquence vidéo correspondant à cette description.

camera settings jpg

Une autre fonctionnalité clé démontrée par Adobe est la conversion d’images fixes en vidéos. Cela permettrait de générer des clips vidéo à partir d’images de référence spécifiques, une innovation particulièrement utile pour ajouter des plans supplémentaires ou combler les lacunes dans les calendriers de production.

Qualité vidéo et intégration avec d’autres outils

D’après les aperçus dévoilés, la qualité des vidéos générées semble être analogue à celle du modèle Sora d’OpenAI, que Adobe envisage d’intégrer dans son logiciel Premiere Pro. Toutefois, la durée des clips reste limitée, puisque ces vidéos ne peuvent pour l’instant excéder 5 secondes, comme l’a expliqué Alexandru Costin, vice-président de l’IA générative chez Adobe.

Adobe Firefly video model demo

Un atout non négligeable du modèle Firefly est sa promesse d’être « sûr pour une utilisation commerciale ». Contrairement à d’autres IA génératives qui peuvent soulever des inquiétudes en matière de droit d’auteur, Firefly a été entraîné uniquement à partir de contenus sous licence ouverte, de domaine public ou issus de la banque d’images Adobe Stock, garantissant ainsi des vidéos libres de droits.

L’avenir des fonctionnalités vidéo d’Adobe

Adobe a également présenté une fonctionnalité complémentaire baptisée « Remplissage génératif », prévue pour Premiere Pro. Cette option permet d’étendre la durée d’une séquence vidéo existante, rappelant l’outil « Remplissage génératif » déjà disponible dans Photoshop pour étendre les arrière-plans des images. Cette nouveauté, attendue pour la fin de l’année, pourrait se révéler utile pour prolonger des séquences sans avoir à filmer de nouvelles prises.

Les fonctionnalités « texte-en-vidéo » et « image-en-vidéo » seront d’abord disponibles en version bêta via une application autonome Firefly, avant d’être intégrées aux applications Creative Cloud, Experience Cloud, et Adobe Express.

Un tournant pour la création vidéo

Les nouvelles capacités de l’IA générative d’Adobe, notamment celles offertes par le modèle Firefly, marquent un tournant dans l’édition vidéo. Elles permettront aux créateurs de gagner en flexibilité, qu’il s’agisse de générer des vidéos à partir d’images ou de descriptions textuelles, ou encore de prolonger facilement des séquences existantes.

Bien que certaines limitations, comme la durée maximale des vidéos, subsistent pour le moment, ces outils pourraient transformer radicalement la manière dont les professionnels abordent la production vidéo.

Lire plus
Intelligence Artificielle

Apple Intelligence : Tout ce qu’il faut savoir sur l’IA de l’iPhone 16

Apple Intelligence : Tout ce qu'il faut savoir sur l'IA de l’iPhone 16

L’iPhone 16 d’Apple devrait redéfinir l’expérience du smartphone en intégrant des technologies innovantes d’intelligence artificielle (IA) et d’apprentissage automatique avec Apple Intelligence.

La vidéo d’Apple ci-dessous présente les principales caractéristiques de l’iPhone 16 et d’Apple Intelligence, en mettant l’accent sur les outils d’écriture innovants, les puissantes capacités de recherche, les fonctions de communication améliorées, les fonctionnalités avancées de l’appareil photo et les solides mesures de protection de la vie privée.

La première série de fonctionnalités d’intelligence artificielle d’Apple devrait être disponible au public le mois prochain dans la plupart des régions, à l’exception de l’UE, dans le cadre d’un test bêta pour l’iPhone 15 Pro et tous les iPhone 16, ainsi que les Mac et iPad équipés de puces Apple Silicon M1 ou supérieures. Au lancement, elles ne seront disponibles qu’en anglais américain.

Découvrons la nouvelle IA d’Apple qui sera intégrée à l’iPhone lors du lancement des nouveaux iPhone 16 et iPhone 16 Pro.

Libérer la créativité grâce à des outils d’écriture alimentés par l’IA

L’iPhone 16 offre aux utilisateurs une suite d’outils d’écriture avancés pilotés par l’IA. Grâce à la possibilité de réécrire des notes et d’ajuster la tonalité des messages, vous pouvez adapter sans effort votre communication à différents contextes. L’IA de relecture intégrée garantit que vos révisions et vos documents sont impeccables et exempts d’erreurs, ce qui vous permet de gagner du temps et d’économiser des efforts.

L’une des fonctionnalités les plus remarquables est la création d’emoji personnalisés. Exprimez-vous de manière unique en créant des emojis personnalisés qui reflètent votre personnalité et vos émotions. L’aire de jeux d’images pousse la créativité à son paroxysme en générant des images à partir de vos descriptions textuelles, ouvrant ainsi un monde de possibilités visuelles.

Recherche aisée et organisation rationalisée

Il n’a jamais été aussi facile de trouver les médias dont vous avez besoin grâce aux fonctionnalités de recherche d’images et de vidéos pilotées par l’IA de l’iPhone 16. Décrivez simplement les photos ou les vidéos que vous recherchez, et la fonction de recherche intelligente les localisera rapidement. Cette technologie s’étend à la création de films, vous permettant de générer des films captivants à partir de simples descriptions.

Gardez le contrôle de vos communications grâce aux fonctions de synthèse des e-mails et de gestion des notifications de l’iPhone 16. L’IA vous aide à hiérarchiser les messages importants, pour que vous ne manquiez jamais une information cruciale. Dites adieu aux boîtes de réception encombrées et bonjour à la communication rationalisée.

large 2x 2

Contrôle intelligent de l’appareil photo et informations instantanées

Les fonctionnalités de l’appareil photo de l’iPhone 16 ne se limitent pas à capturer des instants : elles permettent d’accéder instantanément à des informations précieuses. Dirigez votre appareil vers un restaurant ou un événement, et l’IA identifiera et fournira les détails pertinents. La fonction de reconnaissance des objets vous permet de rechercher des articles similaires, ce qui facilite la recherche de ce dont vous avez besoin.

L’intégration avec ChatGPT fait passer votre expérience de la caméra au niveau supérieur. Obtenez des explications immédiates sur les concepts et les idées, et transformez votre appareil photo en un outil d’apprentissage intelligent. Capturez, apprenez et explorez le monde qui vous entoure comme jamais auparavant.

Siri : Votre assistant intelligent redéfini

Siri, l’assistant virtuel bien-aimé d’Apple, bénéficie d’améliorations significatives dans l’iPhone 16. Grâce à une meilleure compréhension du langage et à de meilleures capacités d’exécution des tâches, Siri devient un compagnon encore plus précieux. L’option de frappe discrète permet des interactions silencieuses, garantissant la confidentialité dans les lieux publics.

large 2x 3

Siri offre désormais des conseils étape par étape pour un large éventail de tâches, ce qui facilite la navigation dans les processus complexes. L’introduction de nouvelles actions dans les applications élargit encore l’utilité de Siri, vous permettant d’accomplir plus de choses avec votre seule voix.

Un engagement inébranlable en faveur de la confidentialité et de la sécurité

Avec l’iPhone 16, Apple reste fidèle à son engagement en faveur de la protection de la vie privée des utilisateurs. L’appareil exploite le Private Cloud Compute pour les tâches intensives, ce qui garantit la sécurité et la confidentialité de vos données. La vérification indépendante des mesures de protection de la vie privée ajoute un niveau de confiance supplémentaire, vous permettant d’avoir l’esprit tranquille en sachant que vos informations personnelles sont protégées.

L’iPhone 16, avec son intégration de l’IA et des technologies d’apprentissage automatique, établit une nouvelle norme pour les smartphones. Qu’il s’agisse de stimuler la créativité grâce à des outils d’écriture avancés ou de rationaliser la communication et l’organisation, l’appareil offre une expérience complète et centrée sur l’utilisateur. Les fonctionnalités de l’appareil photo intelligent et les capacités améliorées de Siri augmentent encore l’utilité de l’iPhone 16, ce qui en fait un outil indispensable à la vie moderne. Grâce à des mesures de confidentialité inébranlables, Apple veille à ce que les utilisateurs puissent profiter de ces fonctionnalités innovantes sans compromettre la sécurité de leurs données.

Lire plus
Intelligence Artificielle

OpenAI en difficulté : Une augmentation des prix jusqu’à 9 900 % à l’étude

OpenAI en difficulté : Une augmentation des prix jusqu’à 9 900 % à l’étude

OpenAI traverse une période financière délicate malgré son impressionnante base d’abonnés payants, qui a récemment franchi la barre du million. Chaque abonné débourse 20 dollars par mois (ou plus pour les offres Teams et Enterprise).

Cependant, cela semble insuffisant pour maintenir OpenAI à flot, étant donné que des centaines de millions d’utilisateurs accèdent gratuitement à ses services.

Une hausse des prix d’abonnement à l’horizon ?

Selon The Information, OpenAI envisagerait une augmentation drastique de ses tarifs d’abonnement, pouvant aller jusqu’à 2 000 dollars par mois pour accéder à ses derniers modèles. Cette potentielle hausse de 9 900 % ferait grimper les prix pour les utilisateurs premium, mais il n’y a pas encore de confirmation officielle sur les raisons exactes de cette décision ni sur l’application éventuelle de ce tarif à des modèles existants comme GPT-4 ou aux modèles à venir tels que Strawberry et Orion.

Actuellement, bien que le service ChatGPT soit accessible gratuitement, les abonnés bénéficient d’avantages notables, notamment un accès prioritaire en cas de forte affluence, des fonctionnalités en avant-première, ainsi que la possibilité de créer des GPT personnalisés. OpenAI a récemment ouvert l’accès à son générateur d’images Dall-E, auparavant réservé aux abonnés.

Un modèle abordable sous pression

Le coût de fonctionnement d’une entreprise spécialisée dans l’intelligence artificielle générative est extrêmement élevé. Entre les investissements dans le matériel, l’infrastructure des centres de données, les coûts énergétiques, ainsi que ceux liés à l’entraînement des modèles, les dépenses d’OpenAI sont astronomiques. Il est rapporté que l’entreprise aurait déjà dépensé 7 milliards de dollars uniquement pour entraîner ses modèles, contre 1,5 milliard pour le personnel.

Avec des pertes projetées atteignant 5 milliards de dollars, certaines sources évoquent la possibilité d’une faillite d’ici un an. Cependant, un récent tour de table d’investisseurs pourrait repousser cette échéance.

OpenAI doit également faire face à une concurrence croissante sur le marché de l’IA générative. Des entreprises comme Google et Anthropic continuent de développer des chatbots toujours plus performants, tout en maintenant des tarifs d’abonnement similaires à ceux d’OpenAI. Par ailleurs, Apple Intelligence devrait commencer à être déployée sur les appareils mobiles et les ordinateurs de bureau dès le mois prochain, ce qui accentue la pression sur OpenAI.

Une course contre la montre pour la rentabilité

Cette situation intervient dans un contexte où les investisseurs sont de plus en plus inquiets des sommes considérables que des géants comme Google et Microsoft injectent dans la technologie de l’IA, sans pour autant entrevoir un chemin clair vers une rentabilité durable. OpenAI, en tant que figure de proue de l’industrie, ressent les mêmes pressions. Pour rester compétitive et éviter une potentielle crise financière, l’entreprise pourrait être contrainte d’ajuster son modèle économique, soit en augmentant ses prix, soit en explorant de nouvelles sources de revenus.

En résumé, bien que le succès populaire d’OpenAI soit indéniable, l’entreprise doit surmonter d’importants défis financiers et concurrentiels pour garantir sa survie à long terme. Si la hausse des prix se confirme, cela pourrait bouleverser le marché des abonnements à l’IA, mais également ouvrir la voie à des opportunités pour ses concurrents.

Lire plus