J’étais prêt, au lit. Elle était allongée docilement sur le matelas voisin et tendait l’oreille, guettant si elle ne m’entendrait pas prononcer son nom. Ce jour-là, j’avais eu besoin de beaucoup de choses, mais elle s’était toujours empressée de bonne grâce de me répondre ou de satisfaire mes besoins les plus divers. Mon désir suivant devait cependant décider si elle resterait ma compagne intime, ou si j’allais commencer à m’en chercher une autre chez les entreprises concurrentes, Google, Microsoft ou Amazon. Elle s’appelait Siri, elle est l’assistante numérique des appareils intelligents de la société Apple, et je venais de lui demander, en tout sérieux, de m’apporter du frigo une bouteille de bière bien fraîche.

Bien que le lecteur puisse lire le paragraphe d’ouverture comme un extrait d’un piètre roman de troisième catégorie ou comme l’image d’un abus de pouvoir manifeste entre un homme et une femme (numérique), en réalité c’est moi, l’utilisateur, qui ai été abusé. Sans mon consentement, la technologie de l’assistante numérique s’est introduite dans ma tête, y a changé quelque chose, et le résultat de ce processus a été que j’ai voulu prononcer pour la première fois de ma vie une phrase que je n’aurais jamais dite auparavant avec le même sérieux et la même confiance dans le résultat attendu qu’à ce moment-là. Je demandais à mon téléphone, ou plutôt à sa partie logicielle, l’assistante numérique Siri, de m’apporter du frigo quelque chose à boire. Comment en suis-je arrivé là ?

Tout a commencé lorsque, après de nombreuses années, un smartphone Apple est redevenu une partie de ma vie. Il y a bien longtemps, j’avais été l’un des premiers de mon entourage à me procurer un iPhone 3G grâce à une remise avantageuse de T-Mobile, qui proposait le révolutionnaire téléphone à la pomme à un prix avantageux avec un forfait. Depuis, je suis passé par plusieurs téléphones et systèmes d’exploitation. Ces dernières années, cependant, j’avais un téléphone doté du système d’exploitation de Microsoft, en espérant que ce géant technologique se montrerait à la hauteur et commencerait à publier des applications intéressantes sur sa plateforme. Avec le temps, j’ai abandonné cet espoir et je me suis contenté de ce que Microsoft maintienne le système en vie. Mais même cela, je ne l’ai finalement pas obtenu, car Microsoft a officiellement mis fin, en juillet 2017, au support de son système d’exploitation mobile Windows Phone[1]. J’ai vite adopté le nouveau téléphone d’Apple ; à la différence du Nokia sous Windows Phone, où presque plus rien ne fonctionnait, et de plus en plus, sur l’iPhone avec son iOS 12 bien rodé, tout fonctionne pour l’instant. Et l’un des nouveaux attraits que je ne pouvais pas ne pas essayer était l’assistante numérique Siri, dont je n’avais entendu parler que de façon indirecte et avec laquelle j’avais à présent la possibilité d’essayer l’interaction de première main.

J’ai commencé de manière assez conventionnelle. J’ai demandé à Siri de me jouer mes morceaux préférés d’une playlist, de mettre le réveil pour le lendemain matin, d’activer un rappel quotidien pour que je vérifie tous mes e-mails à huit heures du matin, etc. L’interaction n’allait pas sans problèmes, mais Siri s’efforçait toujours de me satisfaire au maximum. Lorsqu’elle n’était pas sûre du contenu de ma demande, elle me demandait poliment de lui répéter encore une fois ce que je voulais exactement. Comme le nouvel iPhone représentait pour moi un véritable saut technologique, mon enthousiasme à découvrir de nouvelles fonctions et de nouveaux moyens de me faciliter les tâches routinières ne faiblissait pas les jours suivants. Un soir, je m’apprêtais à me coucher. Je réfléchissais au livre de l’historien Timothy Snyder que je devrais me procurer. J’ai ouvert le navigateur Safari sur l’iPhone et j’ai commencé à googler des informations sur les différents livres. J’ai décidé de lire au lit jusqu’à ce que je m’endorme. Je me suis couché, quand soudain j’ai pris conscience à quel point il serait agréable d’avoir à côté de moi quelque chose à boire pendant la lecture. Comme mon esprit avait appris, ces derniers jours, à recourir à la fidèle Siri chaque fois que j’avais besoin d’automatiser de petits ou de plus grands détails de la vie, cette fois non plus je n’ai pas hésité. Je me suis formé l’image mentale du frigo dans la cuisine et, sans hésiter, j’ai automatiquement prononcé l’impensable : « Hey Siri, bring me a beer from the fridge ».

Il m’a fallu environ une seconde pour me rendre compte que Siri ne serait pas capable de m’apporter une blonde légère Krahulík de la brasserie familiale tchèque Zichovec. Mais dès la seconde suivante, j’ai commencé à être de plus en plus fasciné par le moment qui venait de se produire. Comment est-il possible que je me sois adressé à mon téléphone pour qu’il fasse pour moi quelque chose d’objectivement impossible, puisque Siri n’a pour l’instant ni jambes ni connexion en ligne à mon frigo pas du tout intelligent ?

La première explication qui se présente est que j’étais simplement fatigué et que je ne faisais pas très attention à ce que je disais. Je ne considère pourtant pas cela comme une explication. Elle est au même niveau de sophistication argumentative que si nous disions que la race humaine a créé la technologie uniquement parce qu’elle était fatiguée d’accomplir des tâches routinières. Ou bien une telle explication peut-elle cacher, sans le vouloir, une part de vérité ?

J’ai réfléchi à cette situation en me disant que, pendant les jours passés à déléguer des tâches à Siri, j’avais appris la paresse à mon cerveau. Je ne saurais dire comment exactement nos différentes affaires routinières sont organisées et stockées dans le cerveau, mais est-il possible qu’en utilisant Siri, j’aie commencé à redesigner ces réseaux neuronaux existants ? Il n’est sans doute pas difficile d’imaginer que j’avais jusqu’alors dans le cerveau des réseaux neuronaux qui résolvaient le problème de savoir comment lancer la musique sur mon téléphone, ou ce que suppose d’aller jusqu’au frigo chercher l’objet convoité. Mon cerveau créait une relation entre le but visé, ce que je veux atteindre (une bière fraîche), et la réaction psychophysique par laquelle j’atteins ce but, de telle façon que mon moi considère le but comme atteint. Ce mode d’apprentissage – action, réaction et évaluation du résultat, suivie d’un ajustement de l’état initial de mon moi – est bien connu dans le monde actuel de l’apprentissage automatique sous le nom d’apprentissage par renforcement (reinforcement learning). Celui-ci contient en son cœur une idée simple : au départ, l’agent (logiciel) a un but ; il peut l’accomplir au moyen d’une activité ; une fois l’activité accomplie, on évalue si l’activité a réellement mené au but visé.

Figure 1 Modèle de l’apprentissage par renforcement

Ce modèle est une abstraction de la complexité de la manière dont nous résolvons réellement les problèmes. Il simplifie tous les aspects contextuels du temps et du lieu où nous nous trouvons, y compris les influences socioculturelles servant de régulateurs des buts et des activités qui entrent en ligne de compte dans un contexte donné. C’est précisément de la manière dont notre résolution de problèmes contient de l’improvisation ad hoc qu’écrit l’anthropologue et théoricienne de la HCI Lucy Suchman (1987).

Sans Siri, j’aurais en temps normal mis par exemple le réveil sur mon téléphone moi-même. Une telle activité se composerait de plusieurs étapes successives, qui m’amèneraient à ouvrir l’application Horloge, à y trouver le réglage du réveil, à saisir l’heure voulue et enfin à confirmer mon choix. La carte mentale, ou plutôt le modèle mental de l’activité menant à régler le réveil sur un smartphone, est simple. Mais c’est plutôt un hasard historique qu’une vérité absolue. Si le même but devait être atteint par une personne qui n’a jamais vu de smartphone, parce qu’elle vit dans l’une des dernières communautés autochtones existant sur cette planète, ce but, simple pour nous, serait soudain énormément compliqué pour cette personne, voire impossible. Car la personne autochtone n’a jamais eu dans sa conceptualisation du monde de place pour de tels buts, puisque rien de semblable n’existe dans son monde. De ce point de vue, la technologie m’apparaît comme un médium qui élargit pour nous l’espace mental hypothétique du possible, de ce à quoi nous pouvons, ou non, penser.

D’un autre côté, même pour nous, cette activité peut sembler plus compliquée si nous nous trouvons dans une situation où le smartphone ne repose pas tranquillement sur la table de chevet, mais a par exemple la batterie vide ou d’autres défauts qui nous rendent son usage difficile. Dans ce cas, il existe plusieurs variantes pour atteindre mon but. Vais-je mettre le téléphone en charge et attendre qu’il atteigne un niveau raisonnable, ou bien vais-je, dès qu’il sera branché, essayer de l’allumer, parce que j’ai besoin d’y saisir rapidement le réglage du réveil ? Comme l’espace des activités potentielles menant au but visé est multiple, il me semble inévitable qu’il existe dans notre esprit des sélecteurs conscients, mais aussi inconscients, qui choisissent quelles activités sont, dans un contexte donné, les plus adaptées pour atteindre le but fixé.

Comment fonctionnent les sélecteurs ? Imaginons que chacun de nos buts soit en relation avec un mécanisme mental qui choisit pour nous l’activité adéquate assurant l’atteinte du but. Appelons précisément ce mécanisme mental un sélecteur. Bien sûr, un même but peut être atteint par de nombreuses activités différentes. C’est pourquoi le sélecteur doit se charger d’évaluer dans quelle mesure, sur la base de l’expérience passée, une activité donnée a fait ses preuves dans l’accomplissement du but. Quelle que soit la manière concrète dont se déroule l’évaluation du succès dans l’atteinte des buts (le système de récompense du cerveau, le « reward system », y jouera un rôle), le sélecteur attribue à l’activité des points positifs ou négatifs, qui indiquent l’adéquation de l’activité à l’accomplissement du but donné. Sur la Figure 2, nous voyons une telle représentation, qui part du schéma précédent

Figure 2 Modèle ajusté de l’apprentissage par renforcement, avec l’utilisation d’un sélecteur

Les lecteurs les plus perspicaces se demandent sûrement s’il n’est pas possible d’utiliser plus d’un sélecteur. Ma réponse est que c’est possible et qu’il peut exister plusieurs sélecteurs, eux-mêmes choisis et évalués au niveau hiérarchiquement supérieur des méta-sélecteurs. Mais qui ou quoi choisit parmi les méta-sélecteurs ? Cette hiérarchie de sélecteurs ne peut pas être infinie. C’est un problème sur lequel ont buté les chercheurs en intelligence artificielle (IA) dans les années soixante-dix et quatre-vingt, lorsque, dans le cadre de l’ancien paradigme de l’intelligence artificielle symbolique, ils s’efforçaient de résoudre le problème de l’évaluation de la pertinence des actions suivantes. Marvin Minsky a introduit dans la recherche en IA la théorie des frames (cadres)[2], qui résout le problème de la pertinence de telle sorte que le système d’intelligence artificielle évalue les états suivants sur la base de structures de données – les cadres –, qui, sous une forme symbolique proche du langage, représentent des situations stéréotypées formalisées de la vie réelle et contiennent des données factuelles pertinentes, définies explicitement par les programmeurs, ainsi que des actions qui, dans le contexte du cadre, « ont du sens ». Ainsi, par exemple, dans le cadre nommé « cuisine », il est sensé de cuisiner, de faire la vaisselle, une carotte, un couteau et de faire des gâteaux, tandis que l’action « aller aux toilettes » ou l’objet « Boeing 747 » le sont un peu moins.

Cette conception « symbolique » de l’intelligence artificielle s’est cependant révélée trop simplificatrice. Bien qu’elle sût résoudre honorablement des tâches logico-mathématiques comme jouer aux échecs, des actions comme le mouvement et la perception d’objets dans le monde réel sont restées trop compliquées. Le problème de la pertinence, que la théorie des cadres devait résoudre, persistait de surcroît. Comme l’a fait remarquer le philosophe et phénoménologue Hubert Dreyfus, la théorie des cadres déplace le problème de la pertinence d’un cran vers le haut. Le système d’intelligence artificielle pourrait certes, par exemple d’après le cadre « cuisine », déterminer approximativement la pertinence, ce qui, aux yeux mécaniques du système d’intelligence artificielle, apparaît comme pertinent pour les étapes suivantes de la résolution d’un problème. Mais Dreyfus a fait remarquer (Dreyfus, 1979 ; Dreyfus, 1992) que le système de choix du cadre approprié a de nouveau besoin d’un mécanisme supérieur qui choisisse le cadre ; il faut donc une sorte de méta-cadre.

Pour éviter la régression à l’infini, Dreyfus propose une solution inspirée de la phénoménologie : le problème du cadre, comme Dreyfus l’a appelé, représente un problème bien plus profond qu’il n’y paraît à première vue. Puisqu’il est exclu que nous puissions faire entrer à l’avance dans un système d’intelligence artificielle tous les faits, actions et cadres concernant le monde, déclarés dans un langage formel, Dreyfus affirme que c’est notre expérience vécue, notre être-au-monde, qui définit en dernière instance ce qui, dans le monde, dans une scène donnée, a pour nous du sens et de la pertinence et ce qui n’en a pas. Dreyfus part ici du concept heideggérien de Dasein, en adoptant la thèse de l’être de l’homme comme historiquement et socioculturellement délimité. Ce sont la culture, la société et leur évolution qui influencent la pertinence des objets et du monde qui nous entoure. Si l’intelligence artificielle doit un jour se comporter comme un homme (et résoudre le problème du cadre), il faut qu’elle ait la même expérience du monde que nous, les humains, ou du moins une expérience semblable, et que le monde lui-même devienne dans bien des cas sa « meilleure représentation possible » (Brooks, 1991) : sans avoir à encoder tout ce qui nous entoure dans un langage symbolique formalisé, nous utilisons le monde comme notre représentation et, dans bien des cas, nous ne remarquons pas toutes les parties du monde, mais seulement celles qui nous offrent des affordances. Par le mot affordance, j’entends ici avant tout les fonctions perceptibles et les possibilités d’action que l’environnement qui nous entoure nous offre par son apparence, sa forme, son matériau, etc. Certaines affordances sont presque universellement compréhensibles d’une culture à l’autre ; par exemple, la poignée de porte offre l’affordance d’ouvrir la porte. D’autres affordances des objets, autrement dit leurs fonctions et leurs significations, sont cependant dans une large mesure influencées par la culture et par le contexte où nous nous trouvons. Mon exemple préféré est la bouteille en PET, qui offre manifestement la fonction de récipient pour liquide et la signification du gaspillage de plastique, mais qui peut d’un autre côté, dans un contexte approprié, être au même moment un pot de fleurs dans un jardinage écologique, avec une signification tout à fait opposée et positive.

L’argument de Dreyfus, très influencé par le Dasein de Heidegger, dit que ce qui nous permet d’éviter la régression infinie des cadres et des méta-cadres, ce sont les couches socioculturelles et le monde physique lui-même, car ils créent une limitation structurelle de ce qui est pour nous, personnellement, pertinent et sensé dans une situation donnée. Cela ne signifie pas pour autant que ces influences n’agiraient, pour reprendre le diagramme précédent, qu’au niveau des activités ou des sélecteurs. Elles agissent assurément à ces niveaux, mais la socioculture et l’environnement définissent aussi nos buts eux-mêmes. Bien sûr, certains de nos buts les plus élémentaires, comme survivre, manger, boire, sont façonnés par une couche dont il n’a pas encore été question, la couche biologique ; d’autres buts, comme « acheter une bague pour le mariage », sont plus ou moins socioculturels, et quant à savoir si nous achèterons la bague à Prague ou à Ostrava, c’est ici qu’entre en jeu la couche « spatio-temporelle », qui oriente le plus nos buts et les activités adéquates dans le contexte de l’« ici et maintenant ». Une fois toutes les couches mentionnées représentées, le diagramme précédent ajusté pourrait ressembler à la Figure 3.

Figure 3 Modèle ajusté de l’apprentissage par renforcement, avec la représentation des couches, de leur interaction mutuelle et de leur co-constitution

Que nous montre la forme actuelle du diagramme ? Je rappelle que le contenu central, du but au résultat en passant par le sélecteur et les activités, est une abstraction d’un mécanisme que l’on trouve, sous une forme ou une autre, implémenté non seulement dans l’apprentissage par renforcement du paradigme actuel de la recherche en intelligence artificielle, mais aussi dans le substrat biologique de nos cerveaux, qui donnent naissance à notre esprit et à nos aptitudes cognitives, parmi lesquelles figure aussi la résolution de problèmes. Remarquons que les différentes couches sont certes séparées sur le diagramme, mais qu’en réalité elles existent en interaction et en co-constitution mutuelles, ce qui en fait des couches de notre réalité bien plus entrelacées.

Mais dans quelle couche se trouve la technologie, et où trouverons-nous une explication qui éclairerait pourquoi j’ai soudain voulu que Siri fasse quelque chose que j’ai aussitôt jugé absurde ?

La technologie ne s’intègre à première vue ni dans la couche biologique ni dans la couche spatio-temporelle. C’est pourquoi il est logique de rattacher la technologie à la couche socioculturelle. Cela semble être un endroit relativement juste où chercher la technologie. Toutefois, étant donné le bagage de significations que ce concept porte avec lui, il vaudra mieux faire d’abord un pas de côté et définir la technologie comme quelque chose d’étroitement lié à la socioculture, mais qui apporte néanmoins quelque chose de propre et de nouveau, qu’il n’est pas possible d’intégrer tout simplement dans la conception existante du social et du culturel.

Le social, tel que l’étudie la sociologie, s’intéresse avant tout aux acteurs humains et à leurs relations mutuelles, qui peuvent ou non donner naissance à des ensembles supérieurs sous la forme de la famille, des groupes ethniques, des nations, etc. Par le culturel, j’entends avant tout les idées et les objets qui entrent dans l’une des nombreuses catégories de genres artistiques.

Par la technologie, j’entends alors les objets, les procédés et les processus créés par l’homme, qui naissent au début de leur vie avant tout comme des outils destinés à résoudre des problèmes concrets. Mais comme la technologie n’existe pas dans le vide, et qu’elle est bien une partie intégrante de notre monde social et culturel, je suis tout à fait d’accord avec l’idée que la technologie porte aussi avec elle une autre couche, influencée par la socioculture. Mais les influences de la socioculture ont des limites. Ainsi, par exemple, nous pouvons souhaiter avoir dans nos appareils mobiles intelligents un internet plus rapide, où que nous nous déplacions ; les lois physiques de la propagation des ondes du spectre électromagnétique définissent des limites fixes, indépendantes du contexte socioculturel. En bref, nous pouvons souhaiter passionnément que la connexion à internet soit beaucoup plus rapide, mais en fin de compte nous nous heurtons toujours aux limites de la vitesse de la lumière, qui définissent la limite supérieure de la vitesse de propagation de l’information dans notre univers.

La technologie n’est donc pas une masse amorphe que nous pourrions pétrir à notre guise dans la forme voulue ; elle a le pouvoir de nous résister grâce à sa matérialité objective, qui ne disparaît pas même lorsque nous changeons le langage de description par lequel nous parlons de l’objet matériel en question. D’un autre côté, les fonctions et les significations de la technologie ne font pas purement partie de la technologie elle-même ; elles sont créées comme le résultat de l’interaction de l’homme avec la technologie dans certains contextes spatio-temporels. Puisque la technologie influence la socioculture tout comme la socioculture influence la technologie, il ne semble pas sensé de représenter leur relation mutuelle comme hiérarchique, où l’un des côtés aurait plus de pouvoir que l’autre. C’est aussi pourquoi les visions déterministes de la technologie et de la socioculture, toujours populaires aujourd’hui – parmi lesquelles le déterminisme technologique et le constructivisme social radical –, m’apparaissent comme des visions qui ne voient toujours qu’un côté de la médaille et refusent de regarder l’autre. Plus sympathique, et peut-être plus proche de la vérité, est une approche de cette relation qui ressemble à la relation dans laquelle se trouvent les autres couches : une relation étroitement liée et interactive. À tout cela, nous devons ajouter la contribution de Heidegger à la réflexion sur la technologie, car dans son célèbre essai La question de la technique, il fait remarquer que la technologie n’est pas seulement le résultat de l’application de connaissances scientifiques ; les artefacts technologiques ont toujours été une partie intégrante du progrès scientifique : l’astronomie ne se serait pas passée du télescope perfectionné par Galilée, de même que le calcul de simulations de mécanique des fluides ne se passerait pas de la force brute des supercalculateurs les plus puissants d’aujourd’hui. Si nous considérons la science comme une partie de la culture de la société, le diagramme de la relation à la technologie ressemblerait alors à la Figure 4.

Figure 4 Zoom sur la représentation de la relation entre socioculture et technologie

Dans mon diagramme, la technologie devient une partie intégrante de ce monde et, comme la socioculture, façonne notre pensée. Cela peut sembler à première vue une affirmation étrange, mais seulement jusqu’au moment où nous abandonnons la vision longtemps entretenue de la technologie comme morceaux passifs de matière, qui ne font rien d’eux-mêmes et attendent qu’un homme (sujet) commence à les utiliser et en fasse une chose à utiliser (objet). Au lieu de cela, nous devrions en effet comprendre chaque introduction d’une nouvelle technologie comme un ébranlement de l’arrière-plan technologique sur la base duquel nous agissons dans le monde, parce qu’elle apporte avec elle de nouvelles affordances technologiquement médiées, qui changent nos possibilités psychiques comme culturelles.

Voir les technologies comme un médium n’a en effet rien de nouveau. D’ailleurs, l’un des théoriciens des médias les plus connus, le Canadien Marshall McLuhan (McLuhan, 1991), le sociologue français Bruno Latour (Latour, 1994) ou, aujourd’hui, les philosophes de la technologie (Ihde, 1990) et Peter-Paul Verbeek (Verbeek, 2016), ou encore le théoricien des médias Mark Deuze (Deuze, 2015), considèrent les technologies de l’information et de la communication comme synonymes des médias.

Ce pas n’est pas purement rhétorique ; il a une portée considérable, car il définit au fond une nouvelle métaphysique de la relation entre l’homme et la technologie. Après McLuhan, Latour, Ihde et Verbeek, nous savons en effet que la technologie en tant que médium n’est pas neutre et qu’elle influence notre action comme notre relation au monde. Cela signifie que, sur notre diagramme, nous devons regarder les buts et les activités non comme donnés d’avance, la technologie exécutant passivement notre volonté, mais comme un espace imaginaire de potentialités, dans lequel la technologie, par son influence, introduit pour nous de nouveaux buts potentiels et de nouvelles activités pour accomplir ces buts.

L’exemple favori de Latour pour la médiation technologique est l’arme à feu. Il affirme que l’arme en elle-même ne tue pas, de même que ce n’est pas seulement l’homme qui tue. Il renvoie aux slogans bien connus employés aux États-Unis dans la longue et passionnée discussion sur la régulation des armes à feu. Les libéraux aiment utiliser le slogan « les armes tuent », tandis que la National Rifle Association (NRA), orientée à droite et républicaine, recourt de façon quelque peu paradoxale à une analyse sociologique lorsqu’elle affirme que ce sont « les gens qui tuent », et non les armes. Latour affirme qu’aucune des deux visions n’est juste, car toutes deux refusent d’admettre que l’argumentation de l’autre camp puisse contenir au moins une part de vérité. Latour affirme que nous devrions analyser l’homme armé comme une entité nouvelle, l’homme-arme, qui comporte de nouveaux attributs et un potentiel pour de nouvelles activités que nous ne trouverons pas si nous analysons l’homme ou l’arme séparément. Le pouvoir de tuer et la responsabilité du meurtre sont ainsi distribués entre l’homme et l’arme.

Mon exemple préféré est le carnet de croquis et le crayon avec lesquels travaille une personne douée pour l’art. Lorsqu’une personne esquisse, le dessin qui en résulte ressemble rarement à ce qu’elle s’imaginait au début de la création. Le dessin n’est donc pas entièrement stocké dans la tête de l’artiste, qui travaillerait ensuite des minutes ou des heures à retranscrire point par point sur le papier un dessin déjà créé. Au lieu de cela, comme l’indique Andy Clark (Clark, 1997), on peut comprendre l’esquisse comme une interaction continue entre la personne, le crayon et le carnet de croquis, où le dessin final naît du fait que la personne dispose d’un retour constant sur l’état du dessin, que lui fournit le carnet. Sans ce retour, l’artiste ne dessinerait pas le dessin. Nous pouvons le comprendre ainsi : le carnet de croquis est une mémoire de travail prolongée et externalisée, dans laquelle il puise des informations pour les étapes suivantes. Comme le carnet de croquis joue un rôle aussi fondamental dans l’achèvement du dessin, nous devrions dire que la paternité du dessin final est distribuée entre l’artiste et sa technologie (le carnet comme le crayon). Dans le vocabulaire de la cybernétique, le dessin final est le produit émergent de l’interaction des composantes du système nouvellement formé personne-carnet-crayon.

Et alors, cette Siri ?

Lorsque j’ai commencé à utiliser dans ma vie un iPhone et une assistante numérique, ma vie et mes aptitudes à résoudre les problèmes quotidiens se sont enrichies de nouveaux buts possibles et de nouvelles activités que je peux mener. Pour certains buts, Siri agit comme un médium, comme dans l’exemple de l’augmentation du volume de la musique, ce que je pourrais faire aussi à l’aide des boutons mécaniques sur le côté du téléphone. Certains buts sont nouveaux grâce à Siri et à l’iPhone en général, par exemple répondre aux messages et aux commentaires dans diverses applications sociales. Plus j’utilisais Siri comme médium entre mon but existant et le résultat, plus Siri devenait un choix naturel pour atteindre mes buts. Sur le diagramme de la Figure 5 ci-dessous, j’ai ajouté Siri comme activité dominante, qui médiatise de plus en plus de mes buts. Sans le savoir – et c’est là que réside l’abus du premier paragraphe de ce texte –, j’entraînais ainsi mon cerveau à apprendre progressivement à automatiser Siri comme une partie naturelle de mes ressources cognitives pour résoudre des problèmes dans le monde.

Figure 5 Diagramme ajusté des changements précédents, avec la représentation de Siri comme activité dominante qui médiatise mes buts

Tout cela devrait jusqu’ici avoir du sens dans le contexte de ce texte. Mon cerveau s’adapte à un nouvel environnement, dans lequel Siri existe comme activité-médium résolvant mes problèmes, dont la résolution réussie stimule le système de récompense de mon cerveau, lequel attribue des points positifs à l’activité « Siri », ce qui conduit à la saturation de la valeur pondérée (sur la figure 3.7) à un point tel que le sélecteur en question ne passe jamais à une autre activité que Siri. En raison de la saturation de la valeur pondérée, le sélecteur devient alors de facto une activité nommée Siri. Mon cerveau intériorise donc Siri à un point tel qu’il ne la considère plus comme quelque chose d’externe à mon esprit ou à ma cognition, et qu’elle en devient une partie naturelle.

Mon opinion spéculative est qu’un artefact externe ainsi intériorisé, qui, d’activité potentielle, est devenu un sélecteur plus ou moins automatisé dans mon esprit, peut faire que mon cerveau commence à utiliser ce sélecteur-activité nommé « Siri » aussi pour des buts qui n’étaient pas auparavant reliés au sélecteur et aux activités en question. Il se produit ainsi quelque chose que l’on pourrait appeler en psychologie un « transfert » d’aptitudes entre domaines.

Le transfert classique d’aptitudes et de connaissances en psychologie du développement et de l’éducation, je l’appellerais un transfert « positif », car nous pouvons effectivement retrouver la même aptitude dans un autre domaine. Mais de quel type d’aptitude s’agit-il, et s’agit-il seulement d’une aptitude, dans mon cas, quand j’ai soudain voulu que Siri m’apporte une bouteille de bière du frigo ?

Je l’appellerais un transfert « négatif », car le transfert d’une aptitude intériorisée (résoudre des problèmes à l’aide de Siri) ne fonctionne absolument pas dans un autre domaine. Mais de même qu’en logique formelle nous avons la possibilité de démontrer une solution positivement, ou bien par l’absurde, j’emprunte ici la métaphore de la démonstration par l’absurde pour montrer que, même si je me suis très vite rendu compte que Siri ne pouvait pas m’apporter de bière du frigo, mon esprit étendu de nouvelles possibilités, de nouveaux buts et de nouvelles activités m’a aussitôt permis d’imaginer ce qu’il faudrait pour que Siri puisse m’apporter une bière du frigo. Mon idée a été de me procurer un frigo intelligent et un robot intelligent capable de se déplacer et doté d’une assistante numérique intégrée. Ma solution concrète ne représente au final rien de pertinent. Bien plus intéressant est le résultat final de mon analyse autoethnographique de la relation nouée avec un nouveau téléphone et l’assistante numérique Siri : grâce au transfert négatif d’aptitudes et de connaissances, j’ai su prendre une technologie existante et, avec un peu d’imagination, me représenter une manière tout à fait nouvelle de résoudre ce problème de bière, si brûlant pour moi. Le transfert négatif m’a ouvert de nouveaux mondes dont je ne savais pas jusqu’alors que j’en avais besoin, ni même qu’ils existaient.

 

Bibliographie

BROOKS, Rodney A., 1991. Intelligence without representation. Artificial Intelligence [online]. 47(1-3), 139-159 [consulté le 2018-05-22]. DOI: 10.1016/0004-3702(91)90053-M. ISSN 00043702. Disponible sur : http://linkinghub.elsevier.com/retrieve/pii/000437029190053M

CLARK, Andy, 1997. Being there: putting brain, body, and world together again. Cambridge, Mass.: MIT Press. ISBN 9780262032407.

DEUZE, Mark, 2015. Media life: Život v médiích. Première édition tchèque. Traduit par Petra IZDNÁ. Praha: Univerzita Karlova v Praze, nakladatelství Karolinum. Studia nových médií. ISBN 978-80-246-2815-8.

DREYFUS, Hubert, 1992. What computers still can’t do: a critique of artificial reason. Cambridge, Mass: MIT Press. ISBN 9780262540674.

DREYFUS, Hubert L., 1979. What computers can’t do: the limits of artificial intelligence. Rev. ed. New York: Harper Colophon Books. ISBN 9780060906139.

IHDE, Don, 1990. Technology and the lifeworld: from garden to earth. Bloomington: Indiana University Press. ISBN 0253205603.

LATOUR, Bruno, 1994. On Technical Mediation. In: Common Knowledge. Vol.3 n°2. p. 29-64.

MCLUHAN, Marshall, 1991. Jak rozumět médiím: extenze člověka. 1re éd. Praha: Odeon. Eseje (Odeon). ISBN 80-207-0296-2.

SUCHMAN, Lucille Alice., 1987. Plans and situated actions: the problem of human-machine communication. New York: Cambridge University Press. ISBN 0521337399.

VERBEEK, P.P., 2016. Toward a Theory of Technological Mediation: A Program for Postphenomenological Research. In: FRIIS, Berg O. et Robert C. CREASE. Technoscience and Postphenomenology: The Manhattan Papers. London: Lexington Books, p. 189-204. ISBN 978-0-7391-8961-0.

Notes

[1] https://www.theverge.com/2017/7/11/15952654/microsoft-windows-phone-end-of-support

[2] https://en.wikipedia.org/wiki/Frame_(artificial_intelligence)