Atelier 4: La numérisation des contenus inexploités: stratégies et outils

7 speakers
Summary

The discussion focused on transforming “dormant” content into useful, reliable, and well-governed digital resources for artificial intelligence, while preserving authors’ rights, data quality, and the public interest . The moderator also framed the exchange around the experience of heritage digitization and the governance and copyright issues related to content used by AI .

Speaker 1 argued that immense volumes of heritage content still remain inaccessible online, even though AI models depend not only on the quantity but also on the quality of data, with risks of cultural and linguistic bias if only data already dominant on the web are used . He presented this as a dual issue of sovereignty and representativeness for the Francophonie, noting that the Royal Library of Belgium has digitized only about 10% of its collections and that, within the digital Francophone network, rates often range from just a few percent to 25% at most . He stressed that heritage digitization is not just about producing images, but about creating contextualized, reliable heritage data that can be used by machines, notably through high-quality full text and collections transformed into structured data . In his view, this justifies public investment, harmonization of practices, consideration of copyright, and a collective increase in digital maturity within the Francophone network .

Speaker 2 complemented this approach with an intellectual property perspective, recalling that AI systems need both older heritage data and contemporary content that is often protected by copyright . He explained that WIPO promotes a balanced framework between public access and respect for rights, notably through guides on the preservation of and access to works in heritage institutions . He emphasized that copyright exceptions are possible, but only within the limits of the “three-step test,” and that a distinction must be made between public access, text and data mining, and use as training data for AI . He also stressed transparency of uses, value-sharing, licensing, public-private partnerships, and the need for a robust semantic infrastructure with metadata and identifiers to attribute works and manage rights .

Questions from the audience broadened the debate to oral knowledge, particularly in African contexts, highlighting the need to think about archiving, costs, sovereignty criteria, and the risk that some societies might become mere providers of knowledge exploited by others . In response, the speakers emphasized the trust of communities, the need to frame future uses of local knowledge, and the fact that even seemingly marginal content can have high value for AI . Asked about priorities, Speaker 1 proposed starting with a better inventory of collections, then giving priority to fragile or threatened heritage-notably magnetic tapes, the press, audio sources, and unique documents-while multiplying access channels and interoperability . In conclusion, the discussion converged on the idea that a digitization strategy for AI must combine preservation, reliability, cultural diversity, trust, funding, common standards, and rights governance so that heritage becomes a resource for the future rather than a blind spot of the digital age .

Keypoints
  • The debate first concerns the transformation of “dormant” content into useful resources for AI, with a balance between usefulness, reliability, governance, copyright, and the public interest. The moderator explicitly raises this central question at the outset, and the speakers then return to it from the perspective of heritage digitization and machine use.
  • A major point is the urgency of digitizing heritage that is still absent from the web, because a large share of collections remains outside the digital sphere, creating a problem of sovereignty, cultural and linguistic representativeness, and bias in AI systems. Speaker 1 stresses that the data available online are limited, that heritage collections constitute a reservoir still largely untapped, and that their absence makes certain cultures and languages invisible in future models.
  • The discussion underscores that digitization is not enough in itself: content must be reliable, contextualized, structured, interoperable, and converted into data that machines can genuinely use. Speaker 1 explains that heritage digitization involves choices about quality, control, metadata, and the production of full text or structured data (“collections as data”), without which content remains difficult to use for AI.
  • Another central focus concerns the legal framework for works protected by copyright, particularly twentieth-century content and uses by AI. Speaker 2 recalls the need to reconcile access, preservation, and respect for rights, relying on copyright limitations and exceptions, the “three-step test,” licenses, public-private partnerships, and remuneration mechanisms.
  • Lastly, participants stress the need for a collective strategy based on trust, consideration of oral traditions, clarification of digitization priorities, infrastructure, funding, and standardization. The discussion highlights African and Indigenous oral knowledge, the risks of value capture, the fragility of certain media, as well as the need for robust metadata, precise inventories, common standards, and coordinated public policies.
  • Overall objective of the discussion:
  • This discussion aims to define how to digitize and govern heritage and cultural content-sometimes still analog or oral-so that it becomes a reliable, visible resource that can be used by artificial intelligence, while respecting copyright, the communities concerned, cultural diversity, and the requirements of information sovereignty.
  • General tone:
  • The overall tone is serious, expert, and constructive. It is initially pedagogical and strategic, with rich presentations by the two main speakers on the technical, cultural, and legal issues. It then becomes more interactive and critical during questions from the audience, particularly around oral traditions, risks of exclusion, costs, sovereignty, and the economic capture of content. Despite these tensions and questions, the discussion returns to a pragmatic and action-oriented tone, focused on priorities, trust, standards, and collective strategies.
Speakers Overview
M
Moderator
134 wpm · 10 min
S1
Speaker 1
160 wpm · 29 min
S2
Speaker 2
139 wpm · 16 min
S3
Speaker 3
194 wpm · 4 min
S5
Speaker 5
195 wpm · 2 min
S6
Speaker 6
138 wpm · 58 s
S4
Speaker 4
180 wpm · 2 min

The workshop opens with a central question: how can still “dormant” content be transformed into useful, reliable, and well-governed resources for artificial intelligence, without sacrificing authors’ rights, data quality, or the public interest . The moderator immediately clarifies that the discussion is intended to be more open than a traditional panel, and announces two complementary entry points: the experience of heritage digitization presented by Speaker 1, and the issues of content governance and copyright related to AI presented by Speaker 2 . He also reformulates a key point very early on: in this context, digitization only makes sense if it produces usable and interoperable content, not merely digital copies .

In his opening remarks, Speaker 1 returns to an idea raised earlier in the day: the harvesting of data available on the web is approaching a form of saturation, making the vast amounts of content still absent from the internet all the more visible . He emphasizes that behind every AI system, the decisive issue remains data, both in quantity and quality . In his view, the imbalances already present online - between languages, cultures, viewpoints, or historical periods - risk being reproduced in the outputs of AI systems . From this perspective, the Francophone world faces a challenge of both sovereignty and representativeness, but it also has particular potential because of its cultural and linguistic diversity .

Speaker 1 supports this observation with several figures. At the Royal Library of Belgium, he estimates that at most 10% of content has now been digitized and made available online, without this yet meaning that it is directly usable by AI . In the Réseau francophone numérique, which brings together around one hundred heritage institutions from across the Francophone world, digitization rates often range from a few percent to a maximum of 25% . In other words, very large swathes of knowledge and culture remain outside the digital sphere and are therefore much less likely to feed AI systems . For Speaker 1, digitization is thus also a matter of public policy choice, since these reserves of knowledge are held in heritage institutions that are largely publicly funded .

His central point, however, is that digitizing is not enough. He distinguishes between the simple production of a digital facsimile and the creation of genuine heritage data . The latter must be contextualized, reliable, and structured if the goal is to avoid producing content that is of little use or itself carries bias . He describes heritage digitization as a complete professional chain: harmonization of inventories, revision of old bibliographic data, consideration of the legal status of works, technical capture, quality control, structuring, and dissemination . He also stresses the place of human intervention in this process, comparing digitization staff to “knowledge brokers” or “modern-day copyists” .

Speaker 1 adds that having beautiful images or basic metadata is not enough either . For content to be truly useful to machines, high-quality full text must be produced and collections must be made readable by automated systems, including for printed, manuscript, iconographic, sound, and audiovisual corpora . It is in this context that he refers to the idea of “collections as data” . In his view, this shift leads heritage data to be seen no longer merely as memory of the past, but also as a strategic asset and a raw material for the future . He therefore calls for public investment in digitization to continue and expand so that this content can be made genuinely usable in the age of AI .

He also presents the Réseau francophone numérique, created in 2006 at the time Google Books emerged, as a tool for solidarity and for building digital maturity . He sums up this orientation with a clear formula: “there is no AI without digitization” . To reach a level at which heritage data can support advanced uses, institutions must master the entire chain: inventory, cataloguing, legal status, capture, structuring, dissemination, and interoperability . The network thus seeks to harmonize practices and develop training, in a context where members’ capacities remain highly unequal .

Speaker 2 then addresses the issue from the standpoint of copyright and governance of uses. He recalls that AI systems need high-quality and culturally relevant data, but also contemporary content that is often still protected, not only older works that have entered the public domain . His remarks therefore focus in particular on twentieth-century works still existing in analog form - books, phonograms, films on magnetic tape - and on the conditions for their digitization within a balanced framework between public access and respect for rights . In this regard, he presents the role of WIPO, which supports Member States through guides to good practice on the preservation of and access to works in heritage collections .

At the heart of his intervention is the issue of limitations and exceptions to copyright. Speaker 2 recalls that international law allows States to provide exceptions to the exclusive right of reproduction, but only in compliance with the three-step test: certain special cases, no conflict with the normal exploitation of the work, and no undue prejudice to the legitimate interests of authors . He then stresses three distinctions. Providing access to researchers is not equivalent to publishing on the internet; enabling text search with excerpts is not equivalent to providing full access; and digitizing a work does not automatically authorize its use for training an AI . He cites the example of Google Books, where the digitization of protected works was accepted in the United States for text search and previews, but not for full access .

Speaker 2 adds that “making accessible” does not necessarily mean “free of charge” . He highlights the growing number of licensing agreements between content holders and AI companies, showing that a market exists and that free access cannot be presumed . He also mentions that certain public policy choices may lead to the opening of public data, while some rights holders may prefer open licences . He also draws attention to the potential value of content that is not widely commercialized, including in rare, Indigenous, or minority languages, for which companies are already seeking to build specialized datasets, especially audio and multilingual ones .

From there, Speaker 2 sets out several guiding messages. First, any digitization strategy must integrate copyright issues from the outset, as well as folklore and intangible heritage, particularly when it involves knowledge held by local communities or Indigenous peoples . Next, he stresses transparency regarding the objectives being pursued: preservation, access, text search, or the training of AI systems . He also mentions, in the European context, the existence of an “opt-out clause” allowing opposition to certain uses by AI systems to be signaled, with reference to Article 4 of the Directive on copyright in the digital single market . He also calls for explicit reflection on value-sharing among creators, heritage institutions, and AI companies, through licences, collective management, or public-private partnerships . On this point, he does not advocate a single model: several arrangements are possible depending on whether an institution wishes to transfer certain rights, retain copies, or pursue other dissemination and valorization objectives . Finally, he emphasizes the need for a robust rights management infrastructure, based on precise metadata and standardized identifiers such as ISBN, ISSN, ISAN, ISRC, or ISWC .

The discussion with the audience then shifts the debate toward four concrete questions: how to integrate orality, how to archive even before digitization, how to avoid cultural extractivism, and how to define operational and fundable priorities . Speaker 3 refocuses the discussion on oral knowledge, particularly in several African societies where information is not primarily preserved in structured documentary form . He emphasizes that a strategy based solely on libraries and already organized archives would risk excluding these forms of knowledge . He also stresses a step that is often overlooked: before digitization itself, thought must be given to the primary archiving of oral knowledge collected in the field, its preservation, its classification, and the cost of this transition phase . He also recalls the weight of material constraints: the cost of digitization, the need for servers and storage, the fragility of energy infrastructure, and the need to design sustainable strategies . In the same intervention, he warns against a risk of cultural extractivism: without a strategy for local valorization, some regions could provide AI with cultural raw material while allowing the capture of the economic value produced to take place elsewhere .

Speaker 4 intervenes in a more conceptual and skeptical register. Through the imaginary figure of a “Martian” coming in a thousand years to write the history of Earth, he recalls the potential scale of unexploited content: telephone conversations, receipts, letters, private images, unsold stocks of books, or various videos . His point is above all to highlight the gap between the ideal of exhaustiveness and the human, legal, moral, and institutional constraints involved . Speaker 1 responds on a pragmatic level: generative AI has already entered everyday use, and the issue is no longer whether or not to take part in this movement, but to ensure that it relies on data that are as reliable, complete, and diverse as possible .

The question of trust and consent then becomes an important thread in the discussion. The moderator introduces this point with the example of a Kanak religious song recorded in a non-profit context in the 1980s and then commercially reused much later, without the originating community being credited . Speaker 2 uses this example to underscore the need to obtain communities’ consent and to define the conditions of use in advance . He also recalls that AI systems are highly diverse and that even apparently marginal content can acquire strong economic value in specialized uses . His example of “helicopter theft” illustrates the fact that an AI producer may need very specific images, collected and annotated from television news, documentaries, or films . He also cites the French ReLIRE database to show that out-of-print twentieth-century works, sometimes niche ones, may retain real value for specialized audiences . Speaker 1, for his part, responds mainly on the strategic level: since AI use is already here, it is necessary to ensure that systems rely on better-quality data .

Several interventions from the audience then anchor these issues in African and national concerns. Speaker 5, Senegal’s Director of Digital Affairs, explains that the absence of digitization of oral transmission could lead to distorted reproduction, or even falsification, of national historical or heroic references in AI systems . In her view, these forms of heritage must therefore be digitized, structured, and made reliable, even if that comes at a cost, so that each society retains control over what culturally belongs to it . She also links this strengthening of reliability to intellectual property, seen as a way to secure content and its attribution at an earlier stage .

The moderator then refocuses the discussion on the Francophone space by asking which prioritization criteria should guide digitization efforts, and whether the aim should be a common Francophone corpus or rather a federation of commons despite the diversity of national and institutional rules . In response, Speaker 1 proposes a fairly clear hierarchy of action. The first priority is to improve or redo inventories so as to know precisely what is being preserved and what is at risk of disappearing . The second is to deal urgently with fragile or endangered heritage, in particular magnetic tapes, sound sources, newspapers printed on acidic paper, manuscripts, and unique documents . He also argues for multiplying access channels in order to avoid dependence on a single intermediary and increase the discoverability of content . He illustrates this with Belgian examples, explaining that certain documents held in Brussels have little chance of being found if they are visible only on a national portal and therefore need to circulate through several specialized or thematic portals .

Speaker 1 also returns to the institutional conditions for this policy. He stresses the need for libraries, archives, and museums to know one another better, understand their respective realities, and collectively build trust, because there can be no AI without that trust . He calls for an open digital ecosystem that is useful both to researchers, students, the general public, and machines . This requires cross-cutting training, better command of public procurement, shared standards, suitable equipment, digital libraries, and aggregator portals .

Asked whether priorities have already been identified and whether concrete action plans exist, Speaker 1 replies that AI has at least had the merit of bringing digitization back to the forefront of policy, whereas some thought this work was already complete . He reaffirms that priority must go to endangered heritage: magnetic tapes, newspapers, sound sources, recorded intangible heritage, manuscripts, and unique documents . He notes, however, that in several Francophone contexts, existing public policies are still aimed primarily at regulating the use of AI in the public sector, rather than refinancing the entire documentary chain needed to build genuinely usable corpora .

In his closing remarks, Speaker 2 summarizes three priorities: building trust with rights holders and the communities carrying oral traditions, ensuring transparency of AI systems regarding the content they use, and putting in place a robust semantic infrastructure for attribution and rights management . He had also specified that conditions of use, digitization objectives, and any restrictions could be recorded in the semantic layer describing digitized objects, so that they are visible to machines as well .

Overall, the workshop reveals broad agreement on several points. The speakers consider that the digitization of content still offline has become an important condition for AI that is more useful, more reliable, and more representative . They also agree that simple digital conversion is not enough: content must be structured, contextualized, interoperable, accompanied by full text, rich metadata, and explicit governance of rights and uses . Finally, several interventions converge on the importance of integrating oral knowledge, fragile heritage, and underrepresented languages, particularly in the Francophone and African space .

The tensions concern less the objectives than the trade-offs. A first sets the ambition to broaden corpora against recognition of the practical, legal, and material limits of any digitization policy . A second concerns the risk of cultural extractivism and the issue of value-sharing . A third relates to method: whether to start from institutional heritage corpora and their standards, or to rethink strategies on the basis of oral knowledge, prior archiving, and community consent .

The conclusion that emerges from the workshop is therefore pragmatic. The point is not to digitize everything indiscriminately, but to build corpora that are more reliable, more representative, and better governed, based on precise inventories, clearly assumed priorities, and strengthened institutional capacities . The clearest avenues for action concern prioritizing fragile media, harmonizing standards and practices, public investment, early integration of copyright and the communities concerned, as well as putting in place robust semantic layers to make content genuinely usable by machines . Several questions nevertheless remain open: sustainable financing, common criteria for prioritization in the Francophone space, governance of a possible common corpus, fair value-sharing, and how to reconcile access, cultural sovereignty, community consent, and the commercial exploitation of data .

Moderator
qui m 'a l 'avance, j 'ai entendu une personne au micro qui a été coupée, désolé. Donc la question centrale de cet atelier sera de savoir comment on transforme des contenus dormants en ressources qui soient à la fois utiles, fiables, gouvernées pour l 'intelligence artificielle, sans pour autant oublier, perdre de vue la question des droits des auteurs, créateurs, la qualité des données et l 'intérêt général. Voilà, pour en discuter, nous avons le plaisir d 'accueillir M. Frédéric Lemers, qui est responsable de la numérisation de la Bibliothèque royale de Belgique et donc qui ouvrira la discussion notamment à partir de son expérience de la numérisation patrimoniale et documentaire. Nous avons aussi le plaisir d 'avoir M. Jérémy Petit, qui est expert en intelligence artificielle, et en droit d 'auteur au sein de l 'organisation. mondiale d 'approprié -té intellectuel il y a vraiment d 'approprié -té intellectuel la question de tracé -dissé la pollution la gouvernance des contenus utilisés par l 'intelligence artificielle voilà je vous remercie pour votre présence cet atelier se veut ouvert on va à la différence donc des panels, il y a beaucoup de plans à l 'échange avec les audiences avec les participants donc après deux interventions liminaires de la part de nos experts on poursuivra dans la salle les échanges et puis nous conclurons avec des messages de nos experts autour des priorités et d 'actions collectives que l 'on peut mener à l 'échelle internationale sans plus tarder je vais peut -être laisser la parole à monsieur le maire pour quelques minutes sur les enjeux en matière de pollution pour continuer ce domaine .
Speaker 1
Merci beaucoup, mesdames et messieurs. Merci de votre invitation. Alors, des introductions, quelques éléments. Donc, j 'interviens évidemment en tant qu 'électronique de Belgique, mais aussi en tant qu 'administrateur du réseau francophone numérique, qui est un des partenaires de cette journée, qui est une organisation de bibliothèques nationales et archives et en bibliothèques patrimoniales, notamment de la francophonie. Une centaine de membres aujourd 'hui. Et on va se poser le lien avec cette organisation. On a beaucoup parlé, et je pense qu 'il y avait une belle transition tout à l 'heure qui nous était faite par cette analyse grasse qui disait qu 'il y aura bientôt un crash de marché dans l 'IA, puisque le moissonnage des données disponibles sur le web arrive progressivement à saturation et qu 'il n 'y aura plus de données disponibles et donc un épuisement potentiel des machines. Eh bien, bonne nouvelle. énormément de contenus qui sont encore totalement inaccessibles sur internet dont l 'existence est parfois même insoupçonnée et donc dès lors que l 'on veut garantir et ouvrir un droit réel d 'accès à de l 'information et encore faut -il que cette information soit fiable il y a évidemment un enjeu de mise à disposition de ces contenus et donc de les rendre accessibles dans la sphère dans la société du numérique qui est la nôtre aujourd 'hui nous savons que derrière chaque modèle d 'intelligence artificielle se cache une question plus fondamentale encore c 'est la question des données qui nourrissent ce modèle il y a la question de la quantité de données mais il y a évidemment aussi la question de la qualité des données et derrière la question des données se cachent d 'autres questions plus profondes encore qui touche à cela a été évoqué déjà ce matin, qui touche à nos individualités, qui touche aux sociétés dans lesquelles on évolue à nos cultures, à nos langues bien sûr, donc qui sera représenté au final dans l 'intelligence artificielle de demain quelles seront les cultures, quelles seront les langues quelle façon de voir le monde contribuant à façonner ces systèmes qui influenceront de plus en plus la société, c 'est finalement une question fondamentale on a encore entendu tout à l 'heure qu 'effectivement dès lors que, peu importe finalement le pourcentage, à partir du moment où il y a une langue et une culture, ou quelques cultures dominantes sur le web, et que les réponses proposées par l 'IA, quelle que soit la langue dans laquelle elles vont se proposer si les données sur base desquelles elles ont été formulées, leurs élèves ne sont représentatives que d 'une partie du savoir de l 'humanité, forcément elles ont introduit un biais un biais, à la fois en termes de diversité, mais aussi en termes de perspective et de diachronie donc ces questions elles placent aujourd 'hui la francophonie devant un enjeu double mais aussi elles permettent à la francophonie de jouer un rôle important à mon sens par rapport à cet enjeu de par sa dimension plurielle précisément alors le premier c 'est un enjeu de souveraineté le fait que les données patrimoniales et culturelles elles sont devenues la matière première d 'intelligence artificielle on le sait et que donc pour pouvoir continuer à en produire dès lors qu 'elles ne sont pas nativement numériques ça suppose de pouvoir faire appel à des réservoirs de données qui sont conservées vous savez dans les bibliothèques patrimoniales dans les archives voire dans les musées et que forcément ça coûte pas mal d 'argent également c 'est un investissement et qui la plupart du temps est réalisé par le secteur public donc la mise à disposition de ces données le fait de rendre ces contenus accessibles donc leur découvrabilité participent des politiques publiques on a entendu tout à l 'heure l 'importance de de préserver l 'accès de situations monopolistiques et de garantir la possibilité de proposer différentes alternatives dans les manières de de rendre accessible ce patrimoine voilà un enjeu de souveraineté important. Le second c 'est un enjeu de représentativité forcément à partir du moment où le modèle ne doit entraîner que sur un certain nombre de données qui sont incomplètes ou qui sont partielles voire qui sont tronquées forcément ça pose un certain nombre de questions et donc là au niveau de la francophonie bien entendu il s 'agit de nos savoirs, de nos cultures de nos imaginaires qui pourraient devenir invisibles dans le texte de l 'État belge et l 'enjeu est immense parce que la plupart de ces collections restent inaccessibles. Si je prends un exemple l 'exemple de la bibliothèque royale de Belgique qui est une bibliothèque patrimoniale, qui est donc la bibliothèque nationale de l 'État belge, qui est une bibliothèque patrimoniale de taille moyenne je dirais par rapport à les très grandes bibliothèques qu 'on peut retrouver dans la bibliothèque nationale de France ou d 'autres bibliothèques de taille plus élite mais dont les collections de par l 'histoire de la Belgique sont disproportionnellement riches aujourd 'hui malgré les efforts intensifs en matière de numérisation on a maximum 10 % des contenus qui sont numériques s 'ils sont numérisés et qu 'ils sont accessibles en ligne, ça ne veut pas dire pour autant qu 'ils sont exploitables par un délire en particulier. Donc on est à 10%. Il y a 90 % qui n 'est pas disponible, qui est donc inexistant du champ du numérique. On prend d 'autres membres parmi nos membres du réseau francophone numérique entre Haïti et le Vietnam en passant par l 'Afrique et nos collègues européens. On a des pourcentages de numérisation qui vont de quelques pourcents à 25 % maximum. Et donc l 'enjeu pour tous les membres reste très très important de rétro -numériser quelque part, de faire en sorte que le savoir du passé, la connaissance du passé, puisse être monté dans le train du numérique et être nourri de l 'intelligence artificielle. Alors face à ce double enjeu, les États ont évidemment les responsabilités économiques, juridiques et morales, et peuvent les protéger et préserver, valoriser ce patrimoine commun. Les institutions en ont aussi forcément, c 'est d 'activer, de stimuler davantage ces opérations de numérisation. Je vais venir rapidement à ce dont il s 'agit en pratique. Parce que le plus facile a été fait finalement pour l 'instant, c 'est -à -dire que les IA se sont nourries de tout ce qui est accessible sur Internet, produites essentiellement d 'un point de vue textuel ou alors des formats audiovisuels, mais qui sont des contenus nativement numériques pour l 'essentiel. A partir du moment où on s 'inscrit dans une logique diachronique, de faire en sorte que la connaissance produite depuis l 'Antiquité jusqu 'à aujourd 'hui, progressivement puisse rejoindre ce train du numérique, on est confronté à des structurations de l 'information, de la pensée, du savoir qui sont différentes, à des langues qui sont... encore bien plus diverses que celles qui sont déjà présentes, etc. et donc la numérisation n 'est pas une simple opération similaire à la numérisation du patrimoine n 'est pas une opération similaire à la numérisation d 'archives bancaires qu 'on peut ensuite détruire ou d 'archives quelconques qu 'on peut ensuite détruire une fois que l 'information brute est disponible dans une nouvelle venue c 'est pour ça qu 'on parle au sein du réseau francophone numérique de plus en plus de données patrimoniales et de bien remarquer, de mettre l 'accent sur le fait qu 'il s 'agit de numériser du patrimoine c 'est bien de le rendre accessible sous la forme d 'un facsimilier numérique mais que c 'est insuffisant et qu 'il s 'agit de données patrimoniales, donc ces données doivent être contextualisées ou en tout cas contextualisables elles doivent être fiables, autrement dit là aussi les acteurs du patrimoine vont eux -mêmes être porteurs de biais non souhaitables. Et il faut voir ces données en puissance comme étant un actif stratégique de notre société. Raison pour laquelle il faut investir à ce niveau. Alors, la francophonie s 'est déjà positionnée sur le sujet. Je ne vais pas développer ça maintenant, mais il y a eu la déclaration du maire scotteret, il y a eu un certain nombre d 'éléments en faveur de l 'écouvrabilité, du fait d 'affirmer ce rôle stratégique des acteurs du patrimoine et de la culture par rapport à ce besoin. Le réseau francophone numérique qui existe depuis 2006, donc bien avant qu 'on parle d 'IA générative, mais qui est donc apparu au moment de la révolution précédente, juste après le lancement de Google, du projet Google Books en 2005, au moment où un certain nombre de bibliothèques relevant de la francophonie ont commencé leur politique de numérisation avec la volonté de se mettre en commun. Et aujourd 'hui, la... la stratégie du réseau par rapport à cet enjeu de numérisation c 'est de se dire qu 'il n 'y a pas d 'IA sans numérisation, qu 'on pourrait faire des choses sous l 'angle du patrimoine culturel et que pour pouvoir arriver à l 'IA pour pouvoir arriver à enrichir et entraîner des modèles d 'intelligence artificielle au départ des données patrimoniales, il faut maîtriser et avoir atteint un certain degré de maturité de toute la chaîne des métiers du secteur des bibliothèques et archives libre autrement ce n 'est pas possible or à ce niveau là il y a évidemment en raison de l 'histoire, en raison des possibilités de financement qui sont très diverses et variées en fonction des réalités économiques des états etc des situations entre nos membres qui sont très différentes et donc il y a cet enjeu de solidarité au sein du réseau francophone numérique qui consiste à développer des formations de manière à permettre de faire relever le niveau moyen de maturité de chacun des stades d 'une pyramide de la maturité numérique que nous avons établie et dont la pointe, si vous voulez, est l 'intelligence artificielle. Et donc, il s 'agit de faire quoi ? D 'harmoniser les pratiques sur la manière dont on traite l 'inventaire, d 'harmoniser les pratiques sur la manière dont on repense les données qui sont présentes depuis longtemps dans les bibliothèques de ce programme informatique via les catalogues généraux, d 'insérer la notion de droit d 'auteur, évidemment, et de vérifier ce statut juridique, parce que dès qu 'on bascule dans le XXe siècle, forcément, il y a une partie qui n 'est pas nativement numérique, mais qui est sous droit et qui n 'est pas numérisée. Il y a ces fameuses œuvres indisponibles dans le commerce, par exemple, etc. Donc, il y a un volet juridique qui est très important. Il y a également un volet qui est la partie visible de l 'iceberg, c 'est la capture d 'images ou la capture du son, c 'est l 'opération technique à proprement parler. Quelles sont les conditions de cette numérisation ? il ne s 'agit pas simplement de photocopier le savoir si je puis parler de cette expression j 'ai l 'habitude de parler de mes collaborateurs quand on fait des visites dans les ateliers de numérisation quand certains numérisent des manuscrits du Moyen -Âge ou d 'autres, la presse qui intéresse énormément de monde pour moi ce sont des passeurs de savoir ce sont des personnes qui ont des activités extrêmement répétitives mais qui ont une immense responsabilité qui sont les ce sont les derniers lecteurs si vous voulez, manipulateurs de la source originale, la source analogique sans exception bien sûr et que en fonction de la qualité de leur travail, qui va évidemment être vérifié par un certain nombre d 'étapes de contrôle de qualité automatisée ou non automatisée en fonction de la qualité de leur travail et la manière dont les chaînes de numérisation auront été calibrées le résultat final, donc l 'original numérique quelque part où la copie numérisée sera plus ou moins fiable et donc plus ou moins exploitable et améliorera l 'univers, l 'entraînement des modèles IA. Donc voilà, pas sûr de savoir ou bien copistes des temps modernes, parce que finalement dans les abis, qu 'est -ce qu 'on faisait ? Les moines copistes ont fait recopier les textes de l 'Antiquité et les permettaient ensuite à cette connaissance de circuler. Mais en fait, finalement, numériser, c 'est pareil, c 'est une autre échelle, c 'est un autre rythme, mais il ne faut pas oublier cette dimension -là. Voilà, donc ça c 'est l 'enjeu essentiel de la numérisation, mais il y a un deuxième enjeu dont on parle peu pour que le produit de la numérisation puisse être exploité par l 'intelligence artificielle, c 'est que il ne suffit pas d 'avoir des belles images, il ne suffit pas d 'avoir des métadonnées structurées, il ne suffit pas d 'avoir respecté des normes colorimétriques. encore faut -il pouvoir produire du plein texte de qualité qui soit complet et quand il s 'agit de corpus textuel alors il y a les imprimés tout ce qui est non imprimé donc tout ce qui est de contenu manuscrit il faut là aussi aller faire en sorte que ce savoir là puisse être rétroversé dans une société numérique puis après toute la dimension iconographique, sonore, audiovisuelle où là il faut pouvoir aller rechercher ces contenus et les traduire dans une réalité intelligible par les machines et on en arrive alors au concept je terminerai par là ce concept de connections as data encore une fois en bon français des collections qui sont déstructurées enfin non pardon qui sont totalement dématérialisées et numérisées au sens stricto luterne mais qui sont transformées en données structurées qui sont alors directement exploitables par des machines et non plus par des yeux humains et ça c 'est indispensable pour pouvoir entraîner des modèles des modèles IA pour y arriver au niveau du réseau francophone numérique on y croit très fort à la collaboration à la nécessité d 'analyser le plus finement possible les préoccupations des uns et des autres et réaliser le terrain de manière à pouvoir progressivement et collectivement édifier cet édifice numérique du patrimoine parce que ce qu 'il y a jusqu 'à peu les autorités publiques acceptaient de financer la numérisation davantage à la fin de conservation même s 'il y avait cette volonté de faciliter l 'accès de permettre le développement des humanités numériques et c 'était essentiellement la conservation, le fait de sauvegarder un patrimoine en danger, en péril qui était l 'élément déclencheur du financement aujourd 'hui il y a une opportunité qui est une nécessité, mais qui est donc un deuxième enjeu, voire sans doute encore plus important. Il ne s 'agit non seulement plus d 'être conservé au format analogique, mais pour pouvoir exister ces données, elles doivent aussi être exploitables par des machines. Et donc, il faut dès lors pouvoir continuer à numériser, et donc considérer que les données patrimoniales ne sont plus seulement la mémoire de notre passé, mais qu 'elles constituent la matière première de notre avenir. Merci, c 'était un peu long, désolé.
Moderator
C'était très intéressant, très passionnant. Merci beaucoup, je pense que le monde a apprécié cette logique liéaire que vous avez développée, en tentant de créer, non seulement de numériser, mais que ce soit la numérisation minable, c 'est -à -dire que c 'est exploitable et interopérable aussi. Très bien, M. Petit, je vais essayer d 'intervenir.
Speaker 2
Je vais apporter un point un peu complémentaire, puisque les systèmes d 'IA ont besoin, pour s 'entraîner et pour fonctionner, de données de qualité, qui sont également des données qui sont pertinentes et qui tiennent compte du contexte culturel. C 'est -à -dire qu 'elles ont besoin de données, certes, qui peuvent être dans le domaine public, mais anciennes, nécessairement, mais également de données contemporaines, récentes, et qui, elles, vont souvent être couvertes par un droit d 'auteur. Donc, ça va être mon propos, en tant que représentant de l 'Organisation mondiale de la propriété intellectuelle, comment numériser ces œuvres du XXe siècle, qui sont dans un format analogique, qui peuvent être des textes, des livres, des chronogrammes, des films, encore sur bande magnétique, qui ont maintenant un bon équilibre avec le respect des droits des auteurs. Il s 'agit de la... question des limitations et exceptions aux droits d 'auteur. à la fois pour la préservation et pour l 'accès au public. Donc l 'OMPI, l 'Organisation Mondiale de la Propriété Intellectuelle que je représente, est là pour faire avancer un cadre international qui permette de faire avancer de manière équilibrée l 'intérêt général du public d 'avoir accès à des œuvres et le respect des droits de propriété intellectuelle, des droits d 'auteur et des droits voisins. Sur cette question de l 'accès et de la préservation, nous mettons à disposition de nos États membres des guides de bonne pratique. Un guide sur la préservation qui est aussi disponible en français sur notre site qui explique la manière dont les États membres, les institutions du secteur du patrimoine culturel comme les bibliothèques, les services d 'archives ou les musées, peuvent mettre en place des exceptions et limitations qui vont s 'inscrire dans le cadre du droit international pour actuer la préservation. Et un guide qui est en cours d 'édition, qui sera prochainement publié sur notre site. sur l 'accès aux œuvres protégées par le droit d 'auteur dans les collections des institutions chargées de patrimoine culturel. Donc toujours pour l 'usage des médiothèques, des services d 'archives et des musées. Car il est possible de faire les choses de manière correcte en respectant ce que nous appelons le test en trois étapes. C 'est -à -dire que les États ont la possibilité de fixer des exceptions et limitations au droit de reproduction, qui normalement est un droit exclusif, à trois conditions. Il doit s 'agir de cas particuliers, avec des objectifs bien précis. Cela ne doit pas entrer en conflit avec une exploitation normale de l 'œuvre. Et cela ne doit pas porter un préjudice induit aux intérêts légitimes des auteurs. Donc il est possible de... à la fois d 'assurer la préservation de ces œuvres toujours couvertes par le droit d 'auteur, une certaine accessibilité au public. Il se pose également la question de la possible utilisation des données numérisées par les systèmes d 'IA. Avant d 'entrer vraiment dans le propos, j 'aimerais faire quelques petits distinguos. D 'abord, quand on parle d 'accessibilité au public, il peut y avoir différents cas de figure. Ce n 'est pas du tout la même chose de permettre l 'accès à des collections de musées, de bibliothèques ou d 'archives à des chercheurs et de rendre accessible un document sur Internet. Lorsque l 'on parle maintenant d 'utilisation par des systèmes d 'IA, il peut y avoir plusieurs choses. Il peut y avoir une numérisation qui a pour but de permettre une recherche dans le corps du texte, mais sans donner accès à l 'intégralité du contenu. C 'est ce que permet notamment Google Books, qui a numérisé des dizaines de millions d 'œuvres couvertes par le copyright des États -Unis. Elles donnent des aperçus sur Internet, mais pas l 'accès à l 'intégralité du document. Dans la législation américaine, qui est très particulière, cela a été reconnu par la jurisprudence comme étant un usage loyal, inférieuse, toléré. Et ça n 'est pas du tout la même chose que de permettre l 'utilisation de ces données d 'œuvres numérisées couvertes par le droit d 'auteur comme données d 'entraînement pour l 'entraînement du système d 'IA. Et enfin, un troisième distinguo, rendre numérisé, rendre accessible ne veut pas dire gratuit. Nous assistons à la multiplication de contrats de licences entre, d 'une part, des détenteurs de contenus et, d 'autre part, des systèmes d 'IA. Et dès lors qu 'il y a un marché, se pose la question de la conformité à la deuxième étape qui reste entre trois étapes, c 'est -à -dire s 'il est possible de vendre un contenu numérique, peut -on imposer la gratuité ? Oui, en fait, sur l 'AXI. La réponse est probablement non, mais ensuite il peut y avoir un choix de politique publique visant à rendre librement accessible des données gouvernementales, également un choix des ayants droit de placer leur contenu sous une licence Creative Commons qui va être accessible sans paiement de royalties. Deuxième sous -cadre, il ne faut pas sous -estimer la valeur d 'usage pour les systèmes d 'IA d 'oeuvres qui n 'ont pas rencontré de succès commercial, ou même d 'oeuvres de contenu dans des langues rares, telles que les langues de peuples autochtones, de communautés locales, de minorités linguistiques et culturelles. Nous avons à l 'OMPI des présentations de marketplace, d 'entreprises spécialisées dans la structuration de jeux de données. Nous avons à l 'OMPI des présentations de marketplace, d 'entreprises spécialisées dans la structuration de jeux de données. langage, donc en 100 langues de documents, une base de données audio, donc en 100 langues différentes pour permettre d 'avoir un système d 'IA qui parle en langage humain de manière audio donc dans 100 langues différentes. Donc effectivement, ils vont avoir besoin d 'avoir des licences, des contenus sécurisés dans un grand nombre de langues différentes. Ensuite, parmi les différentes expériences de numérisation de la proposition par le droit d 'auteur, beaucoup donnent lieu à un système de rémunération et enfin se pose la question des partenariats publics -privés avec des entreprises et Google est particulièrement en train de proposer différents schémas de numérisation des données. Ça rentre également dans le cadre d 'une valorisation. ceci étant posé j 'aimerais faire passer 4 messages pour résumer le premier c 'est qu 'il est très important de poser lorsqu 'on veut définir une stratégie de numérisation de ces contenus toujours couverts par le droit d 'auteur la question du droit d 'auteur mais également celui de la protection du folklore lorsqu 'il s 'agit d 'accéder à des patrimoines non publiés de communautés locales de peuples autochtones qui peuvent être immatériels pour éviter tous les écueils potentiels parce qu 'il y a déjà des leçons à tirer de quelques exemples qui ont été tentés où en fait des pays ont essayé d 'introduire des exceptions trop larges au droit d 'auteur et qui ont été ressentis comme injustes par les ayants droit donc il y a eu des potons de flammes et des expériences qui n 'ont pas vraiment abouti donc ça je pourrais vous donner quelques exemples si vous êtes intéressé là -dessus et par ailleurs il peut y avoir un manque de confiance donc des communautés locales des peuples autochtones, des minorités hick et linguistiques qui auront sans doute très peu envie de partager leur savoir leur contenu, leur folklore s 'ils ne peuvent pas contrôler en fait les conditions d 'utilisation et les usages ultérieurs qui en seront faits par un système d 'IA. Deuxième point il doit absolument créer la confiance auprès des tenteurs de contenu grâce à une transparence sur les objectifs poursuivis et donc lorsque l 'on définit une stratégie et donc il faut avoir il faut pouvoir bien préciser quels vont être les usages à quelle fin en fait nous souhaitons numériser est -ce que c 'est ça non plus pour préserver, est -ce que c 'est pour rendre accessible et accessible à qui pourquoi est -ce qu 'il doit y avoir des étapes supplémentaires pour autoriser l 'utilisation par des systèmes d 'IA et pour quel type d 'utilisation par des systèmes d 'IA ? Est -ce que c 'est simplement pour la recherche textuelle ? Est -ce que c 'est pour rendre l 'ensemble accessible ? Troisième point. Et en fait, je vous dis un petit peu c 'est qu 'il y a certains états qui ont également des législations sur la possibilité par exemple d 'émettre une réserve contre l 'utilisation par les systèmes d 'IA. C 'est notamment la clause de réservation mise en place par l 'Union Européenne dans l 'article 4 de la directive sur le droit d 'auteur dans le marché commun digital. Troisième point. Il faut réfléchir au partage de la valeur entre créateurs de contenu et entreprises de l 'IA en ayant bien en tête les possibilités d 'accords de licence. Dans quelles conditions veut -on numériser ? Certains schémas proposent d 'entrer de jeu, de rémunérer, de verser une compensation aux auteurs dans le cadre d 'un mécanisme de gestion collective. Il faut réfléchir aussi aux propositions de partenariat public -privé et à leurs conséquences. Dans quelles conditions peut -on faire un partenariat pour la digitalisation des contenus ? Des contenus textuels, des contenus artistiques ou autres ? Est -ce qu 'on cède des droits ? Est -ce qu On garde juste des copies. Tout est possible. Tout peut avoir un intérêt. Ça dépend vraiment de la manière dont le bénéficiaire va définir sa politique, ce qu'il souhaite atteindre. Et enfin, il faut mettre en place une infrastructure robuste permettant l'attribution et la gestion des droits. Lorsque l'on numérise, il faut avoir une couche sémantique pour décrire les œuvres, qui va permettre à la fois de savoir qui en est l'auteur et de pouvoir également gérer les droits. Parmi les droits d'auteur, il y a un droit fondamental qui est le droit moral et le droit à être reconnu comme étant l'auteur de l'œuvre. Ces choses-là peuvent être faites grâce à des identifiants, grâce à des métadonnées. les identifiants sont bien connus il y a l'ISBN pour les livres l'ISSN pour les revues il y en a beaucoup d'autres qui sont utilisés dans la gestion des droits le DEOMI pour les articles l'ISAN pour les oeuvres audiovisuelles l'ISRC pour les phonogrammes l'ISWC pour les oeuvres musicales énormément de choses c'est très important de pouvoir avoir une bouche sémantique qui va être robuste, qui va intégrer tous ces éléments sur l'oeuvre qui va être numérisé pour permettre sa solidité à l 'ère de l 'IA. Il y a des travaux qui sont conduits actuellement par la groupe de travail sur l 'infrastructure du copyright de l 'auteur, par la Bibliothèque nationale de Finlande et la Bibliothèque nationale de Lettonie, qui ont publié un rapport sur la standardisation de ces éléments sémantiques, qui peuvent être d 'intérêt pour les participants. Et enfin, lorsqu 'il y a une gestion collective mise en place, il faut veiller aussi à la crédibilité et à l 'efficacité des organismes de gestion collective qui peuvent se voir attribuer la gestion de ces droits. Ça fait beaucoup d 'éléments qu 'il faut avoir en tête au moment de définir cette stratégie. L 'OMPI est à la disposition des États membres avec ces outils. Donc, c 'est guider. Merci. mais également ces outils de gestion tels que le logiciel WipoConnect qui permet de gérer les droits de manière automatisée
Moderator
Merci beaucoup encore une fois une intervention très riche, très dense merci à tous les deux d 'une part pour nous avoir expliqué de manière simple mais riche comment on fait pour numériser les contenus et les exploiter et comment on le fait bien comme on doit bien le faire et puis dans un deuxième temps les conditions pour exploiter les contenus numériques, sans plus tarder je vais ouvrir la parole, donner l 'occasion aux participants de poser leurs questions, d 'intervenir de donner leur point de vue aussi éventuellement c 'est pas une humiliation que ce soit sous forme de questions voilà la parole est ouverte et on va démarrer avec M. M. Diaray voilà on va prendre deux questions on va faire des rangs de deux questions, de trois questions et puis on laissera l 'occasion de discuter et puis on repartira
Speaker 3
Bonjour tout le monde merci à tous pour cette modération et merci pour les interventions j 'ai pas une grande voix, je suis désolé j 'ai perdu la force à moi c 'est comme des jaisés là on est sur un sujet très important c 'est à dire que il est la stratégie pour des contenus aujourd 'hui qui sont peut -être même pas structurés qui sont au port marouane parce que vous parlez de bibliothèque mais ça c 'est des structurés c 'est des données structurées je pense que dans certaines sociétés africaines aujourd 'hui c 'est de l 'oral donc peut -être que c 'est là où c 'est important quand on bâtit une stratégie de comprendre l 'auteur, de voir qu 'on n 'a pas tous uniformes dans la manière d 'aller vers l 'animalisation et aussi d 'éviter des exclusions dans cette partie -là, parce qu 'il y a une seule information orale qui existe quelque part dans ces sociétés -là et aussi beaucoup plus importante des flèves les pertinentes, mais elle n 'est pas mise en valeur parce qu 'elle n 'a pas un support, donc je pense que ça c 'est important aussi de voir dans les stratégies de l 'animalisation il faut voir quels sont les types d 'informations disponibles les canaux, l 'oralité ça c 'est important et deuxième c 'est comment les archiver avant d 'arriver à la période de l 'animalisation archivage si vous prenez votre dictaphone, vous allez en Afrique un veillard qui a plein de choses à vous dire qui sont utiles ou d 'autres comment on archive tout ça comment on garde comment on essaie d 'avoir une phase de transition pour se créer et aller vers la numérisation ça c 'est important aussi de penser cette méthode d 'archivage et le coût que ça peut apporter et puis j 'avais noté un autre point aussi je vais regarder un petit peu dans vos interventions c 'est le mode de conservation les impulsions de conservation qu 'il faut mettre en place dans cette stratégie là et puis après une fois que vous savez il faut arbitrer, à classifier parce que dans tout ce qu 'on a qu 'est -ce qui va être souverain qu 'est -ce qui ne l 'est pas c 'est à partir de là qu 'on verra ce qui est public ce qui est partagé ou pas si on rate aussi dans cette stratégie de définir ce qui est souverain et qui pourrait être partagé ou pas ça facilite de réguler j 'ai l 'impression parce qu 'il ne faut pas courir derrière la régulation si on peut l 'anticiper dans une stratégie le problème c 'est que souvent on enfonce et après on se rend compte qu 'on n 'a pas et puis on court vers la régulation qu 'on aurait fait antes et puis enfin je ne veux pas être loin dans ce truc de chéneté c 'est le coût le gros problème c 'est le financement la numérisation c 'est un coût ce qui coûte cher aujourd 'hui c 'est le coût ça c 'est un coût parce que tout le monde dit aujourd 'hui il faut numériser, derrière il faut des serveurs des data centers pour les stockings et tout le monde dit ça ne va pas, il n 'y a pas d 'électricité donc en fait il faudra peut -être dans la stratégie revoir ce qui est mieux pour la planète parce que si on va tous vers la numérisation c 'est pas un bon signe je m 'arrête là merci
Speaker 4
Boris Engelson, je ne sais pas journaliste indépendant, je ne sais pas si mon intervention que je vais essayer de faire brève est complémentaire ou antagoniste mais enfin elle va quand même être une question de temps et de temps dire pourquoi, de mon point de vue, les contenus inexploités le resteront. Parce que je prends le problème d 'une manière, je ne dirais pas antagoniste, perpendiculaire à vous. Admettons qu 'un martien débarque sur Terre dans mille ans et il veuille écrire l 'histoire de la Terre au XXIe siècle pour faire un livre pour les martiens. Il demandera toutes les archives, tous les actes de congrès, toutes les conversations téléphoniques qui représentent quand même l 'essentiel des idées, ou en tout cas des propos qui se lancent sur Terre, toutes les tickets de caisse et les carnets de lait, tous les courriers privés au public, tous les fonds invendus des brocantes de vieux livres, etc., les photos des runes, les vidéos scabreuses des médecins, etc. Donc tout ça, c 'est des contenus inexploités. Et ils sont inexploités en partie pour des raisons légitimes aujourd 'hui et de toute façon on ne peut pas attendre des bibliothèques et des législateurs qu 'ils œuvre essentiellement pour le martien qui va venir dans Milan, d 'ailleurs qui m 'a téléphoné tout à l 'heure, il faut un certain temps de préparation. Donc, ici nous avons deux pôles extrêmes du problème. Il y a le pôle réel, administratif, même bureaucratique, avec tous les préjugés aussi, les routines dont vous faites les dépositaires de gré ou de force, et puis il y a tout le potentiel des contenus inexploités idéal du point de vue d 'un martien. Tiens, alors comment est -ce que, où est -ce qu 'on place ce curseur et comment satisfaire la bienséance des humains bornés du XXIe siècle sans compromettre l 'encyclopédisme du martien dans Milan ? Voilà comment, moi, je vis le problème qui est assez différent, je crois, de ce qu 'on est censé discuter ici.
Speaker 1
Merci pour votre... J 'aime beaucoup parce qu 'effectivement, c 'est assez complémentaire. la question c 'est le problème c 'est que je ne sais pas si la société dans son ensemble considère que c 'est une question faut -il une IA par rapport à et faut -il une IA qui va remplacer les moteurs de recherche mais poser la question c 'est déjà être dépassé par une vague qui n 'a pas attendu qu 'on pose la question beaucoup de gens ont commencé déjà aujourd 'hui à ne plus utiliser les moteurs de recherche et à utiliser éthiquement des des sites ou des applications d 'intelligence artificielle générative pour obtenir des réponses en trois secondes à leurs questions aux questions qu 'ils se posent et donc quelque part le postulat de mon intervention c 'est de dire à partir du moment où on est dans cette société là en construction autant que les données sur base desquelles l 'IA s 'entraîne soient les plus complètes possibles et les plus fiables possible et donc c 'est ça Après, on peut aussi, effectivement, avoir d 'autres prises de position et considérer qu 'on doit rester en dehors de tout ça. Le souci, c 'est qu 'il y a déjà énormément de choses, énormément d 'informations sur le web. Il y a un concept que j 'aime beaucoup, c 'est le mot d 'infobésité. On en parle depuis 15 ans, je pense, de le fait qu 'il y a tellement d 'informations sur Internet que, quelque part, on ne sait plus par où commencer et que, finalement, tout le monde s 'en remet. — Avant l 'IA, quand on tapait dans Google, c 'était 787 millions de référents. — Au classement aveugle, c 'était là aussi une boîte noire. En fait, finalement, on entend aujourd 'hui qu 'il y a un certain nombre de constats qui ont fait l 'élève -même par rapport aux moteurs de recherche, en particulier au moment où Google s 'est imposé comme étant le plus utilisé dans le monde. Voilà. L 'enjeu, c 'est celui -là. C 'est que... — On peut très bien ouvrir toutes les portes de toutes les bibliothèques du monde. patrimoniales, bibliothèques de prêt, tout ce qu 'on veut, rendre accessibles tous les contenus audiovisuels dont vous parliez, parce que moi je les ai inclus, j 'avais parlé de l 'audiovisuel de manière générale, mais j 'ai bien conscience qu 'effectivement ce serait le milieu le plus catastrophique de se limiter à l 'imprimer ou à l 'éditer, avec l 'essentiel des ports entiers de la connaissance, du savoir, des traditions, de la culture, etc., ne sont pas écrits, très bien entendu, et partout dans le monde d 'ailleurs. Et dès lors qu 'on est dans l 'hypothèse de départ, forcément, si on veut que cette vieille soit la plus possible, il faudrait qu 'elle puisse aussi s 'entraîner sur ce type de données -là. Mais bon, forcément, si on veut les choses par rapport à la perspective du martien, ce serait de dire pour quoi faire, les investissements qui sont nécessaires pour les faire, sont -ils 1. réalistes, 2. les inhérents, 3. Et ça, c 'est une vraie question.
Moderator
ur la question des contenus oraux, il y a aussi une question à avoir bien en tête, c 'est celle de créer la confiance et de s 'assurer que la numérisation va se faire avec l 'accord des communautés et avec, pour elles, un retour de manière éditable. Il y a des exemples, moi j 'en ai un en tête, qui était l 'enregistrement d 'un chant religieux kanak, en Nouvelle -Calédonie, par des musicologues dans les années 80, donc un but non lucratif, et qui va être utilisé 20 ans plus tard par un musicien à succès, de manière complètement commerciale, et sans créditer la communauté d 'origine. Je pense que c 'est nécessaire d 'avoir ce souci, dès la conception de la stratégie, des utilisations. Et dans le futur, pour les encadrer, si l 'on veut réussir le succès de cette politique de préservation des savoirs locaux et oraux. Alors, pour répondre maintenant à la question du martien, là, je pense que vous voyez ça uniquement parce que vous ne voyez que la question des LLM, des chatbots omniscients qui vont produire essentiellement du texte. Or, les IA, les systèmes d 'IA aujourd 'hui sont beaucoup plus divers et on peut avoir des besoins très spécifiques. Et il ne faut pas croire que ces contenus qui peuvent avoir à dire anodin, de vidéos, de parties publiées, des heures de programmes, de journaux télévisés, n 'ont aucune valeur. Par exemple, si vous êtes une compagnie d 'IA, donc d 'IA générative, donc produisant de la vidéo... ou de l 'image, vous pouvez détecter dans votre système un manque, par exemple, sur le vol des hélicoptères. Et donc, la solution, parce que c 'est très difficile de simuler les balles des hélicoptères qui tournent, la solution, ça va être de demander à des data scientists de faire un jeu de données avec des images des hélicoptères qui volent. Et donc, ils vont devoir récupérer, dans des journaux télé, dans des reportages, dans des documentaires, dans des films, tout ce qui va être des images d 'hélicoptères en train de voler, pour les annoter, pour entraîner le système d 'IA pour s 'assurer que lorsque le capteur de manque des hélicoptères est en train de voler, ça soit une image de grande qualité. Et ça, ça vaut très cher. Et ça, ça vaut très cher. Donc, il est possible de vendre tout à fait ces contenus qui vous semblent complètement sans intérêt, de les commercialiser, d 'avoir un certain nombre de licences. si on arrive à trouver le bon mécanisme. Et par ailleurs, une œuvre qui n 'a eu aucun succès, pas forcément une œuvre sans valeur, je regardais aussi la base de données Relire, ui est le projet français pour rendre accessible à nouveau en ligne des œuvres du XXe siècle non rééditées. On va trouver quand même des autoréférences, des sujets de niche, qui ne vont pas intéresser le grand public, mais qui vont avoir de la valeur pour les spécialistes. D
Speaker 4
j 'allais dans votre sens. Je n 'ai jamais dit que c 'était sans intérêt, au contraire.
Speaker 3
Une seconde, juste une seconde. En fait, en gros, dans la stratégie, ce que lui provoque un peu, j 'ai compris, c 'est d 'éviter d 'avoir une partie de stratégie qui a eu des documents inexploités, d 'avoir des consommateurs et uniquement des gens à réduire la consommation. de produits dont ils ont participé mais ils deviennent juste consommateurs. Il y en a d 'autres qui vont en commercialiser, en bénéficier. C 'est pour ça que je parlais un peu de l 'Afrique. En gros, la connaissance risque aussi dans l 'IA d 'avoir les mêmes trucs qu 'on a eu avec les matières primaires. On produit, mais on est pauvre. L 'IA va arriver encore, on va produire des connaissances et on risque d 'être pauvre. C 'est ça la question.
Speaker 1
Si je peux revenir là -dessus et par rapport à votre question précédente sur la question des infrastructures, etc. Ce qui m 'a frappé tout à l 'heure dans la séance plénière, c 'est qu 'on parlait du cloud comme ayant été la fin quelque part sur le développement d 'une gouvernance transparente de tous ces modèles des nouvelles technologies. Parce qu 'on voit au niveau des infrastructures numériques, c 'est vraiment très enrichissant et très important. C 'est effectivement cette nécessité d 'apprendre à mieux d 'abord à mieux se connaître et mieux se comprendre les uns les autres. de comprendre les réalités de terrain qui sont différentes, les réalités symboliques, les réalités historiques, les réalités des enjeux culturels bien entendu, et de comprendre les inquiétudes et les craintes pour pouvoir y répondre collectivement et créer collectivement de la confiance. Parce qu 'effectivement il n 'y a pas d 'IA possible à mon sens sans confiance, et à partir des moments où on est contraint de s 'adresser à une boîte noire à laquelle on ne fait pas confiance, ça commence à devenir compliqué, puisque d 'un point de vue psychologique, on va continuer à évoluer dans un monde comme celui -là. Et donc, c 'est ce qui nous semble important au niveau du secteur bibliothèque et musée -archives, c 'est contribuer à l 'édification d 'un écosystème numérique qui soit ouvert, qui soit disponible pour terrain, qui soit... ... et qui puisse nourrir l 'ensemble des des publics qui sont historiquement les publics des chercheurs les publics des étudiants et puis alors un public plus large et aujourd 'hui aussi des machines finalement c 'est un segment de public quelque part qui serait lui aussi être utile par rapport au premier public et donc là il y a un effort de construction de la confiance qui est indispensable et qui n 'est pas forcément évident d 'où le fait de travailler sur des formations de manière transversale pour pouvoir avoir une meilleure maîtrise des marchés publics parce qu 'on n 'est pas forcément obligé de tout acheter ou de tout faire soi -même il faut maîtriser en tout cas ce qu 'on demande pour pouvoir ... pour pouvoir avoir un résultat qui soit réellement exploitable. Donc, la nécessité de partager les normes et standards, que ce soit en matière bibliographique ou en matière iconographe, en matière de calcul d 'images, de numérisation, de labellisation, etc., en matière d 'équipement, en matière de bibliothèque numérique, de portail agrégateur, et aussi essayer de permettre l 'interopérabilité dont vous parliez, favoriser la multiplicité, la multiplication des canaux de diffusion. Par exemple, le réseau francophone numérique a développé une bibliothèque qui s 'appelle la Bibliothèque du réseau francophone numérique. On a constaté à un moment donné, en novembre, que ça pouvait éventuellement être une crainte. En fait, c 'est une opportunité parce qu 'il y a un portail commun que pour autant, on ne peut pas enrichir des portails individuels ou des portails bilatéraux ou que ce soit un portail numérique. Mais, venant d 'un petit pays comme la Belgique, c 'est assez naturel. On a toute une érie de documents dans nos collections, par rapport auxquels personne dans le monde ne pensera, pas même l 'IA, ou alors il faudrait bien l 'entraîner, pensera à notre institution pour aller voir si on a des sources. Un exemple très simple, posté dans le sujet musical, on a des manuscrits autobac de Novo Tobac, autographe de Sebastian Bach. Il n 'est jamais venu en Belgique, il n 'est jamais venu à Bruxelles. Personne qui connaît un peu le sujet, qui s 'intéresse, va s 'intéresser à venir chez nous. Si on veut maximiser la chance que ce document soit un jour consulté, il faut aller en l 'air, le rendre accessible dans les portails qui auront opinion sur lui par rapport à cette question -là. Un autre exemple, par exemple si on a des contenus... Un francophone qui touche l 'histoire régionale européenne, par exemple, sera davantage consulté sur des sites spécialisés ou dans des portails européens. Et pareil, inversement, à partir du moment où on peut... diffuser largement dans des portails différenciés, spécifiques et plus ou moins spécialisés au départ des mêmes liens au plus on aura de la consultation, au plus on créera la possibilité d 'un accès à une information fiable et donc davantage on contribuera à l 'élimination d 'une société qui a responsable et unique
Speaker 5
Merci beaucoup Je suis la directrice du numérique du Sénégal J 'ai bien aimé la question de monsieur sur les marchés parce que c 'est ce que je donne souvent comme exemple chez moi au Sénégal en disant que d 'ici quelques temps on se retrouvera avec un de nos héros nationaux puisqu 'on a des... on transmet l 'information en oral, on va se retrouver un beau jour avec la Dior qui est dégoûtée, c 'est -à -dire en français, parce que tout simplement, on n 'a pas pris le temps pour la transmission orale de numériser et de pouvoir l 'utiliser avec les IA. Donc d 'ici quelques temps, peut -être que si on tape surtout sur les informations non numérisées, qu 'on se retrouve avec une falsification de l 'histoire. Donc c 'est pourquoi tout à l 'heure quand tu parlais de patrimoine, de patrimoine à numériser, il est important de numériser le patrimoine. Bien que ça coûte très cher, il faudrait qu 'on puisse le numériser, le structurer, parce que d 'ici quelques temps, on parle beaucoup de diversité, mais à un moment donné, il faut que dans cette diversité culturelle, que chacun sache ce qui lui appartient culturellement. Donc il est important, à mon avis, aujourd 'hui, dans les nouvelles stratégies, on pourra le voir, la voir. qui est assez important, mais surtout le modèle à mettre en place pour fiabiliser ces informations qui, chez nous en Afrique, sont au groupe. Quand est -ce que cette information est toujours fiable pour la mettre à disposition de tout le monde ? Et ça a structuré, donc ça, il sera important dans la stratégie qu 'ils mettront en place pour qu 'on puisse les intégrer. C 'est beaucoup plus une contribution et retrouver surtout notre collègue qui a parlé de Marcia et l 'importance également de pouvoir aussi avoir la propriété intellectuelle. En fait, c 'est cette propriété intellectuelle finalement infinie qui permet un peu de fiabiliser ces informations -là, infinies. Si dans cette stratégie très tôt, on intègre cet aspect de fiabilisation avec la propriété intellectuelle, je pense également qu 'on pourrait y arriver un peu plus. Merci beaucoup.
Moderator
Merci beaucoup. Je n 'ai rien dit. Cette question de savoir qu 'est -ce qui est numérisé, la propriété intellectuelle, la fiabilité, elle est très importante. Pour prolonger un petit peu la question de mon collègue sur la stratégie de la numérisation, et là si je reviens vraiment un peu à la question de l 'espace francophone, c 'est vraiment dans l 'espace francophone, qu 'est -ce qui serait dans le cadre de l 'espace francophone, deux questions, deux aspects, qu 'est -ce qui serait dans l 'espace francophone priorisé en matière de numérisation, quels seraient les critères de priorisation pour savoir qu 'est -ce qu 'on doit numériser, et puis comment l 'espace francophone peut développer sa souveraineté, construire un corpus francophone peut -être commun, ou une fédération de communs. Un corpus national ou institutionnel, si les règles sont différentes. Voilà, vous êtes toujours dans cette figure, on a peut -être un petit peu discuté là -dessus, mais ce serait intéressant peut -être d 'avoir votre point de vue sur cette question -là concernant... espace francophone en particulier si vous avez quelques mots on va dire maximum 5 minutes à tous les deux et ensuite vous pouvez faire le mot de culture t
Speaker 1
rès bien la priorité c 'est à mon sens d 'abord je pense que chaque institution, chaque groupe groupe social en fonction de ses réalités de son histoire et de ses sources en fait la priorité c 'est refaire l 'inventaire ou c 'est préciser l 'inventaire et savoir de quoi on parle inconcrètement donc qu 'est -ce qui est conservé jusqu 'à présent qu 'est -ce qui risque de disparaître et du coup la conservation revient quand même au galop cette notion de conservation quand on parle de sources sonores par exemple la tradition orale qui lorsqu 'elle a été ce qui n 'est pas toujours le cas mais est -ce qu 'elle a été à un moment donné retranscrite ou enregistrée forcément tout ce qui est sur bande magnétique par exemple c 'est extrêmement fragile donc c 'est une priorité absolue ça c 'est l 'un des éléments le deuxième élément c 'est je pense multiplier les canaux d 'accès parce qu 'au plus on a des canaux d 'accès au moins on s 'affranchit d 'une potentielle arbitraire dans la manière dont on est et alors la solidarité pour venir ensemble à la maîtrise de la maturité numérique pouvoir être à même en tant que détenteur de ces collections de faire des choix judicieux en termes d 'opération, en termes de choix de matériel d 'infrastructures, de partenaires, etc. et pas se faire dicter la loi par des acteurs économiques qui très rapidement quand il n 'y a pas de l 'expertise de la table de l 'enseignement on peut prendre ce qui est le plus
Speaker 2
e vais être très bref parce que l 'OMPI ne propose pas ou ne tente pas d 'imposer une norme à quelconque pays nous sommes là pour aider les pays à atteindre les objectifs qu 'ils se fixent eux -mêmes je ne vais pas tout à fait réagir à la question mais il y avait aussi une question qui était un peu plus technique comment peut -on signaler les usages qui vont être tolérés les conditions d 'utilisation je pense que c 'est tout à fait possible de le faire dans la couche sémantique qui va décrire les objets numérisés d 'inclure à l 'intérieur l 'objectif de la numérisation dans quelles conditions ils peuvent être utilisés si c 'est quelque chose de sensible qui peut être largement accessible si l 'usage doit être restreintes. Je pense que c 'est également l 'importance d 'avoir des métadonnées qui vont être extrêmement précises parce qu 'elles vont permettre d 'être visibles directement par la machine et exploitables plus facilement et conformément à la politique fixée par l 'État.
Moderator
xcellent. Merci beaucoup pour ces interventions. Je vais peut -être vous laisser encore deux mots. Je peux vous dire que vous allez voir les éléments sur le mot. Tu voulais dire quelque chose ? J 'aimerais, parce qu 'en fait, ce qui pourrait être équitable entre les hommes et les femmes, je pense que vous voulez en parler. C 'est important parce que la normalisation est juste dans la logistique de données. C 'est important. J 'ai juste voulu dire un point au niveau des priorités que vous avez. Vous venez de mentionner. On parle depuis ce matin -là, comment on peut influencer le contenu numérique, comment est -ce qu 'on peut vraiment ne plus avoir de biaiser un peu les informations
Speaker 6
qui sont sur le net. Est-ce qu'il y a des priorités qui ont été identifiées au niveau des bibliothèques, au niveau de l'envie, classification des données avec des recommandations peut-être de numériser une certaine catégorie d'informations ? Est-ce que les normes peuvent contribuer à faciliter ce processus-là ? Parce que là, s'il n'y a pas un plan d'action, comment est-ce qu'on va vraiment aboutir à cet objectif-là ? Ça demande des fonds, des financements, ça demande des priorités politiques au niveau national, ça demande beaucoup de mobilisation. Est-ce que vous voyez cela prendre place ? Il y a des priorités au niveau national des pays membres ? Alors... C'est très bien. Désolée, mais... C'est un marqué à insister, là. C'est une excellente question. Ça rejoint la dégoût de confusion, parce que justement, j'avais demandé des...
Moderator
des priorités à pouvoir défendre collectivement au niveau international. Donc ça rejoint tout à fait. Je crois que...
Speaker 1
je crois que l'IA permet de remettre à l'avant-plan les enjeux de la numérisation alors que beaucoup de gens savent que c'est terminé c'est évidemment pas le cas parce que il y a des effets molles et à un moment donné pendant des décennies il est resté sous le mur donc là il y a une opportunité de reconscientiser les autorités publiques et de la nécessité de financer ces campagnes de préservation et de numérisation du patrimoine Deuxièmement Deuxièmement, il y a moyen de jouer sur l 'urgence, parce que l 'urgence est plus criante qu 'à l 'époque où on parlait essentiellement de pouvoir conserver plus facilement des sources qui allaient disparaître. On sait que tout ce qui est ce bande magnétique, par exemple, a vraiment vocation à disparaître. Il suffit que les bandes se démagnétisent et c 'est terminé. On sait que la presse, même bien conservée, disparaîtra en raison de la signification du papier, alors que, par exemple, des manuscrits au Moyen -Âge, pour se parler de ma bibliothèque, bien conservés, sont toujours très bien conservés dans 500 ans. Mais la priorité, ça reste clairement le patrimoine en danger ou menacé ou fragile, la presse dans des traditions plus écrites et les sources sonores. par rapport à tout ce qui est patrimoine immatériel ou tradition orale, etc. Les documents uniques, parce que là, les bibliothèques, on oublie, mais elles sont en situation de monopole, donc si elles ne le font pas, personne ne le fera. Ça veut dire que c 'est tout le patrimoine manuscrit, et là, ça touche tout le monde, que ce soit de la correspondance, que ce soit de l 'édition, etc., peu importe. Et puis après, il y a, en général, là, je parle plutôt dans le secteur des bibliothèques nationales, le principe de subsidiarité qui dit que, bon, chaque État doit, quelque part, faire son travail, et donc il y a le principe du patrimoine national, donc pour la Belgique, ce qu 'on appelle le Belgique canard. C 'est un État qui a moins de 200 ans, donc on ne s 'arrête pas à 1830, c 'est, en gros, le patrimoine en lien avec l 'histoire des régions qui constituent l 'actuelle Belgique. Et si chacun fait comme ça, forcément, collectivement, on arrive alors quand même à aller assez loin. Voilà, ça, c 'est la base. Mais... Au niveau de l 'IA, aujourd 'hui, il y a une meilleure liberté. Ce que j 'ai pu voir, en tout cas au niveau belge, chez certains de mes collègues francophones, c 'est quand même essentiellement des textes qui sont, et sont à raison d 'ailleurs, des textes qui visent à essayer de baliser l 'utilisation de l 'IA, a fortiori à commencer au sein du secteur public, notamment en appui à la décision politique, mais pas à la plage de la décision. C 'est un principe qu 'on retrouve quand même un peu partout, mais on n 'est pas encore réellement dans des programmes qui permettent de refinancer l 'ensemble des chaînes qui aboutissent à l 'IA, au bénéfice de l 'IA, pour l 'IA et en raison de l 'IA. Et ça, c 'est le combat suivant. Autrement, effectivement, comme vous l 'avez évoqué tout à l 'heure, on n 'avancera pas davantage, pas plus vite, et donc à ce moment -là, on sera forcément tous tous tributaires du fait qu'on ne pourra pas combattre, enfin même comme ça, de toute façon, on ne pourra pas combattre les armées de trolls, ce que l'on appelle, qui produisent automatiquement des conduits, il y a des conduits sur le monde, en s'inspirant des armées de trolls.
Moderator
Peut -être, si vous avez envie de faire quelque chose, normalement, en une minute. Parce que vous avez passé le 4 minutes.
Speaker 2
C 'est peut -être les grands principes que j 'aimerais mettre en avant, d 'intégrer dans les stratégies, d 'assurer, de créer la confiance avec les ayants droit, mais également les communautés porteurs de tradition orale, d 'assurer la transparence des systèmes d 'IA, s 'agissant des contenus exploités, et finalement, de mettre en place aussi un système d 'infrastructures, de couches sémantiques qui soient robustes, incluant des identifiants et des métadonnées qui permettent d 'identifier les auteurs et de gérer les droits localisés. Merci.
Prévisions 2023 : 12 tendances en matière de gouvernance numérique et de diplomatie
Par exemple, les données doivent-elles être traitées comme une question technique, juridique, économique, sécuritaire ou socioculturelle ? L'IA est une question encore plus complexe avec des lignes de démarcation floues ...
10 tendances en matière de diplomatie et de gouvernance numériques pour 2022
7. Un accent accru sur les valeurs dans la gouvernance numérique élèvera l'importance des droits de l'Homme en ligne. Après la stratégie de l'administration Biden en matière de politique numérique mondiale axée sur les ...
Ties between generative artificial intelligence and intellectual property rights
Introduction Artificial intelligence (AI) is becoming an increasingly important part of our daily lives, from search engines and automatic driving systems to generative AI (GenAI) such as ChatGPT, MidJourney, and DALL-...
Atelier #2 : « Comment les politiques publiques et les cadres de gouvernance peuvent-ils soutenir la promotion de la diversité culturelle et linguistique dans le domaine de l’intelligence artificielle ? »
Elle a illustré la complexité de la préservation culturelle à travers l'exemple d'un masque africain, démontrant comment un même objet peut être perçu de manières radicalement différentes selon les perspectives culturell...
Rapport: Des voix africaines plus fortes dans le numérique : construire une politique étrangère et une diplomatie africaines du numérique
À mesure que le dynamisme numérique de l'Afrique s'accroît, sa participation à la politique numérique mondiale doit augmenter. Dans cette transition, les pays africains doivent composer avec les réalités géopolitiques de...
Strengthening Africa’s voices in global digital processes
After looking at the current situation, the discussion will provide practical insights and suggestions on why and how to broaden the African digital diplomacy footprint in international processes, focusing on those deali...
1

La base confirme explicitement que « l'IA est construite sur des données », et que la gouvernance des données et celle de l’IA vont de pair [S19].

2

Cette idée est corroborée par [S29], qui rappelle que les données utilisées par l’IA sont majoritairement anglophones et que les plateformes recommandent souvent des contenus anglophones, ce qui pose un défi direct pour la diversité linguistique francophone en ligne [S29].

3

La base apporte un contexte utile en montrant que la concentration du pouvoir numérique et l’inégalité numérique sont identifiées comme des risques majeurs, en particulier pour les régions moins favorisées, ce qui renforce l’idée d’un enjeu de souveraineté informationnelle et culturelle [S22].

4

La base n’aborde pas directement les institutions patrimoniales, mais elle confirme plus largement que l’usage accru des données par les organisations et pouvoirs publics doit servir des politiques fondées sur des preuves, tandis que la gouvernance des données devient plus politique [S19]. Cela donne du poids à la dimension de politique publique évoquée dans le rapport.

5

La base confirme que l’essor d’outils comme ChatGPT a fait émerger de nouvelles questions de gouvernance pratique et de protection des droits de propriété intellectuelle [S19].

6

La base ajoute un élément important en soulignant le rôle d’instances internationales comme l’UNESCO dans l’élaboration de pactes et chartes culturels, ainsi que le rôle moteur de l’Europe dans la gouvernance numérique et de l’IA [S37] et [S19].

IGFSA | SIDE EVENT — I am Here representing the dynamic coalition on accessibility and disability where I am a co-coordinator I am also a a Secretary the treasurer of the both the The ISAC accessibility standing group and also the accessibil...
Michael Frendo — The Hon. Dr Michael Frendo, MP, currently, Speaker of the Parliament of Malta, has been a Member of the Maltese Parliament for the past 23 years. From 1990 to 1992, he was Parliamentary Secretary (Minister of State) for ...
IGFSA | SIDE EVENT — I am Here representing the dynamic coalition on accessibility and disability where I am a co-coordinator I am also a a Secretary the treasurer of the both the The ISAC accessibility standing group and also the accessibil...
Michael Frendo — The Hon. Dr Michael Frendo, MP, currently, Speaker of the Parliament of Malta, has been a Member of the Maltese Parliament for the past 23 years. From 1990 to 1992, he was Parliamentary Secretary (Minister of State) for ...
Internet3: An Internet based on 21st Century Principals | IGF 2023 Launch / Award Event #179 — Thank you. Great. Yeah. Speakers Hideshi Takatani Speech speed 121 words per minute Speech length ...
The Role of Parliamentarians in Shaping a Trusted Internet Empowering All People — The potential benefits are enormous. The potential risks are also. How do we as lawmakers, technical experts, civil society, come together to build a force? framework for development and use artificial intelligence that ...
Michael Frendo — The Hon. Dr Michael Frendo, MP, currently, Speaker of the Parliament of Malta, has been a Member of the Maltese Parliament for the past 23 years. From 1990 to 1992, he was Parliamentary Secretary (Minister of State) for ...
IGFSA | SIDE EVENT — I am Here representing the dynamic coalition on accessibility and disability where I am a co-coordinator I am also a a Secretary the treasurer of the both the The ISAC accessibility standing group and also the accessibil...
Parliamentary Session 4 From Dialogue to Action Advancing Digital Cooperation Across Regions and Stakeholder Groups — Speakers Speakers from the provided list: - Jennifer Chung - Moderator, from DotAsia and 2025 MAG member - Olaf Kolkman - Principal of Internet Technology Policy and Advocacy at the Internet Society -...
Michael Frendo — The Hon. Dr Michael Frendo, MP, currently, Speaker of the Parliament of Malta, has been a Member of the Maltese Parliament for the past 23 years. From 1990 to 1992, he was Parliamentary Secretary (Minister of State) for ...
Parliamentary Session 4 From Dialogue to Action Advancing Digital Cooperation Across Regions and Stakeholder Groups — Speakers Speakers from the provided list: - Jennifer Chung - Moderator, from DotAsia and 2025 MAG member - Olaf Kolkman - Principal of Internet Technology Policy and Advocacy at the Internet Society -...
Michael Frendo — The Hon. Dr Michael Frendo, MP, currently, Speaker of the Parliament of Malta, has been a Member of the Maltese Parliament for the past 23 years. From 1990 to 1992, he was Parliamentary Secretary (Minister of State) for ...
IGFSA | SIDE EVENT — I am Here representing the dynamic coalition on accessibility and disability where I am a co-coordinator I am also a a Secretary the treasurer of the both the The ISAC accessibility standing group and also the accessibil...
[GUIDE] Who should be on your organising team? — Who are the key people you need to organise and run a meeting or event? Generally, a moderator (or host) is always required, regardless of the size of the group. As for the rest, it depends on the size of your event… and...
[HOW-TO] The art of moderating effectively —   A moderator can make or break a meeting. The moderator's role is therefore crucial in meetings and events. What is the moderator's role? Pretty much like the conductor of an orchestra, the moderator's role i...
IGFSA | SIDE EVENT — Speakers and Moderators Amrita Choudhury, the Director of CCAOI, Treasurer of Internet Society India, Delhi Chapter and the APAC Lead of SIG Women Jennifer Chung, heads the Secretariat for Internet Governance Forum Su...
IGFSA | SIDE EVENT — His leadership and advocacy will undoubtedly contribute to the development of a robust internet governance framework in the country as it continues to navigate its digital future. Nasa Nicholas Kirama...
The WSIS welcome Part II: and now for the Shakers! — The adaptability of the WSIS Action Lines was acknowledged for matching the pace of rapid technological changes, supported by the Internet Governance Forum's role in wider digital governance issues.This high-level discus...
Prévisions 2023 : 12 tendances en matière de gouvernance numérique et de diplomatie — Par exemple, les données doivent-elles être traitées comme une question technique, juridique, économique, sécuritaire ou socioculturelle ? L'IA est une question encore plus complexe avec des lignes de démarcation floues ...
Séance d'ouverture : « La gouvernance internationale du numérique et de l’IA : à la croisée des chemins ? » — Je garde l'outil. Avec l'IA, le problème est que ces IA créent, créent des choses qui peuvent être mauvaises pour l'humanité. Et donc, ensemble, nous devons décider comment les utiliser. Et pour savoir comment les utilis...
Panel #3: « Gouverner les données : entre souveraineté, éthique et sécurité à l’ère de l’interconnexion » — Est-ce qu'on peut s'accorder deux minutes, parce que je voudrais donner la parole à Destiny Tchéhouali pour une petite intervention, le professeur Tchéhouali donc qui est intervenu hier dans le cadre de la diversité, par...
10 tendances en matière de diplomatie et de gouvernance numériques pour 2022 — De nouveaux outils pour les activités diplomatiques Des négociations et de la rédaction à la représentation et à la promotion, la numérisation des fonctions diplomatiques devrait s'accélérer en 2022. L'utilisation des s...
Rapport: Des voix africaines plus fortes dans le numérique : construire une politique étrangère et une diplomatie africaines du numérique — À mesure que le dynamisme numérique de l'Afrique s'accroît, sa participation à la politique numérique mondiale doit augmenter. Dans cette transition, les pays africains doivent composer avec les réalités géopolitiques de...
Ties between generative artificial intelligence and intellectual property rights — Introduction Artificial intelligence (AI) is becoming an increasingly important part of our daily lives, from search engines and automatic driving systems to generative AI (GenAI) such as ChatGPT, MidJourney, and DALL-...
Atelier #2 : « Comment les politiques publiques et les cadres de gouvernance peuvent-ils soutenir la promotion de la diversité culturelle et linguistique dans le domaine de l’intelligence artificielle ? » — Elle a illustré la complexité de la préservation culturelle à travers l'exemple d'un masque africain, démontrant comment un même objet peut être perçu de manières radicalement différentes selon les perspectives culturell...
Rapport: Des voix africaines plus fortes dans le numérique : construire une politique étrangère et une diplomatie africaines du numérique — À mesure que le dynamisme numérique de l'Afrique s'accroît, sa participation à la politique numérique mondiale doit augmenter. Dans cette transition, les pays africains doivent composer avec les réalités géopolitiques de...
Prévisions 2023 : 12 tendances en matière de gouvernance numérique et de diplomatie — Alors que la mise en œuvre des résultats du SMSI est réexaminée, il en sera de même pour l'avenir du Forum sur la gouvernance de l'Internet (FGI). Au début de l'année 2023, le FGI contribuera au processus du Pacte numé...
10 tendances en matière de diplomatie et de gouvernance numériques pour 2022 — Comme la principale bataille réglementaire en matière de technologies se déroule à Bruxelles, de nombreux autres pays suivent de près l'UE et adoptent des réglementations similaires, comme ce fut le cas avec le Règlament...
Atelier #1 : « Comment mettre en place des mécanismes de mesure de la pluralité culturelle et linguistique des contenus en ligne ? » — Differences Different viewpoints Approche méthodologique pour la mesure de la découvrabilité Nécessité de développer des méthodes scientifiques rigoureuses pour mesurer la place des langues sur Internet, car le...
Atelier #2 : « Comment les politiques publiques et les cadres de gouvernance peuvent-ils soutenir la promotion de la diversité culturelle et linguistique dans le domaine de l’intelligence artificielle ? » — Et à chaque fois, c'était l'idée d'un lieu, d'une case où étaient entreposés des objets sacrés, avant qu'ils ne ressortent pour des cérémonies, comme ce masque. Et on est donc bien là dans l'idée d'un musée qui serait en...
Prévisions 2023 : 12 tendances en matière de gouvernance numérique et de diplomatie — Par exemple, les données doivent-elles être traitées comme une question technique, juridique, économique, sécuritaire ou socioculturelle ? L'IA est une question encore plus complexe avec des lignes de démarcation floues ...
10 tendances en matière de diplomatie et de gouvernance numériques pour 2022 — 7. Un accent accru sur les valeurs dans la gouvernance numérique élèvera l'importance des droits de l'Homme en ligne. Après la stratégie de l'administration Biden en matière de politique numérique mondiale axée sur les ...
Ties between generative artificial intelligence and intellectual property rights — Introduction Artificial intelligence (AI) is becoming an increasingly important part of our daily lives, from search engines and automatic driving systems to generative AI (GenAI) such as ChatGPT, MidJourney, and DALL-...
Atelier #2 : « Comment les politiques publiques et les cadres de gouvernance peuvent-ils soutenir la promotion de la diversité culturelle et linguistique dans le domaine de l’intelligence artificielle ? » — Elle a illustré la complexité de la préservation culturelle à travers l'exemple d'un masque africain, démontrant comment un même objet peut être perçu de manières radicalement différentes selon les perspectives culturell...
Rapport: Des voix africaines plus fortes dans le numérique : construire une politique étrangère et une diplomatie africaines du numérique — À mesure que le dynamisme numérique de l'Afrique s'accroît, sa participation à la politique numérique mondiale doit augmenter. Dans cette transition, les pays africains doivent composer avec les réalités géopolitiques de...
Strengthening Africa’s voices in global digital processes — After looking at the current situation, the discussion will provide practical insights and suggestions on why and how to broaden the African digital diplomacy footprint in international processes, focusing on those deali...
Panel #2 : « Diversité et découvrabilité : quelle gouvernance pour promouvoir et rendre davantage visibles les contenus francophones (nationaux/locaux) en ligne ? » — Et puis, il y a un troisième niveau qui me paraît très important, c'est le niveau de l'international, c'est-à-dire des structures et des instances, je pense évidemment à l'UNESCO dans le domaine de la culture, parce que ...

Disclaimer: This is not an official session record. DiploAI generates these resources from audiovisual recordings, and they are presented as-is, including potential errors. Due to logistical challenges, such as discrepancies in audio/video or transcripts, names may be misspelled. We strive for accuracy to the best of our ability.