Produits
Solutions
Entreprise
Entreprises
Se connecterCréez votre réseau
inclusion · multilingual · low-connectivity

Inclusion par conception : une IA qui fonctionne sur une connexion lente

Multilingue, multimodale et conçue pour une faible connectivité — pas seulement pour une ligne rapide dans une grande ville. L'inclusion est une contrainte de conception, pas un slogan.

Inclusion par conception : une IA qui fonctionne sur une connexion lente

La plupart des produits d'IA sont conçus et mesurés sur une ligne rapide dans une grande ville. C'est un problème d'échantillonnage, pas une déclaration de vision — ceux qui conçoivent les systèmes et ceux qui peuvent les atteindre confortablement partagent le même profil de connectivité étroit. Nous traitons l'inclusion comme une contrainte de conception que l'architecture doit satisfaire, pas un slogan imprimé après le lancement. Cet article expose ce que cela signifie en pratique : multilingue par défaut, multimodal par défaut, et conçu pour continuer à fonctionner quand la connexion est lente ou intermittente.

C'est aussi le premier article du blog marketing que nous publions en sept locales — anglais, espagnol, portugais, chinois, japonais, allemand et français. Le blog lui-même est la preuve, non l'affirmation. ✅ Production.

The Honest Architect — Points clés

  • L'inclusion est une contrainte architecturale : nommez le mécanisme (chemins small-model, repli text-first, routage géospatial), puis étiquetez son état de maturité.
  • En 2026, MIT News a rapporté le travail de Devavrat Shah sur l'IA « utilisant des ressources de calcul limitées » pour des décisions du monde réel — la même contrainte qui fait fonctionner un système sur une connexion lente (MIT News, 2026).
  • Le moteur conversationnel HAI tourne en production depuis 2016 ; c'est la fondation sur laquelle le reste se compose.
  • Multilingue et multimodal ne sont pas des fonctionnalités boulonnées après coup. Elles sont la forme que le système doit prendre pour être atteignable du tout.

Pourquoi l'inclusion appartient-elle à l'architecture, pas au texte marketing ?

En 2026, MIT News a rapporté dans « Helping AI models to meet the real world » que le groupe du professeur du MIT Devavrat Shah conçoit des méthodes qui gèrent « une prise de décision seconde par seconde en utilisant des ressources de calcul limitées » (MIT News, 2026). Le cadrage est celui que nous tenons : quand le budget de ressources est fini, l'architecture doit faire un choix, et ce choix est la décision d'inclusion. On ne peut pas l'ajouter après avec une bannière.

[UNIQUE INSIGHT] Le produit d'IA standard est optimisé pour l'acheteur médian — une connexion rapide et forfaitaire, un appareil récent, une langue, une modalité (texte). L'inclusion est ce qu'on obtient quand on refuse ce médian comme centre de conception. La contrainte force l'ingénierie : des chemins de modèle plus petits, des replis text-first, une couche de routage qui n'envoie pas un mégaoctet de bundle client pour trouver la bonne salle. Chez Everythink, l'espace est le routeur — network → community → room — de sorte qu'une requête atterrit dans le bon polygone avant que quoi que ce soit réponde. Ce mécanisme, pas un slogan, est ce qui rend le produit atteignable sur une mauvaise connexion.

L'étiquette The Honest Architect compte ici. Le moteur conversationnel HAI est ✅ Production, en service depuis 2016. Social, Campaigns et la Whitelabel Network sont ✅ Production. Matchmaking, Marketplace et Calendar sont ⚠️ Partial. Wallet & Token, Super App et Community Credit sont 🔵 Roadmap. Nous ne promouvons pas un état pour paraître inclusif. Si une capacité n'est pas construite, elle n'est pas affirmée.

Comment la spécialisation rend-elle un système plus inclusif, pas moins ?

Une objection courante va ainsi : si vous spécialisez pour une faible connectivité, vous construisez un système pire pour tout le monde. Les mathématiques disent l'inverse. En 2026, l'essai de Dharma-AI « Why Specialization Is Inevitable » a parcouru le théorème no-free-lunch de Wolpert et Macready de 1997 et a conclu qu'« un algorithme gagne en étant un bon ajustement au problème cible », et que « l'universalité générale est un concept théorique, mais en termes pratiques c'est un mythe » (Dharma-AI, Hugging Face, 2026).

[ORIGINAL DATA] Nous avons formalisé le même instinct dans notre série académique de 21 papers. Theorem 3 énonce qu'une propriété est garantie exactement quand son mécanisme est implémenté et mesurant. L'inclusion est une propriété de ce type : elle n'est garantie que lorsque le mécanisme de faible connectivité est construit et observé. Une affirmation d'inclusion sans mécanisme derrière est, par Theorem 3, non une garantie — c'est du marketing. Le mécanisme que nous pointons est le routeur de topologie plus les chemins de modèle à petit empreinte que le moteur utilise depuis 2016.

La spécialisation ne signifie pas construire un produit « lite » séparé pour les connexions médiocres. Elle signifie que le produit unique est façonné par la contrainte. Comme le dit l'article du MIT, « un focus plus étroit vient avec une technologie plus acérée, mais il est assez large pour être très précieux » (MIT News, 2026). L'étroitesse est d'où vient l'inclusion. Le laboratoire de Shah construit sur des données tabulaires et des séries temporelles, pas seulement texte et images, parce que c'est la forme de la décision du monde réel. Notre analogue est le polygone géospatial — la salle est l'unité de contexte, et le routage vers elle est bon marché.

L'IA multilingue peut-elle vraiment fonctionner au-delà de l'anglais ?

En 2026, IBM Granite a publié « Granite Embedding Multilingual R2 », une famille d'embeddings Apache-2.0 couvrant plus de 200 langues, ajustée sur 52, avec un modèle compact de 97M de paramètres qui « bat tous les embedders multilingues ouverts sous 100M » sur le benchmark MTEB Multilingual Retrieval (IBM Granite, Hugging Face, 2026). Le compromis que l'article nomme est celui que tout système multilingue rencontre : « une large couverture linguistique vient généralement au coût de la taille du modèle, et les petits modèles sacrifient généralement des langues. » Le modèle compact de 97M est l'artefact d'inclusion — il tourne là où un modèle de 311M ou de 3B ne tourne pas.

Le même mois, le Technology Innovation Institute a publié « Introducing Falcon-H1-Arabic », une famille hybride Mamba-Transformer en paramètres de 3B, 7B et 34B entraînée sur environ 300 milliards de tokens en arabe, anglais et contenu multilingue (TII, Hugging Face, 2026). Le détail qui compte pour l'inclusion est le dialecte : l'arabe moderne standard coexiste avec l'égyptien, le levantin, le golfe et le maghrébin, « chacun avec des vocabulaires et des constructions grammaticales distincts. » Un modèle qui ne gère que MSA n'est pas inclusif des locuteurs arabes — il est inclusif du registre formel.

[PERSONAL EXPERIENCE] Nous avons pris la même décision pour ce blog. Il publie en sept locales — en, es, pt, zh, ja, de, fr — depuis un seul manifeste, avec des alternates hreflang et un slug par locale. La route anglaise est sans préfixe ; les six autres sont préfixées. Le build est statique par locale. Ce n'est pas une fonctionnalité de traduction ajoutée par-dessus un produit anglais. C'est le produit étant multilingue à la couche de routage. Si le système ne peut pas vous atteindre dans votre langue, il n'est pas inclusif de vous, quel que soit le nombre de langues que le modèle comprend en interne.

Qu'apporte le multimodal que le texte seul ne peut pas ?

En 2026, Hume AI a publié « Introducing Real World VoiceEQ », un benchmark construit à partir de plus d'un million de notations humaines sur plus de 40 modèles de voix et plus de 15 dimensions (Hume AI, Hugging Face, 2026). Sa conclusion centrale est l'argument d'inclusion dans un autre registre : « les benchmarks traditionnels surestiment de plus en plus la performance dans le monde réel », parce que les modèles « continuent de peiner avec la parole accentuée, les locuteurs superposés, l'émotion, le bruit de fond et les conversations plus longues. » Un modèle de voix qui score bien sur un audio de studio propre n'est pas un modèle de voix inclusif. C'est un modèle de voix pour le studio.

Le multimodal est une contrainte d'inclusion pour deux raisons. D'abord, la parole est le texte à plus faible bande passante : une phrase parlée dans un marché de producteurs, une clinique ou une tournée de livraison porte du sens qu'un clavier ne porte pas, et elle fonctionne pour des personnes qui ne tapent pas dans la langue du système — ou pas du tout. Ensuite, l'image et la géo portent un contexte que la prose ne peut pas coder à peu de frais. La topologie d'Everythink route sur des préfixes geohash, pas sur la géométrie PostGIS complète, précisément pour qu'un appareil mobile sur un pipe fin puisse dire au serveur où il est sans un round-trip lourd.

La conclusion de VoiceEQ que « les modèles de voix sont devenus meilleurs pour parler que pour écouter réellement » est la mise en garde. Le multimodal n'est pas inclusif par défaut ; un modèle de voix qui manque un « …oui… » hésitant dans un contrôle de fraude est un modèle qui a décidé qui est son utilisateur. L'inclusion par conception signifie construire pour le oui hésitant, le oui accentué et le oui bruyant, et mesurer qu'on le fait. ✅ Production pour le contexte aware-of-room du moteur HAI ; ⚠️ Partial pour la surface vocale plus large, qui n'est pas encore aussi mesurée que nous le voulons.

Comment construire pour une connexion lente, pas seulement pour une ligne rapide ?

En 2026, MIT News a cité Devavrat Shah sur le problème central de conception : « avec une petite quantité de ressource, vous devez faire beaucoup de travail lourd » (MIT News, 2026). C'est le problème de faible connectivité énoncé comme une contrainte d'ingénierie. Les réponses architecturales, dans notre stack, sont concrètes et aucune n'est un adjectif.

D'abord, router avant de rendre. Le routeur de topologie résout network → community → room sur le serveur, de sorte que le client reçoit la tranche qu'il a demandée, pas un menu de tout. Ensuite, préférer le chemin small-model. Le même instinct qui a produit l'embedder multilingue 97M d'IBM Granite est l'instinct qui choisit un responder plus petit et spécialisé plutôt qu'un généraliste de frontière quand le budget de round-trip est serré. Troisièmement, garder le bundle du client honnête. La configuration remplace le code, de sorte qu'une organisation active un module avec un réglage, pas avec une nouvelle dépendance que le téléphone de chaque membre doit télécharger. Quatrièmement, dégrader avec grâce. Si la surface vocale ne passe pas, la surface texte passe. Si la carte ne peut pas tuiler, le geohash route encore.

Ce ne sont pas des fonctionnalités. Ce sont la contrainte inversée en une forme. Le mouvement de l'honest-architect est d'étiqueter ce qui est réel. Le moteur HAI, Social, Campaigns et la Whitelabel Network sont ✅ Production. Matchmaking, Marketplace et Calendar sont ⚠️ Partial — utiles aujourd'hui, non terminés. Wallet & Token, Super App et Community Credit sont 🔵 Roadmap, pre-revenue, soumis à la revue Howey, et non quelque chose que nous décrirons comme construit. L'inclusion ne peut pas emprunter de la maturité à des fonctionnalités qui ne sont pas encore live.

L'inclusion est une contrainte qui affûte l'ingénierie

Il y a une tentation de cadrer l'inclusion comme générosité — quelque chose que la plateforme fait pour les utilisateurs qui ont moins. Les preuves pointent dans l'autre direction. L'essai de Dharma-AI note que « les systèmes qui atteignent les résultats les plus significatifs dans un domaine donné tendent à être ceux qui y sont le plus étroitement focalisés » (Dharma-AI, Hugging Face, 2026). La contrainte qui vous oblige à servir une connexion lente est la même que celle qui vous oblige à perdre du poids, à choisir la bonne modalité, à router vers la bonne salle et à publier en sept langues plutôt qu'une.

C'est pourquoi nous publions cet article en sept locales, sur un moteur qui tourne depuis 2016, avec chaque capacité étiquetée à son état réel. L'inclusion par conception n'est pas une position que nous prenons. C'est une contrainte que nous gardons.

Foire aux questions

Qu'est-ce que « inclusion par conception » signifie concrètement chez Everythink ?

Cela signifie que l'inclusion est une contrainte architecturale, pas une ligne marketing. Le moteur HAI tourne en production depuis 2016, route sur une topologie network → community → room, et publie ce blog en sept locales (en/es/pt/zh/ja/de/fr) — ✅ Production. Une propriété n'est garantie que lorsque son mécanisme est construit et mesurant (Theorem 3, notre série de 21 papers).

Le blog multilingue est-il vraiment live dans les sept langues ?

La route anglaise est sans préfixe (/blog) ; les six autres sont préfixées (/es/blog, et ainsi de suite), avec des alternates hreflang et des slugs par locale générés statiquement. ✅ Production. Certains articles sont encore en cours d'écriture ; le harness, le routage et la couche SEO sont live. Nous ne promouvons pas un item Partial ou Roadmap à Production.

Comment la conception pour faible connectivité affecte-t-elle quelqu'un sur une connexion rapide ?

Ça ne lui fait pas de mal — ça retire du poids qu'il payait déjà. Router vers la bonne salle avant de répondre signifie un payload plus petit. Choisir un petit modèle spécialisé plutôt qu'un généraliste de frontière signifie un round-trip plus rapide. En 2026, l'embedder multilingue 97M d'IBM Granite a battu tous les modèles ouverts sous 100M sur MTEB Multilingual Retrieval (IBM Granite, Hugging Face, 2026). Plus petit, quand il s'ajuste, est simplement meilleur.

Pourquoi multimodal ? Le texte ne suffit-il pas ?

Le texte suffit pour les personnes qui tapent couramment dans la langue du système, sur un appareil qui la rend. En 2026, le benchmark Real World VoiceEQ de Hume AI, construit à partir de plus d'un million de notations humaines, a trouvé que « les modèles de voix sont devenus meilleurs pour parler que pour écouter réellement » et peinent encore « avec la parole accentuée, les locuteurs superposés, l'émotion, le bruit de fond » (Hume AI, Hugging Face, 2026). La parole et l'image portent un contexte que le texte laisse tomber, et atteignent des utilisateurs que le texte exclut.

La couche wallet, token ou community-credit en fait-elle partie ?

Non. Wallet & Token, Super App et Community Credit sont 🔵 Roadmap, pre-revenue et soumis à l'analyse Howey. Ils ne sont pas live et ne sont pas décrits comme des fonctionnalités d'inclusion. L'inclusion par conception désigne le moteur, la topologie et les surfaces multilingue et multimodale qui sont ✅ Production ou ⚠️ Partial aujourd'hui. Rien ici n'est un conseil financier, d'investissement ou juridique.

Conclusion

L'inclusion par conception est la discipline de refuser le médian de la ligne rapide comme centre de conception. Elle se manifeste comme une topologie qui route avant de rendre, un chemin small-model qui s'ajuste à un round-trip lent, un harness multilingue qui publie en sept locales depuis un manifeste, et une surface multimodale qui écoute le oui hésitant. Chacun de ces éléments est un mécanisme, et chacun porte son état de maturité réel — ✅ Production, ⚠️ Partial ou 🔵 Roadmap. Cet étiquetage est l'engagement d'honnêteté : une propriété est garantie exactement quand son mécanisme est implémenté et mesurant.

Si vous voulez voir la plateforme — et l'honnêteté — par vous-même, réservez une démo ou lisez les 21 academic papers derrière le moteur.

Sources

Construisez votre monde sur un moteur qui prouve ce qu'il affirme.

Créez votre propre réseau sur le moteur qui tourne depuis 2016 — ou parlez à l'équipe derrière les 21 articles.