# Recherche sémantique contre recherche par mot-clé : pourquoi cela compte pour les appels d'offres

> Les alertes d'appels d'offres par mot-clé manquent les contrats que vous devriez remporter. Découvrez comment la recherche sémantique et les embeddings apparient les appels d'offres par le sens, et non par les mots exacts, pour que les PME manquent moins d'affaires.

Source: https://trinta.ai/fr/blog/semantic-search-vs-keyword-search-tenders · Published: 2026-07-25 · Category: AI & Technology · 7 min read
Keywords: semantic search tenders, keyword search tenders, tender matching AI, embeddings procurement, tender alerts, find public tenders

Une entreprise de gaz médicaux configure des alertes d'appels d'offres sur TED, le portail Tenders Electronic Daily de l'UE. Elle utilise les mots-clés évidents : « gaz médical », « centrale d'oxygène », « générateur PSA ». Pendant six mois, les alertes sont silencieuses, alors elle suppose que le marché l'est aussi. Puis un concurrent remporte un contrat hospitalier valant plusieurs centaines de milliers d'euros. L'acheteur l'avait publié sous l'intitulé « système de canalisation centrale pour thérapie respiratoire ». Trois mots que l'entreprise n'aurait jamais songé à surveiller, et le filtre par mot-clé l'a laissé passer tout droit.

Ce n'est pas un échec rare. C'est la faiblesse déterminante de la façon dont la plupart des alertes d'appels d'offres fonctionnent encore. Et c'est la raison la plus claire pour laquelle la **recherche sémantique** surpasse la **recherche par mot-clé** pour quiconque prend au sérieux la conquête de marchés publics.

## Comment la recherche par mot-clé échoue réellement

Le rapprochement par mot-clé est littéral. Il cherche les chaînes exactes que vous avez tapées, ou leurs racines proches, dans le titre et la description d'un appel d'offres. Si l'acheteur a employé un autre mot, vous n'obtenez rien. Les marchés publics sont le pire environnement possible pour cela, pour trois raisons :

- **Les acheteurs décrivent la même chose de dizaines de façons.** « Centrale d'oxygène » peut apparaître comme « unité de production d'oxygène », « système PSA », « skid de production de gaz » ou « source d'alimentation centrale en air médical ». Un hôpital à Lisbonne, une clinique à Nairobi et un ministère à Riyad l'exprimeront chacun différemment.
- **La langue et la traduction dérivent.** TED publie en 24 langues, le PNCP brésilien en portugais, la plupart des portails du Golfe en arabe et en anglais côte à côte. Un mot-clé qui fonctionne dans une langue renvoie le silence dans une autre, même après qu'une traduction automatique ait massacré le terme technique.
- **Les codes CPV et de classification sont appliqués de façon incohérente.** Le Common Procurement Vocabulary de l'UE est censé normaliser cela, mais les acheteurs choisissent régulièrement un code assez proche plutôt qu'exact. Filtrer sur un seul code CPV élimine de vraies opportunités ; filtrer sur un code parent large vous noie dans le bruit.

Vous êtes donc face à un arbitrage brutal. Des mots-clés étroits produisent des **faux négatifs** : de vrais appels d'offres que vous ne voyez jamais. Des mots-clés larges produisent des **faux positifs** : un déluge quotidien d'avis non pertinents que vous cessez de lire au bout d'une semaine. Dans les deux cas, vous manquez des affaires.

## Ce que la recherche sémantique fait différemment

La recherche sémantique apparie sur le **sens, pas l'orthographe**. Au lieu de demander « cet appel d'offres contient-il mes mots exacts », elle demande « cet appel d'offres porte-t-il sur la même chose qui m'intéresse ».

Le mécanisme, ce sont les **embeddings**. Un modèle d'IA lit un texte, votre profil d'entreprise ou un avis de marché, et le convertit en une longue liste de nombres (un vecteur) qui représente ce dont le texte parle réellement. Des textes de sens proche finissent proches les uns des autres dans cet espace mathématique, même lorsqu'ils ne partagent aucun mot.

En pratique, cela signifie qu'un profil décrivant « systèmes d'approvisionnement en oxygène médical pour hôpitaux » atterrit juste à côté d'un appel d'offres intitulé « système de canalisation centrale pour thérapie respiratoire », parce que le modèle comprend que les deux formulations désignent la même chose du monde réel. Aucun mot-clé partagé requis. Le même modèle sait aussi qu'un « contrat de fournisseur Apple » dans un appel d'offres de fourniture de fruits ne parle pas d'ordinateurs, ce qu'un filtre par mot-clé sur « Apple » ne pourra jamais deviner.

Le résultat est un appariement qui survit :

- **Aux synonymes et au jargon :** « générateur PSA », « unité d'adsorption modulée en pression » et « production d'oxygène sur site » correspondent tous au même profil.
- **À la traduction et aux sources multilingues :** le sens est préservé d'une langue à l'autre parce que le vecteur représente le concept, pas la chaîne littérale.
- **Aux codes de classification vagues ou erronés :** le modèle lit la description elle-même, donc un code CPV mal étiqueté ne vous cache plus l'appel d'offres.

## Un avant-après concret

Prenez une entreprise de génie civil de taille moyenne qui construit des infrastructures de traitement de l'eau. Avec des alertes par mot-clé sur « station de traitement des eaux » à travers TED, les avis de marché de la Banque mondiale et quelques portails nationaux, elle attrape les appels d'offres évidents et manque une longue traîne :

- « Modernisation du réseau d'eaux usées » dans un avis eTenders sud-africain
- « Estação de tratamento de águas residuais » publié sur le portail BASE du Portugal
- « Travaux de gestion des effluents » dans un projet de la Banque mondiale en Afrique de l'Est
- « Reabilitação de ETAR » dans le PNCP brésilien

Aucun de ceux-ci ne contient l'expression « station de traitement des eaux ». Un système par mot-clé n'en montre aucun à l'entreprise. Un système sémantique les note tous les quatre comme de fortes correspondances, parce que chacun décrit un travail que fait l'entreprise, dans un langage qu'elle n'avait simplement pas prévu. Sur une année, cet écart fait la différence entre un pipeline sain et un pipeline maigre.

## Sémantique ne veut pas dire que les mots-clés sont inutiles

La réponse honnête est que les meilleurs systèmes combinent les deux, une approche souvent appelée **recherche hybride**. Les mots-clés comptent encore quand vous avez besoin de précision sur une contrainte dure : un nom d'acheteur précis, un numéro d'enregistrement, une norme obligatoire comme ISO 13485 ou le marquage CE, un pays où vous êtes autorisé à opérer. Ce sont des faits, pas des concepts, et l'appariement exact est le bon outil pour les faits.

Là où la recherche sémantique gagne, c'est sur la question floue et à forte valeur de la pertinence : parmi les 3 000 avis publiés sur TED aujourd'hui, plus des milliers d'autres à travers l'Afrique, l'Amérique latine, le Moyen-Orient et les banques multilatérales, laquelle de cette poignée porte réellement sur ce que fait mon entreprise. Utilisez les embeddings pour classer par le sens, puis les filtres par mot-clé pour imposer les non-négociables. Vous obtenez à la fois le **rappel** (vous cessez de manquer des appels d'offres) et la **précision** (vous cessez de vous noyer dans le bruit).

Quelques signes pratiques que vous avez dépassé les alertes par mot-clé :

- Vous ne trouvez que les appels d'offres qui utilisent votre vocabulaire interne exact.
- Soit vous ne recevez presque rien, soit vous recevez des centaines de courriels non pertinents.
- Vous entendez sans cesse parler de contrats après leur clôture, par des gens qui les ont vus décrits différemment.
- Vous opérez dans plus d'une langue ou d'un pays.

## Ce que cela signifie pour votre surveillance

Les portails ne vont pas normaliser leur formulation, et les acheteurs ne vont pas se mettre à utiliser votre vocabulaire. La fragmentation est permanente. La seule chose que vous contrôlez, c'est la façon dont vous la lisez de bout en bout.

C'est exactement le problème pour lequel un flux d'appels d'offres fondé sur le sens est conçu. Au lieu que vous deviniez des mots-clés, la plateforme apprend ce que fait votre entreprise à partir de votre profil, encode chaque nouvel avis de centaines de sources dès sa publication, et note chacun d'eux par le sens au regard de vous. Ce qui atterrit dans votre boîte de réception est une courte liste quotidienne classée des appels d'offres qui correspondent vraiment, y compris ceux décrits avec des mots que vous n'auriez jamais cherchés. Moins de recherche, moins d'oublis, et beaucoup moins de risque que le prochain « système de canalisation centrale pour thérapie respiratoire » aille à quelqu'un d'autre.

## Frequently asked questions

**What is the difference between semantic and keyword search for tenders?**

Keyword search matches literal strings, so it finds notices containing the exact words you predicted and misses those describing the same requirement differently. Semantic search compares meaning using embeddings, so a notice specifying your product in unfamiliar terminology still matches. The practical difference shows up most on technical specifications written without product names.

**Does semantic search make keywords useless?**

No. Keywords remain useful as hard filters where precision matters: a specific standard, a named platform, a CPV code, a buyer's name. The effective combination is semantic matching to decide relevance and keywords to constrain or verify it, rather than choosing one approach and accepting the other's blind spots.

**How much do keyword alerts actually miss?**

It depends on how consistently your market describes what you sell, and the more technical the category, the worse keyword coverage gets. The pattern to watch for is a tender you lost or never saw that used none of your terms while describing exactly your product, since that indicates systematic rather than occasional loss.

---

All guides: https://trinta.ai/blog · Site index for agents: https://trinta.ai/llms.txt
