« Pourquoi ce message n’est-il jamais arrivé ? » — c’est la question qui revient le plus souvent lorsqu’un agent rédige des relances automatiquement : le contenu peut être irréprochable, si le message finit en spam ou n’est jamais délivré, tout le travail de rédaction ne sert à rien. Ce constat a poussé une petite équipe technique à comparer trois services d’envoi transactionnel sur un même lot de messages générés par un agent.
Le test portait sur cinq cents relances de paiement rédigées par un modèle de langage à partir d’un même jeu de données fictif, envoyées en parallèle via Sendgrid, Postmark et Mailjet, avec un contenu strictement identique d’un service à l’autre pour isoler la variable de délivrabilité.
Le protocole de test, pour situer les chiffres
Les cinq cents adresses utilisées provenaient d’un domaine de test dédié à l’expérimentation, réparties en trois lots égaux, un par service. Chaque service disposait de sa propre configuration DNS (SPF, DKIM, DMARC) correctement mise en place au préalable, condition indispensable pour ne pas fausser la comparaison au profit ou au détriment d’un service en particulier.
Les résultats de délivrabilité observés
| Service | Délivrabilité mesurée | Temps moyen d’acheminement | Complexité de mise en place |
|---|---|---|---|
| Postmark | 97,2 % | 4 secondes | Faible, focalisé sur le transactionnel |
| Sendgrid | 94,8 % | 7 secondes | Moyenne, options nombreuses |
| Mailjet | 93,1 % | 9 secondes | Moyenne, interface orientée marketing |

Pourquoi Postmark est arrivé en tête sur ce test précis
Postmark sépare structurellement les flux transactionnels des flux marketing dans son infrastructure d’envoi, ce qui limite la contamination de réputation entre les deux usages. Sendgrid et Mailjet, plus généralistes, mélangent davantage ces flux par défaut, ce qui peut jouer défavorablement lorsque d’autres clients du même service envoient beaucoup de campagnes marketing depuis des adresses IP partagées.
Ce que le test ne permet pas de conclure
Un écart de quatre points de délivrabilité sur cinq cents messages reste un signal, pas une certitude statistique définitive. La réputation d’un domaine d’envoi évolue dans le temps, et un service moins performant sur ce test précis pourrait très bien se comporter différemment sur un volume plus important ou une durée plus longue.
- Le test a duré une semaine, une période trop courte pour juger de la stabilité à long terme.
- Aucun des trois services n’a présenté d’incident technique notable durant le test.
- Le contenu généré par l’agent, relu avant envoi, ne contenait aucun élément déclencheur connu de filtres anti-spam.
Le rôle du contenu rédigé par l’agent dans les résultats
Un point mérite d’être signalé : les messages générés par l’agent, une fois relus et validés, ne différaient pas structurellement d’un message rédigé par un humain. Aucun service n’a pénalisé le contenu en tant que tel — la variable déterminante restait bien l’infrastructure d’envoi, pas l’origine automatisée de la rédaction.
La délivrabilité se joue sur la réputation du domaine et de l’infrastructure d’envoi, bien avant de se jouer sur qui — ou quoi — a rédigé le message.
Ce qui a changé côté intégration technique
Le passage d’un service à l’autre demandait, dans les trois cas, une adaptation limitée du code d’envoi côté WordPress, la plupart des différences se logeant dans l’appel à l’API plutôt que dans la logique de génération du message par l’agent. Un exemple simplifié d’envoi via l’API de Postmark illustre cette légèreté d’intégration :
function envoyer_relance_postmark( string $destinataire, string $contenu ): bool {
$reponse = wp_remote_post(
'https://api.postmarkapp.com/email',
array(
'headers' => array(
'X-Postmark-Server-Token' => POSTMARK_TOKEN,
'Content-Type' => 'application/json',
),
'body' => wp_json_encode(
array(
'From' => 'relances@exemple.fr',
'To' => $destinataire,
'Subject' => 'Relance de paiement',
'TextBody' => $contenu,
)
),
)
);
return ! is_wp_error( $reponse );
}
Cette légèreté d’intégration confirme que le choix entre ces trois services ne repose pas sur une contrainte technique de développement, mais bien sur la question de la délivrabilité et de la réputation d’envoi, seule variable qui a véritablement départagé les trois candidats sur ce test.
Notre verdict
Sur ce test précis, Postmark s’est montré le plus fiable pour un usage strictement transactionnel comme des relances de paiement, grâce à une infrastructure dédiée qui limite les effets de réputation partagée. Sendgrid reste un choix raisonnable pour des équipes ayant déjà des besoins marketing en parallèle, à condition de séparer les flux. Mailjet, plus orienté marketing par défaut, demande une configuration plus attentive pour un usage transactionnel exigeant comme des relances automatisées par un agent.