Plutôt que d’importer un fichier, vous pouvez coller un lien et laisser Hushscript récupérer l’enregistrement pour vous. Cette page explique ce que fait notre récupérateur, afin que quiconque le voie dans ses journaux serveur sache exactement qui fait la demande et pourquoi.
Notre récupérateur s’identifie
Chaque requête que nous effectuons en votre nom porte ce User-Agent :
HushscriptFetcher/1.0 (+https://hushscript.com/url-import)
Nous ne déguisons jamais le récupérateur en navigateur et nous ne contournons jamais un site qui nous refuse l’accès.
Chaque requête est signée
Chaque requête porte aussi une signature Ed25519 sur sa propre cible, selon le schéma Web Bot Auth fondé sur RFC 9421 (HTTP Message Signatures). Vous pouvez ainsi vérifier qu’une requête vient réellement de nous, et non de quelqu’un qui emprunterait notre nom dans un User-Agent. La signature pointe vers notre répertoire de clés :
Signature-Agent: "https://hushscript.com"
Les clés publiques sont publiées, et signées avec la même clé, à l’adresse
/.well-known/http-message-signatures-directory.
Ce document indique aussi, sous une forme lisible par une machine, tout ce que
cette page dit en prose : qui nous sommes, comment nous contacter, et quelles
directives robots.txt nous respectons.
Ce que nous demandons
- HTTPS uniquement. Nous ne suivons pas les liens
http://en clair. - Un
GETpar plage lorsque c’est possible. Pour un aperçu, nous demandons seulement les premiers mégaoctets puis nous nous arrêtons. Si votre serveur ne gère pas les requêtes par plage, nous faisons une requête ordinaire et cessons de lire dès que nous en avons assez. - Audio uniquement. Enregistrements jusqu’à 10 heures. Les liens vidéo sont refusés – téléchargez la vidéo et importez-la dans l’application, où l’audio est extrait sur votre propre appareil.
- Quelques requêtes par import. Nous envoyons une petite requête de sondage pour vérifier le fichier, puis nous le récupérons. Nous n’explorons pas votre site, nous ne l’indexons pas, et nous ne revenons jamais sur une URL de notre propre initiative. Une exception : un lien de partage Google Drive renvoie parfois une page de confirmation au lieu du fichier, et nous suivons le lien de téléchargement de cette page.
- Un rythme modéré. Nous visons à rester sous une requête par seconde vers un même site, et jamais plus de dix.
Quels liens fonctionnent
- Les liens directs vers un fichier audio.
- Les liens de partage Dropbox, Google Drive et OneDrive, à condition que le partage soit réglé sur « toute personne disposant du lien ». Nous les réécrivons pour vous sous leur forme de téléchargement direct.
- Les liens protégés par une connexion, un paywall ou un défi anti-robot ne peuvent pas fonctionner : le serveur nous renvoie une page web au lieu d’un enregistrement, et nous signalons le lien comme inaccessible plutôt que de nous faire passer pour quelqu’un d’autre.
Ce que nous respectons dans robots.txt
Notre jeton de produit RFC 9309 est HushscriptFetcher.
- Les règles qui nous visent sont respectées intégralement. Un groupe
nommant
HushscriptFetcher— ou simplementHushscript— s’applique exactement tel qu’écrit :Disallownous arrête,Allowrouvre un chemin. Crawl-delayest respecté depuis n’importe quel groupe, y comprisUser-agent: *. Un délai coûte à un visiteur un import plus lent et ne vous coûte rien, nous prenons donc le mot du groupe générique pour argent comptant. Si l’attente dépasse ce qu’un seul import peut supporter, nous nous arrêtons et expliquons pourquoi au visiteur.- Les règles
Disallowgénériques ne sont pas appliquées. Le récupérateur n’est pas un robot d’indexation : il lit un seul fichier, une seule fois, parce qu’une personne connectée le lui a demandé. Les règles générales des grands hébergeurs de partage de fichiers existent pour tenir les index de recherche à l’écart des liens de partage, et les respecter casserait les liens mêmes que les gens collent. Si vous voulez que nous disparaissions, nommez-nous — cela tient en une ligne, ci-dessous. - Si votre
robots.txtest totalement inaccessible, nous poursuivons. Nous préférons ne pas faire échouer l’import de quelqu’un parce qu’un serveur a eu un mauvais moment.
Si vous hébergez des fichiers et voyez notre récupérateur
Notre récupérateur n’arrive que parce qu’un de vos visiteurs a collé un lien vers votre fichier dans Hushscript. Il lit ce seul fichier et rien d’autre.
Pour l’arrêter, nommez-nous dans robots.txt :
User-agent: HushscriptFetcher
Disallow: /
Bloquer le User-Agent à la périphérie de votre réseau fonctionne aussi. Dans les deux cas, votre visiteur reçoit un message clair l’invitant à télécharger le fichier et à l’importer lui-même, plutôt qu’un lien cassé.
Des questions ou un signalement d’abus : support@hushscript.com.