Définir les CNV et « régions complexes » : pourquoi ces zones sont-elles problématiques ?
Un variant de nombre de copies (CNV, Copy Number Variant) est une variation structurelle génétique responsable d’un gain ou d’une perte de segment(s) d’ADN, le plus souvent supérieur à 1kb, pouvant toucher un ou plusieurs gènes. Les CNV sont estimés responsables de 10 à 15% de la variabilité génétique interindividuelle (Redon et al, Nature, 2006).
Les régions complexes du génome (par exemple : loci riches en séquences répétées, régions segmentaires dupliquées, sites de recombinaison fréquente) présentent plusieurs caractéristiques :
- Forte densité de séquences repetitives (LINEs, SINEs, satellites…)
- Homologies entre différentes régions du génome (paralogues, duplications récentes)
- Présence de pseudogènes gêneurs
- Zones pauvres en points d’ancrage pour l’analyse par hybridation ou séquençage
- Affectant parfois des gènes cliniquement essentiels (PMP22, SMN1-2, locus 22q11.2…)
L’obstacle majeur : le risque d’erreur d’interprétation et la non-détection d’événements pathogènes est nettement accru, alors que les enjeux cliniques peuvent être majeurs (diagnostic du syndrome de DiGeorge, amyotrophie spinale infantile, neuropathies périphériques, etc).
Panorama des technologies de détection des CNV : atouts et limites face à la complexité
Choisir la bonne méthode revient à sélectionner l’outil adapté au type de « terrain » : cherche-t-on une pièce manquante dans un puzzle uniforme ou dans une mosaïque déjà fragmentée ? Les principales technologies utilisées sont :
- Caryotype haute-résolution : encore pertinent pour certaines anomalies majeures, mais résolutivité insuffisante pour les petits CNV (detection : ≥ 5-10 Mb).
- CGH-array (puces à ADN) : résolution descendant à 50-100 kb, mais performance dépendante de la densité des sondes, qui demeure faible dans les régions très répétées ou segmentaires (Riggs et al, Genet Med, 2020).
- MLPA (Multiplex Ligation-dependent Probe Amplification) : outil ciblé, très robuste pour le dénombrement d’exons/clusters spécifiques (SMN1/2, PMP22…), mais dépend du design des sondes et peut être piégé par des variants de séquence sous-jacents.
- Séquençage à haut débit (NGS) : panels ciblés, exome ou génome complet. La détection des CNV repose sur la couverture de lecture, la discordance d’appariement (split-reads) ou les lectures appariées. Limites importantes : biais de GC, qualité du mapping, complexité locale du génome.
- Séquençage long reads (Nanopore, PacBio) : promesse de lever bon nombre des blocages actuels, mais accessibilité clinique encore limitée et coûts élevés.
Tableau synthétique : Atouts et restrictions des techniques selon la complexité locale
| Technique |
Résolution |
Régions complexes |
Utilité clinique |
| CGH-array |
50-100 kb |
Sensibilité réduite |
Premier niveau, grandes variations |
| MLPA |
1 exon ou plus |
Dépendance au design des sondes |
Excellent en ciblé (SMN1/2, DMD) |
| NGS-Panel/Exome |
1-2 kb (selon couverture) |
Problèmes de mapping récurrents |
Ajout en diagnostic moléculaire |
| NGS-Lectures longues |
<1 kb |
Performance supérieure |
En cours d'intégration clinique |
Stratégie pratique : comment aborder une région complexe suspected de CNV ?
L’approche pragmatique repose sur une succession d’étapes, analysant pour chaque outil les forces et pièges potentiels. Une checklist s’impose :
- Bien délimiter le besoin clinique :
- Phénotypage précis (type de syndrome, suspicion génétique ciblée)
- Identification des gènes/régions candidats
- Analyse in silico préalable :
- Consultation de bases de données globales des CNV (DGV, ClinGen, DECIPHER)
- Repérage des pièges connus (pseudogènes, duplications, gaps)
- Étude des cartes de coverage/failles des panels/exomes utilisés dans le laboratoire
- Choix de la technologie initiale (et anticipez ses limites):
- Si région très répétée/duplicée : préférez une approche ciblée (MLPA sur locus, qPCR spécifique si possible).
- Si investigation exploratoire : CGH-array ou NGS, en tenant compte des faux négatifs potentiels sur la région d’intérêt.
- Vérification croisée :
- Tout CNV suspect dans une région à risque doit être confirmé par une autre méthode (ex : MLPA derrière un NGS, ou RT-qPCR derrière un CGH-arr).
- Attention à la compatibilité entre sondes et séquences régionales (risque de non-hybridation ou de cross-hybridation…)
- Intégration des données cliniques et familiales :
- Fréquence du CNV dans la population générale ? Présence chez des apparentés ?
- Pénétrance connue de la lésion détectée ? Expressivité variable ?
Illustration adaptée : le cas de la région SMN1/SMN2 dans l’amyotrophie spinale
La détection des CNV sur le locus SMN1/SMN2 (5q13) dans l’amyotrophie spinale infantile est un parfait exemple de région complexe : deux loci quasi identiques en séquence mais à implication pathologique distincte.
- Le CGH-array a une résolution inconstante, moins fiable sur ce locus.
- La MLPA est devenu le gold standard (Verhaart IE et al, Eur J Hum Genet, 2017) pour dénombrer précisément le nombre de copies de SMN1 et SMN2.
- Le séquençage NGS peut être perturbé par les alignements ambigus sur ces exons très similaires, générant des faux positifs/négatifs si seul un pipeline CNV « standard » est utilisé.
Ce schéma illustre la démarche par excellence : connaître la nature complexe du locus conditionne la sélection de l’outil et l’interprétation du résultat. Une démarche similaire s’applique aux syndromes microdélétionnels (22q11.2, 17p11.2…) où le risque de détection incomplète est documenté : selon une étude récente (Coe et al, Nat Genet 2014), jusqu’à 10% des microdélétions pathogènes connues dans les régions complexes peuvent échapper à une CGH-array standard.
Qualité analytique et interprétation : comment minimiser les faux positifs et faux négatifs ?
Toute détection de CNV en région complexe appelle à rester vigilant sur quelques points cardinaux :
- Faux positifs : souvent générés par des erreurs d’alignement sur séquences répétées, artefacts d’hybridation (CGH, MLPA), ou fluctuations locales de la couverture séquencée.
- Faux négatifs : zones non couvertes par les sondes (CGH, MLPA), mapping défaillant (NGS), effet de mosaïque à faible taux (low-level mosaicism).
Clés pratiques pour la validation :
- S’assurer de la concordance entre phénotype et CNV identifié.
- Recourir à une méthode alternative (de préférence orthogonale dans son principe) pour la confirmation.
- Utiliser les outils de visualisation et d’annotation (IGV, UCSC Genome Browser, DECIPHER) pour localiser précisément le break-point du CNV.
- Documenter systématiquement toute zone non testée ou non interprétable dans le compte rendu, avec explication pour le clinicien référent et/ou le patient.
Vers l’avenir : innovations, limites persistantes et perspectives en clinique
L’avènement du séquençage long read (PacBio HiFi, Oxford Nanopore) représente une avancée prometteuse, en particulier dans le décodage des régions segmentaires complexes : plusieurs publications récentes démontrent la capacité à résoudre des CNV sur des loci auparavant inaccessibles (Chaisson et al, Nature 2019). Toutefois, l’intégration de ces technologies à la pratique clinique de routine reste freinée par les contraintes de coût, d’accès et de standardisation analytique.
Dans l’intervalle, la médecine génomique doit composer avec ses zones d’ombre, en gardant à l’esprit : là où le génome se fait le plus illisible, l’exigence de dialogue interdisciplinaire (biologiste, clinicien, généticien) est essentielle pour éviter les diagnostics erronés et garantir une prise en charge éthique. La prudence et la transparence quant aux limites du test restent une obligation morale aussi bien que scientifique.
Points-clés et ressources à retenir pour les professionnels
- Avant tout, analyser le contexte clinique et technique du locus ciblé : pas de solution universelle, chaque cas requiert adaptation et anticipation des biais méthodologiques.
- Méthodes complémentaires (MLPA, CGH-array, NGS, long reads) : combiner, comparer, confronter.
- Limiter les interprétations sur zones complexes sans validation orthogonale.
- Se référer régulièrement aux bases de données internationales et aux recommandations nationales de bonnes pratiques (HAS, ACMG, ESHG…)
Pour approfondir, quelques liens à explorer :
- American College of Medical Genetics (ACMG) : recommandations sur la détection des CNV
- DECIPHER Database : interprétation clinique des CNV
- Redon R, et al. Global variation in copy number in the human genome. Nature, 2006.
- Chaisson MJ, et al. Multi-platform discovery of haplotype-resolved structural variation in human genomes. Nature, 2019.
- Coe BP, et al. Refining analyses of copy number variation identifies specific genes associated with developmental delay. Nat Genet, 2014.
Finalement, détecter un CNV dans une région complexe du génome requiert à la fois outil technique, culture du doute et sens clinique aigu. Notre « séminaire virtuel » n’a pas vocation à proposer une recette universelle, mais à fournir le cadre pour affuter notre analyse et, surtout, orienter le dialogue autour d’un patient – première raison d’être de la génétique médicale.