A cosa serve e come si usa questa regex?
Estrae il valore dei collegamenti `href` o `src` presenti nei tag HTML.
Espressione Regolare (Pattern)
Flag consigliati:
gi · Motori compatibili: JavaScript, PCRE/PHP, Python, Go, .NET
\b(?:href|src)=["']([^"']+)["']
Integrazione nel codice
Snippet pronti all'uso// JavaScript (ES6+)
const regex = /\b(?:href|src)=["']([^"']+)["']/gi;
const isValid = regex.test(text);
// Estrazione match
const matches = text.match(regex);
<?php
// PHP 8.2+ (PCRE)
$pattern = '~\b(?:href|src)=["']([^"']+)["']~gi';
$isValid = (bool) preg_match($pattern, $text);
// Estrazione con gruppi
if (preg_match($pattern, $text, $matches)) {
print_r($matches);
}
# Python 3 (re)
import re
pattern = r"\b(?:href|src)=[\"']([^\"']+)[\"']"
is_valid = bool(re.search(pattern, text))
# Estrazione match
match = re.search(pattern, text)
if match:
print(match.group(0))
// Go (regexp)
package main
import (
"fmt"
"regexp"
)
func main() {
re := regexp.MustCompile(`\b(?:href|src)=["']([^"']+)["']`)
isValid := re.MatchString(text)
fmt.Println(isValid)
}
// C# (.NET)
using System;
using System.Text.RegularExpressions;
bool isValid = Regex.IsMatch(text, @"\b(?:href|src)=[""']([^""']+)[""']");
Come funziona (Spiegazione dettagliata)
\b(?:href|src)=intercetta i nomi degli attributi preceduti da confine di parola.["']accetta sia virgolette doppie che singole.([^"']+)cattura nel Gruppo 1 l’URL o percorso della risorsa.
Casi d’uso consigliati
- Crawler e scraper di link interni di un sito
- Verifica di broken links
- Estrazione percorsi immagini e asset per preloading o CDN
Esempi che corrispondono (Validi)
3 test passati<a href="https://regex.oceweb.net/libreria">Libreria</a>
<img src="/assets/img/logo.png" alt="Logo">
<link href='style.css' rel='stylesheet'>
Esempi rifiutati (Non validi)
2 test respinti<p>Testo senza attributi</p>
<span>Solo testo e nessun link</span>
Limiti tecnici e avvertenze
- Non gestisce attributi HTML privi di virgolette (es.
href=index.html), sebbene sconsigliati dalle specifiche moderne.
Espressioni regolari correlate
Avanzato
Estrai tag HTML semplici con contenuto
Individua e cattura tag HTML generici e il relativo contenuto interno usando backreference.
Vedi scheda
Intermedio
Commenti di codice a riga singola e multiriga
Individua e intercetta sia i commenti su singola riga (`//...`) che i blocchi multiriga (`/*...*/`) tipici di JavaScript, C, PHP e CSS.
Vedi scheda
Intermedio
Stringhe tra virgolette con gestione escape
Cattura stringhe delimitate da doppi apici supportando correttamente i caratteri di escape come `\"` all’interno del testo.
Vedi scheda
Verifica empirica
Apri nel tester
Hai bisogno di collaudare questo pattern con i tuoi dati?
Apri il tester sandboxato con questa regex già caricata e verifica i gruppi di cattura.