Skip to content

Instantly share code, notes, and snippets.

@me-suzy
Created July 22, 2026 10:09
Show Gist options
  • Select an option

  • Save me-suzy/ac88ca7ca831b8e60c9b62f7579d4f88 to your computer and use it in GitHub Desktop.

Select an option

Save me-suzy/ac88ca7ca831b8e60c9b62f7579d4f88 to your computer and use it in GitHub Desktop.
regefdf.txt
<tr>
<td class="text_dreapta">On Septembrie 07, 2025, in <a href="https://neculaifantanaru.com/leadership-xs-analytics.html" title="Vezi toate articolele din Leadership XS-Analytics" class="external" rel="category tag">Leadership XS-Analytics</a>, by Neculai Fantanaru</td>
</tr>
vreau un regex notepad++ care sa gaseasca toate html ce contin data Septembrie din tagul respectiv
Pentru a identifica liniile HTML care conțin „on septembrie” în interiorul structurii tabelare specificate în Notepad++, se poate folosi expresia regulată <tr>\s*<td[^>]*>on septembrie.*?</td>\s*</tr> cu opțiunea „Regular expression” activată. Acest regex caută rândul tabelului (<tr>), celula (<td>) conținând textul, și se închide corect la finalul rândului, permițând selectarea și manipularea datelor.
nu e bine, regexul tau gaseste si dintr-un tag care contine alt link.
<tr>
<td class="text_dreapta">On Septembrie 22, 2014, in <a href="https://neculaifantanaru.com/leadership-de-baza.html" title="Vezi toate articolele din Leadership de bază" class="external" rel="category tag">Leadership de Bază</a>, by Neculai Fantanaru</td>
</tr>
Pentru a te asigura că regexul nu trece peste alte taguri și nu se extinde greșit de la un rând la altul, trebuie să folosești o clasă de caractere negată [^>]* în locul punctului (.*?). Acest lucru blochează căutarea în interiorul aceluiași tag HTML și garantează că textul „septembrie” se află direct în celula respectivă, înainte de deschiderea oricărui link <a>.
Folosește următorul regex în Notepad++:
<tr>\s*<td[^>]*>[^<]*septembrie.*?</td>\s*</tr>
## De ce funcționează corect:
* <tr>\s*<td[^>]*> — Găsește tagul de deschidere al rândului și al celulei, indiferent de atribute (cum ar fi class="text_dreapta").
* [^<]*septembrie — Partea critică: [^<]* îi permite să caute textul „septembrie” doar dacă acesta aparține direct celulei <td> și se află înainte de primul tag deschis (înainte de <a href...). Dacă vede un < înainte de cuvânt, regexul ratează acea linie și trece mai departe.
* .*?</td>\s*</tr> — Consumă restul liniei (inclusiv linkul <a>) până la închiderea corectă a celulei și rândului.
## Setări obligatorii în Notepad++:
1. Deschide fereastra de căutare (Ctrl + F sau Ctrl + H).
2. Bifează opțiunea Regular expression în stânga jos.
3. Dezbifează opțiunea . matches newline (altfel regexul se va întinde pe mai multe rânduri din fișier).
4. (Opțional) Dacă în codul tău luna este scrisă uneori cu majusculă („Septembrie”), dezbifează opțiunea Match case.
Dacă vrei să modifici ceva anume în aceste linii sau ai nevoie de grupuri de captură pentru înlocuire, spune-mi ce vrei să faci cu ele după ce le găsești.
tot nu e bine. Mai, tu trebuie sa identifici cuvantyul septembrie, dar din acest fel de taguri:
<tr> <td class="text_dreapta">on septembrie 07, 2025, in <a href="https://neculaifantanaru.com/leadership-xs-analytics.html" title="vezi toate articolele din leadership xs-analytics" class="external" rel="category tag">leadership xs-analytics</a>, by neculai fantanaru</td> </tr>
deci trebuie sa iei in considerare astea:
<a href="https://neculaifantanaru.com/leadership-xs-analytics.html" title="vezi toate articolele din leadership xs-analytics" class="external" rel="category tag">
Am înțeles perfect acum. Problema era că doreai un regex care să fie foarte specific și să valideze inclusiv structura fixă a acelui link spre categoria leadership-xs-analytics.
Pentru a potrivi exact acel model de rând, folosește această expresie regulată:
<tr>\s*<td class="text_dreapta">on septembrie.*?<a href="https://neculaifantanaru\.com/leadership-xs-analytics\.html".*?>leadership xs-analytics</a>.*?</td>\s*</tr>
## Cum funcționează această expresie:
* <tr>\s*<td class="text_dreapta">on septembrie - Pornește exact de la deschiderea rândului și verifică clasa celulei, urmată de textul exact on septembrie.
* .*? - Sare peste data calendaristică (de ex: 07, 2025, in ) până ajunge la link.
* <a href="https://neculaifantanaru\.com/leadership-xs-analytics\.html" - Verifică adresa exactă a URL-ului (punctele din link sunt scrise ca \. pentru a fi tratate ca text, nu ca caractere speciale).
* .*?> - Sare peste restul atributelor din interiorul tagului <a> (cum ar fi title="...", class="...", etc.) până la închiderea tagului de deschidere.
* leadership xs-analytics</a> - Se asigură că textul ancoră afișat este cel corect și că tagul de link se închide.
* .*?</td>\s*</tr> - Consumă restul textului (ex: , by neculai fantanaru) și validează închiderea celulei și a rândului.
## Setări în Notepad++:
1. Apasă Ctrl + F (Căutare) sau Ctrl + H (Înlocuire).
2. La Search Mode, bifează Regular expression.
3. Dezbifează căsuța . matches newline pentru ca Notepad++ să caute doar în interiorul aceleiași linii.
4. Dacă în textul tău codul are litere mari (ex: On Septembrie sau Leadership), dezbifează căsuța Match case (Ignorare majuscule).
Spune-mi dacă vrei să folosești această căutare pentru a șterge liniile respective, sau dacă vrei să înlocuiești ceva specific din interiorul lor (cum ar fi data sau link-ul)!
PERFECT
Sign up for free to join this conversation on GitHub. Already have an account? Sign in to comment