- 🛡️ Advanced Anti-Detection - Modern fingerprinting evasion and stealth techniques
- 🔍 GraphQL Interception - Captures comprehensive ad data directly from API calls
- 🎭 Human Behavior Simulation - Realistic mouse movements, scrolling, and delays
- 🌐 Proxy Support - Built-in Apify proxy integration with residential IPs
- 📊 Comprehensive Data - Ad creatives, targeting, performance metrics, and more
- ✅ Bypass avanzato dei sistemi anti-bot di Facebook
- ✅ Intercettazione richieste GraphQL interne
- ✅ Simulazione comportamento umano realistico
- ✅ Supporto per tutti i tipi di ads (non solo politici)
- ✅ Rotazione User-Agent e fingerprint evasion
- ✅ Metodo HAR per estrazione legale al 100%
# Clona o scarica i file del progetto
cd V2Scraping
# Esegui setup automatico
python setup.py# Installa dipendenze Python
pip install -r requirements.txt
# Installa browser Playwright
playwright install chromium- Import this Actor to your Apify account
- Configure input parameters (see Input Configuration below)
- Run the Actor and monitor progress
- Download results from the dataset
# 1. Install dependencies
npm install
# 2. Set up environment
cp .env.example .env
# Edit .env with your configuration
# 3. Run locally
npm startThe Actor saves comprehensive ad data to the Apify dataset with the following structure:
{
"adId": "123456789",
"pageId": "987654321",
"pageName": "Brand Name",
"adContent": "Ad text content...",
"startDate": "2025-01-01",
"endDate": "2025-01-31",
"spend": "1000-5000",
"impressions": "10K-50K",
"reach": "8K-40K",
"demographics": {...},
"platforms": ["Facebook", "Instagram"],
"adCreative": {
"images": [...],
"videos": [...],
"link_url": "..."
},
"targetingInfo": {...},
"currency": "EUR",
"isActive": true,
"scrapedAt": "2025-01-15T10:30:00Z",
"source": "graphql_interception"
}| Campo | Descrizione |
|---|---|
timestamp |
Data/ora estrazione |
ad_id |
ID univoco dell'ad |
page_name |
Nome della pagina |
page_id |
ID della pagina |
ad_text |
Testo dell'annuncio |
image_url |
URL immagine |
video_url |
URL video |
cta_text |
Testo call-to-action |
start_date |
Data inizio campagna |
end_date |
Data fine campagna |
impressions |
Numero impressioni |
spend |
Spesa pubblicitaria |
demographics |
Dati demografici |
platforms |
Piattaforme di pubblicazione |
Copia config.env.example in .env e modifica:
# Impostazioni generali
HEADLESS=false
MAX_RESULTS=100
DELAY_MIN=1
DELAY_MAX=3
# Proxy (opzionale)
USE_PROXY=false
PROXY_LIST=proxy1:port,proxy2:port
# Anti-detection
SIMULATE_HUMAN=true
RANDOM_DELAYS=true
MOUSE_MOVEMENTS=true
# Output
OUTPUT_FORMAT=csv,json
OUTPUT_DIR=./results# Esempio di utilizzo programmatico
from facebook_ad_library_scraper_2025 import FacebookAdLibraryScraper
async def custom_scraping():
scraper = FacebookAdLibraryScraper(
headless=True,
use_proxy=False
)
await scraper.search_ads(
search_term="your_brand",
max_results=200
)
scraper.save_results("custom_output")- Playwright Stealth - Evasione fingerprinting avanzata
- User-Agent Rotation - Rotazione automatica browser
- Viewport Randomization - Dimensioni schermo casuali
- Human Behavior Simulation - Movimenti mouse e scroll realistici
- Request Timing - Delay casuali tra richieste
- GraphQL Interception - Cattura dati API interne
- 100% Legale - Usa traffico web registrato manualmente
- Zero Detection - Nessun rischio di ban
- Accesso Completo - Tutti i tipi di ads disponibili
- Dati Strutturati - JSON dalle API interne Facebook
| Caratteristica | Scraper Automatico | Estrattore HAR |
|---|---|---|
| Legalità | ✅ 100% Legale | |
| Velocità | 🚀 Veloce | 🐌 Manuale |
| Rilevamento | ✅ Zero rischio | |
| Scalabilità | ✅ Alta | |
| Facilità | ✅ Automatico | |
| Dati | ✅ Buona qualità | ✅ Qualità massima |
| Manutenzione | ✅ Stabile |
# Analizza ads dei competitor
python facebook_ad_library_scraper_2025.py
# Cerca: "competitor_name"# Estrai ads per categoria
python facebook_ad_library_scraper_2025.py
# Cerca: "fitness", "fashion", "tech"# Monitora menzioni del tuo brand
python facebook_ad_library_scraper_2025.py
# Cerca: "your_brand_name"# Trova ispirazione per creatività
# Usa metodo HAR per sessioni lunghe
python facebook_har_extractor_2025.py session.har1. Scraper non trova ads:
# Prova modalità non-headless per debug
python facebook_ad_library_scraper_2025.py
# Seleziona: headless = n2. Errori di installazione:
# Reinstalla dipendenze
pip uninstall playwright playwright-stealth
pip install -r requirements.txt
playwright install chromium3. File HAR vuoto:
- Assicurati di aver attivato "Preserve log" in DevTools
- Naviga attivamente nell'Ad Library durante la registrazione
- Registra per almeno 5-10 minuti
4. Rilevamento anti-bot:
- Usa il metodo HAR invece dello scraper automatico
- Riduci la velocità di scraping
- Usa proxy diversi
# Abilita logging dettagliato
export LOG_LEVEL=DEBUG
python facebook_ad_library_scraper_2025.py- Rispetta i Terms of Service di Facebook
- Non abusare del servizio (limita le richieste)
- Usa responsabilmente i dati estratti
- Considera l'API ufficiale quando possibile
- Il metodo HAR è raccomandato per uso commerciale
- ✅ Tecniche anti-detection aggiornate
- ✅ Supporto GraphQL intercettazione
- ✅ Metodo HAR integrato
- ✅ Simulazione comportamento umano
- ✅ Setup automatico
- 🔄 Supporto API ufficiale Facebook
- 🔄 Dashboard web per visualizzazione dati
- 🔄 Integrazione database
- 🔄 Analisi sentiment automatica
- 🔄 Export PowerBI/Tableau
---NiksHacks