📌 Quali dati dei risultati di ricerca di Xiaohongshu puoi raccogliere dagli URL inviati?
Questo modello raccoglie i record dei risultati di ricerca con Titolo, URL dell'immagine, URL della pagina dei dettagli, URL dell'autore, Data e ora, Autore e Conteggio dei 'Mi piace'. È utile per ricercatori di social media, team di contenuti, analisti di brand e ricercatori di pubblico.
I dati vengono raccolti da Xiaohongshu. Xiaohongshu è una piattaforma di social discovery incentrata su post degli utenti, prodotti, argomenti di lifestyle e raccomandazioni.
💰 Prezzi
Questo modello è attualmente gratuito e non ha costi di utilizzo per riga. Potrebbero comunque applicarsi i limiti del piano o delle risorse di Octoparse.
📦 Output
L'implementazione attualmente pubblicata può restituire i seguenti campi:
TitleImage_URLDetails_page_URLAuthorDatetimeAuthor_URLLike_count
{
"Title": "推荐3款自动爬虫神器,再也不用手撸代码了",
"Image_URL": "https://sns-webpic-qc.xhscdn.com/202511101556/e6aa53f42ed33364e0afd76422cd9bc3/1040g008314t3depl14005npqjgqg8e7a9v66v7g!nc_n_webp_mw_1",
"Details_page_URL": "https://www.xiaohongshu.com/search_result/66889d19000000000a026420?xsec_token=ABNlEB76L3vQ5N6cIYO-nnMuxpO0YslweSJOt3wLL32-8=&xsec_source=",
"Author": "Python大数据分析",
"Datetime": "2024-07-06",
"Author_URL": "https://www.xiaohongshu.com/user/profile/5f3a9c3500000000010038ea?channel_type=web_search_result_notes&parent_page_channel_type=web_profile_board&xsec_token=AB6uZC_94FYmu431pd_4pk8yP8HtOlqXAyi_kjD4UVbiA=&xsec_source=pc_search",
"Like_count": "511"
}
🎯 Casi d'uso
- Costruire un set di dati di ricerca strutturato e organizzato per Titolo.
- Analizzare il contenuto di origine e la tempistica tramite Autore, URL dell'autore e Data e ora.
- Misurare il coinvolgimento del pubblico o dei clienti utilizzando il Conteggio dei 'Mi piace'.
- Utilizzare l'URL dell'immagine, l'URL della pagina dei dettagli e l'URL dell'autore per verificare i record di origine o inserire le pagine verificate nei flussi di lavoro a valle.
🐙 Perché Octoparse
- Flusso di lavoro pronto all'uso: I passaggi di estrazione per Xiaohongshu sono già configurati, quindi non è necessario creare lo scraper da zero.
- Esecuzione flessibile: Scegli la modalità di esecuzione locale o cloud supportata per adattarsi a controlli una tantum o a lavori di raccolta ripetibili.
- Output strutturato e ripetibile: I risultati vengono restituiti come righe coerenti, più facili da confrontare, filtrare, deduplicare ed elaborare rispetto alle pagine copiate manualmente.
- Barriere di protezione per input verificati: Il modulo espone gli input correnti, i valori selezionabili e i limiti significativi configurati per questo modello.
- Trasferimento pratico dei dati: Rivedi i risultati in Octoparse ed esportali o elaborali utilizzando le opzioni supportate dal tuo ambiente Octoparse.
📝 Input
Compila i seguenti campi:
- URL dei risultati di ricerca di Xiaohongshu (Obbligatorio) — URL dei risultati di ricerca di Xiaohongshu. Fino a 10.000 voci per esecuzione.
- Pre-Login (Obbligatorio) — Abilita il pre-login prima di raccogliere i risultati di ricerca di Xiaohongshu.
🚀 Come si usa
- Apri il modello e seleziona Provalo o Avvia.
- Compila i campi di input elencati sopra.
- Avvia l'attività utilizzando la modalità di esecuzione locale o cloud supportata.
- Rivedi le righe di output ed esporta o elabora i dati strutturati.
⚠️ Limitazioni
I risultati dipendono da ciò che il sito di origine espone al momento dell'esecuzione. Un campo di output elencato può essere vuoto quando la pagina di origine non fornisce quel valore. I limiti di input mostrati sopra sono imposti dal modello.
💡 Suggerimenti
Utilizza input specifici e validi e rivedi un risultato rappresentativo prima di avviare un lotto di grandi dimensioni. Rimuovi gli input duplicati quando non sono necessari record ripetuti.
❓ FAQ
Come funziona questo scraper?
L'automazione applica gli URL dei risultati di ricerca di Xiaohongshu (fino a 10.000) e il Pre-Login, elabora le pagine di ricerca risultanti e i loro elementi, e scrive righe strutturate che includono Titolo, URL dell'immagine, URL della pagina dei dettagli e Autore.
Cosa devo inserire?
Utilizza i campi e i valori accettati mostrati nella sezione Input. Vengono elencati solo i limiti rilevanti per l'utente e le opzioni selezionabili.
Quali dati restituisce questo modello?
I campi di output attuali e un'Anteprima dei dati JSON rappresentativa sono elencati nella sezione Output. La disponibilità dei campi può variare quando la pagina di origine non visualizza un valore.
L'uso di questo modello è gratuito?
Attualmente è gratuito e non ha costi di utilizzo per riga. Potrebbero comunque applicarsi i limiti del piano o delle risorse di Octoparse.
Perché alcuni campi di output possono essere vuoti?
Le pagine di origine non sempre espongono ogni valore per ogni record, e i layout possono variare in base all'elemento, al mercato o alla risposta corrente del sito. Il modello restituisce un campo quando la pagina corrente lo fornisce.
Posso esportare i dati raccolti?
Puoi rivedere le righe strutturate in Octoparse ed esportarle o elaborarle utilizzando le opzioni supportate dal tuo ambiente Octoparse.
🔗 Modelli correlati
- Xiaohongshu Post Details Scraper — Usa Xiaohongshu Post Details Scraper per arricchire gli URL scoperti con i dati della pagina di dettaglio.
- Xiaohongshu Search Result Scraper (by keyword) — Usa Xiaohongshu Search Result Scraper (per parola chiave) per un flusso di lavoro complementare sullo stesso sito di origine.
- Twitter (X) Comments Scraper — Usa Twitter (X) Comments Scraper per raccogliere dati comparabili dai social media da un'altra fonte.