
小紅書數據采集工具 xhs一條命令裝完筆記評論數據 5 分鐘到手【免費下載鏈接】xhs基于小紅書 Web 端進行的請求封裝。https://reajason.github.io/xhs/項目地址: https://gitcode.com/gh_mirrors/xh/xhs周報截止前夜你為了 600 篇筆記手動謄寫標題、點贊、收藏進 Excel凌晨一點手指發麻還把兩個競品的數據抄串了。這種純體力活真不該再用雙手干——小紅書數據采集工具 xhs 把小紅書 Web 端的請求封裝成了 Python 接口幾行代碼就能批量拿到筆記、用戶、評論等公開數據。小紅書數據采集xhs 到底能拉哪些數據筆記詳情一次拿全get_note_by_id()返回標題、正文、點贊、收藏、評論數、圖片鏈接等信息直接輸出結構化 JSON灌進表格或數據庫都能用關鍵詞搜索加排序get_note_by_keyword()按關鍵詞找筆記支持按熱度、時間排序一眼定位話題下的頭部內容用戶側數據成體系get_user_info()拿主頁資料get_user_notes()拿發布列表收藏列表、點贊列表也都有對應接口多級評論全覆蓋get_note_comments()抓一級評論get_note_sub_comments()深挖樓中樓回復完整還原討論現場不止會讀點贊、收藏、關注、發評論等交互操作也有登錄支持二維碼和手機號兩種方式小紅書數據采集工具適合誰三類人對號入座內容創作者和新媒體小編用關鍵詞搜索加熱度排序掃一遍話題下的爆款筆記哪個方向互動多一目了然選題從此有據可依電商選品和品牌運營定期用get_user_notes()拉競品賬號的發布列表再交叉核對每篇的互動數據對方的更新節奏和內容規律全進你自己的數據庫產品運營和口碑研究團隊把一級評論和子評論連起來分析評論區里用戶的真實原話就是成本最低的市場調研小紅書筆記數據采集三步走到出結果第一步裝依賴。三條命令搞定pip install xhs pip install playwright playwright install之所以要 playwright網站對每個請求都會出幾道安全題也就是 x-s 簽名這個工具靠模擬真實瀏覽器替你作答所以瀏覽器內核得先裝好。第二步備好 Cookie。在小紅書網頁版登錄從開發者工具里復制 Cookie 填進腳本。a1、web_session、webId三個字段必須有缺一個就像門禁卡少刷一道門不會開。第三步跑示例看輸出。打開 示例腳本把里面的 cookie 換成你自己的運行。屏幕上打印出一篇筆記的完整 JSON——標題、正文、點贊、收藏、評論數、圖片鏈接——就算跑通了數據已經在你手里。小紅書數據爬取避坑簽名、多賬號與合規邊界簽名偶爾不配合是常態示例腳本已內置重試循環多試幾次一般就好若頻繁失敗把瀏覽器加載后的等待時間適當調長一點相當于讓模擬瀏覽器先熱熱身再答題詳見 docs/basic.rst多賬號共用簽名服務要統一 a1把簽名封裝成獨立服務參考 example/basic_sign_server.py 或 xhs-api/ 里的 Docker 簽名服務時所有賬號 Cookie 中的 a1 字段必須保持一致不然簽名錯誤會一直報控制請求頻率請求之間留足間隔火力全開容易觸發風控甚至 IP 封禁細一點、慢一點才用得久只取公開數據項目出自個人學習用途請只抓取公開可訪問的內容遵守相關法律法規與平臺規則不給目標網站施加壓力說到底xhs 把簽名、解析這些最磨人的環節收進了底層你只管調接口、收 JSON。現在就pip install xhs裝上照著示例腳本跑一遍昨天還在手抄的表格今天就該由腳本自己干——這周的數據別再浪費手指頭了。【免費下載鏈接】xhs基于小紅書 Web 端進行的請求封裝。https://reajason.github.io/xhs/項目地址: https://gitcode.com/gh_mirrors/xh/xhs創作聲明:本文部分內容由AI輔助生成(AIGC),僅供參考