xpath 爬取起點小說寫入mysql前端

原創

Cep�Murphy laws

2020-06-23 00:19

import requests
import lxml.etree as etree

def getBook(url):
    response = requests.get(url)
    response.encoding='utf-8'
    #print(response)
    # 生成選擇器對象
    selector = etree.HTML(response.text)
    #print(selector)
    #xpath 數據 注意 輸出類型定位精確
    bookTitles = selector.xpath('//div[@class="book-mid-info"]/h4/a/text()')  #注意etree 需要解析到文本
    bookhrefs = selector.xpath('//div[@class="book-mid-info"]/h4/a/@href')
    authors = selector.xpath('//div[@class="book-mid-info"]/p[1]/a[1]/text()')
    intros = selector.xpath('//div[@class="book-mid-info"]/p[2]/text()')
    n = 1
    for i in range(len(bookTitles)):
        data = {
            'ID':n,
            'Title':bookTitles[i],
            'BookLink':"https:" + bookhrefs[i],
            'Author':authors[i],
            'Intro':intros[i].strip()
        }

        print(data)
        n += 1

#url = 'https://www.qidian.com/rank/collect?chn=21&page=1'
urlList = ['https://www.qidian.com/rank/collect?chn=21&page=' + str(i) for i in range(1,100)]



for url in urlList:
    getBook(url)

發表評論

所有評論

還沒有人評論，想成為第一個評論的人麼? 請在上方評論欄輸入並且點擊發布.

相關文章

向量數據庫引領 AI 創新——Zilliz 亮相 2024 亞馬遜雲科技中國峯會

2024年5月29日，亞馬遜雲科技中國峯會在上海召開，此次峯會聚集了來自全球各地的科技領袖、行業專家和創新企業，探討雲計算、大數據、人工智能等前沿技術的發展趨勢和應用場景。作爲領先的向量數據庫技術公司，Zilliz 在本次峯會上展示了最新的

2024-05-30 21:25:17

2024年國內最全面最前沿人工智能理論和實踐資料

引言【導讀】2024第11屆全球互聯網架構大會圓滿結束。會議邀請了100餘位行業內的領軍人物和革新者，大會通過主題演講、實踐案例分享，以及前瞻性的技術討論，探索AI技術的邊界。(最新AI-大模型獲取地址點擊領取) 近日

2024-05-29 22:52:52

AI安全志：英國AI騙保事件增加300%！

最近，英國《衛報》報道稱，一些騙子正在利用人工智能照片編輯軟件篡改照片，以進行保險欺詐活動。這一發現令保險公司震驚，因爲這可能導致汽車保險費用飆升至歷史最高水平。安聯保險公司表示，從2021年至2023年期間，利用應用程序篡

2024-05-28 00:15:50

使用 Spring Cloud Alibaba AI 構建 RAG 應用

作者：姬世文背景介紹 RAG（Retrieval Augmented Generation）檢索增強生成（RAG）是一種用於將數據與人工智能模型集成的技術。在 RAG 工作流程中，第一步將文檔數據加載到矢量數據庫（例如 Redis）中。

2024-05-27 21:13:51

面向AI的開發：從大模型（LLM）、檢索增強生成（RAG）到智能體（Agent）的應用

引言隨着人工智能技術的飛速發展，大型語言模型（LLM）、檢索增強生成（RAG）和智能體（Agent）已經成爲推動該領域進步的關鍵技術，這些技術不僅改變了我們與機器的交互方式，而且爲各種應用和服務的開發提供了前所未有的可能性。正確理解這三者

2024-05-24 23:57:39

文心大模型免費辣，動手搓點啥慶祝一下吧

5月21日下午，百度智能雲宣佈文心大模型的兩款主力模型ENIRE Speed、ENIRE Lite全面免費，即刻生效。這兩款大模型都是今年3月剛剛發佈的，均支持8K和128k上下文長度。可以說，這是百度最新的模型

2024-05-24 12:13:22

噱頭還是風口？剖析AI短劇出海的未來

導語 |去年以來，低成本、高回報的土味短劇在國內爆火，而這股風也成功地刮到海外。2024 年，越來越多的人把目光投向了擁有龐大市場的國外“藍海”，當人們還在高談闊論 Sora 是否顛覆影視行業的時候，AI 已經在出海短劇中大顯身手，那

2024-05-24 11:48:13

華爲雲受邀出席AICon2024 分享AI Agent在企業生產中的技術實踐

近日， InfoQ在北京舉辦行業技術盛會——AICon全球人工智能開發與應用大會2024，華爲雲aPaaS首席架構師陳星亮受邀出席，和技術愛好者分享AI Agent在企業生產中的技術實踐。大模型技術發展浪潮下，AI Agent成爲新一

2024-05-24 10:58:18

昔日輝煌不再，PHP老矣，尚能飯否？

導語 | 近期 TIOBE 最新指數顯示，PHP 的流行度降至了歷史最低，排在第 17 名，同時，在年度 Stack Overflow 開發者調查報告中，PHP 在開發者中的受歡迎程度已經從之前的約 30% 萎縮至現在的 18%。“P

2024-05-23 23:48:42

2023全球DDoS攻擊態勢分析，與衆多行業專家共議DDoS破局之道

近日，百度安全聯合華爲、天翼安全科技有限公司、聯通數科安全、Nexusguard、中國移動雲能力中心、中國移動卓望公司、清華大學共同發佈《2023年全球DDoS攻擊現狀與趨勢分析》（以下簡稱《報告》）。報告從DDoS攻擊態勢、殭屍網絡態勢、

2024-05-23 21:42:25

站在岸上學不會游泳 | 算法校招生的高效成長總結

在這個由數據編織、由算法驅動的時代，AI大模型正成爲推動社會進步的重要力量。我們不僅是變革的見證者，更是推動者和塑造者。感謝零售UP技術人欄目的邀請，本文藉此機會回顧一下自己的算法之路上的一些故事和思考，希望能帶給讀者一些幫助。介紹自

2024-05-22 11:56:42

「Kimi」加入微信，最方便的私人財經助手

喜大普奔，「Kimi」大模型現在可以接入微信了！如果說其他大模型應用還略顯繁瑣，需要下載一個新的APP 甚至翻牆，那「Kimi」加入微信後，把大模型應用的體驗成本降低到 0。這意味着我們有了一個免費且好用且穩定且無

2024-05-21 11:48:27

5月21日相聚上海張江！與文心大模型一起共建大模型產業應用生態圈

5月21日，文心中國行將走進上海，在張江科學會堂舉行。屆時，政府、企業與高校的相關專家和業界同仁將現場分享生成式人工智能與大模型最新進展，主要圍繞大模型技術如何賦能產業級應用創新展開探討，還有百度風投從投資視角帶來的觀點，讓參會者全方位瞭解

2024-05-17 00:28:21

白鯨開源CEO郭煒在2024 DataOps發展大會上獲聘專家

2024年5月15日，白鯨開源CEO郭煒在2024 DataOps發展大會上被正式聘任爲DataOps專家，並獲得了榮譽證書。本次大會由中國通信標準化協會主辦，中關村科學城管委會提供支持，大數據技術標準推進委員會（CCSATC601）承辦，

2024-05-16 11:28:50

共創數字經濟新生態，華爲雲生態領航者·AI先遣隊圓滿落幕

5月9-11日，華爲雲生態“領航者·AI先遣隊”課程班在杭州成功舉辦，本次課程聚焦於AI前沿探索與實踐的高端研修，匯聚了來自華爲雲生態夥伴企業的高層決策者，共同開啓了一場關於智慧升級與生態共建的深度對話。華爲雲生態領航者·AI先

2024-05-16 10:58:48

24小時熱門文章

最新文章

最新評論文章