亚洲激情专区-91九色丨porny丨老师-久久久久久久女国产乱让韩-国产精品午夜小视频观看

溫馨提示×

溫馨提示×

您好,登錄后才能下訂單哦!

密碼登錄×
登錄注冊×
其他方式登錄
點擊 登錄注冊 即表示同意《億速云用戶服務條款》

python 中怎么動態遷移solr數據

發布時間:2021-06-17 17:09:31 來源:億速云 閱讀:137 作者:Leah 欄目:開發技術

python 中怎么動態遷移solr數據,很多新手對此不是很清楚,為了幫助大家解決這個難題,下面小編將為大家詳細講解,有這方面需求的人可以來學習下,希望你能有所收獲。

一、使用http的接口先進行查詢

使用如下格式查詢:

其中:collection_name 是你查詢的collection的名稱

rows 是需要查詢多少行,這里設置為1000

start 從多少行開始進行查詢,待會兒腳本里面就是控制這個參數進行循環查詢

http://host:port/solr/collection_name/select?q=*:*&rows=1000&start=0

查詢處理后會得到如下圖片里面的數據格式,其中

在response里面,有兩個鍵值數據是我們需要的,一個是numFound(總的數據條數),docs(所有json數據都在這里面)

python 中怎么動態遷移solr數據

在docs里面,每條數據都帶有version 鍵值,這個需要給去掉

python 中怎么動態遷移solr數據

二、使用http的接口提交數據

wt:使用json格式提交

http://host:port/solr/collection_name/update?wt=json

header 需設置為 {"Content-Type": "application/json"}

提交參數:solr在做索引的時候,如果文檔已經存在,就替換。(這里的參數也可以直接加到url里面)

{"overwrite":"true","commit":"true"}

data_dict 就是我們處理后的 docs數據

提交數據:data={"add":{ "doc":data_dict}}

三、實現的腳本如下:

#coding=utf-8
import requests as r
import json
import threading
import time
#發送數據到目的url des_url,data_dict 參數為去掉version鍵值后的一條字典數據
def send_data(des_url,data_dict):
 data={"add":{ "doc":data_dict}}
 headers = {"Content-Type": "application/json"}
 params = {"boost":1.0,"overwrite":"true","&commitWithin":1000,"commit":"true"}
 url = "%s/update?wt=json"%(des_url)
 re = r.post(url,json = data,params=params,headers=headers)
 if re.status_code != 200:
  print("導入出錯",data)

#獲取數據,調用send_data 發送數據到目的url
def get_data(des_url,src_url):
  #定義起始行
 start = 0
 #先獲取到總的數據條數
 se_data=r.get("%s/select?q=*:*&rows=0&start=%s"%(src_url,start)).text
 se_dict = json.loads(se_data)
 numFound = int(se_dict["response"]["numFound"])
 #while循環,1000條數據為一個循環
 while start < numFound:
  #定義存放多線程的列表
  th_li = []
    #獲取1000條數據
  se_data=r.get("%s/select?q=*:*&rows=1000&start=%s"%(src_url,start)).text
    #把獲取的數據轉換成字典
  se_dict = json.loads(se_data)
    #獲取數據里的docs數據
  s_data = (se_dict["response"]["docs"])

  #循環得到的數據,刪除 version鍵值,并使用多線程調用send_data 方法發送數據
  for i in s_data:
   del i["_version_"]
   th = threading.Thread(target=send_data,args=(des_url,i))
   th_li.append(th)

  for t in th_li:
   t.start()
   t.join()

  start += 1000
  print(start)

if __name__ == "__main__":
 #源數據,查詢數據的collection地址
 src_url = "http://ip:port/solr/src_connection"
 #導入數據導目的collection 的地址
 des_url = "http://ip:port/solr/des_connection"
 start_time = time.time()
 get_data(des_url,src_url)
 end_time = time.time()
 print("耗時:",end_time-start_time,"秒")

備注:

一、如果你的collection 不在同一個網絡,不能實現在線傳輸,可以先把for循環 刪除了version鍵值的數據,寫入一個文件中,然后copy到目的網絡的服務器上,循環讀取文件進行上傳,如下寫入文件(這個就根據各位大佬的喜好來寫了),但讀取后,需要把每一條數據都轉換成字典進行上傳:

file = open("solr.json","a+")
for i in s_data:
del i["version"]
file.write(str(i)+"\n")
file.close()

二、清除數據可使用一下方法,自測比較方便的一種

在你要清除collection里面

選擇 documents

document type 選擇xml

將一下內容復制到如圖位置,最后點擊submit document 按鈕即可

#控制web界面刪除數據
<delete><query>:</query></delete>
<commit/>

python 中怎么動態遷移solr數據

看完上述內容是否對您有幫助呢?如果還想對相關知識有進一步的了解或閱讀更多相關文章,請關注億速云行業資訊頻道,感謝您對億速云的支持。

向AI問一下細節

免責聲明:本站發布的內容(圖片、視頻和文字)以原創、轉載和分享為主,文章觀點不代表本網站立場,如果涉及侵權請聯系站長郵箱:is@yisu.com進行舉報,并提供相關證據,一經查實,將立刻刪除涉嫌侵權內容。

AI

洛川县| 牙克石市| 肥西县| 阳东县| 洪洞县| 祁东县| 正蓝旗| 郧西县| 武安市| 秭归县| 宝兴县| 阿克苏市| 沽源县| 曲周县| 鹤峰县| 日土县| 承德市| 建德市| 盐山县| 太仓市| 苏尼特右旗| 武汉市| 内黄县| 罗山县| 通辽市| 临猗县| 郸城县| 龙胜| 吉木萨尔县| 兴海县| 江陵县| 花莲县| 阿坝县| 南漳县| 宁夏| 汤阴县| 区。| 伽师县| 平定县| 沙田区| 盐池县|