免费国产a国产片高清不卡,欧美福利一区二区三区,国内精品999

一、方法2

此方法是兩個表構建某一相同字段，然后全連接，在做匹配結果篩選，此方法針對數(shù)據(jù)量不大的時候，邏輯比較簡單，但是內存消耗較大

1. 導入庫

import pandas as pd
import numpy as np
import re

2. 構建關鍵詞

#關鍵詞數(shù)據(jù)
df_keyword = pd.DataFrame({
  "keyid" : np.arange(5),
  "keyword" : ["numpy", "pandas", "matplotlib", "sklearn", "tensorflow"]
})
df_keyword

Python Pandas兩個表格內容模糊匹配的實現(xiàn)

3. 構建句子

df_sentence = pd.DataFrame({
  "senid" : np.arange(10,17),
  "sentence" : [
      "怎樣用pandas實現(xiàn)merge？",
      "Python之Numpy詳細教程",
      "怎么使用Pandas批量拆分與合并Excel文件？",
      "怎樣使用pandas的map和apply函數(shù)？",
      "深度學習之tensorflow簡介",
      "tensorflow和numpy的關系",
      "基于sklearn的一些機器學習的代碼"
  ]
})
df_sentence

Python Pandas兩個表格內容模糊匹配的實現(xiàn)

4. 建立統(tǒng)一索引

df_keyword['match'] = 1
df_sentence['match'] = 1

5. 表連接

df_merge = pd.merge(df_keyword, df_sentence)
df_merge

Python Pandas兩個表格內容模糊匹配的實現(xiàn)

6. 關鍵詞匹配

def match_func(row):
  return re.search(row["keyword"], row["sentence"], re.IGNORECASE) is not None
df_merge[df_merge.apply(match_func, axis = 1)]

匹配結果如下

Python Pandas兩個表格內容模糊匹配的實現(xiàn)

二、方法2

此方法對編程能力有要求，在大數(shù)據(jù)集上計算量較方法一小很多

1. 構建字典

key_word_dict = {
  row.keyword : row.keyid
  for row in df_keyword.itertuples()
}
key_word_dict

{'numpy': 0, 'pandas': 1, 'matplotlib': 2, 'sklearn': 3, 'tensorflow': 4}

2. 關鍵詞匹配

def merge_func(row):
  #新增一列，表示可以匹配的keyid
  row["keyids"] = [
      keyid
      for key_word, keyid in key_word_dict.items()
      if re.search(key_word, row["sentence"], re.IGNORECASE)
  ]
  return row
df_merge = df_sentence.apply(merge_func, axis = 1)

3. 結果展示

df_merge

Python Pandas兩個表格內容模糊匹配的實現(xiàn)

4. 匹配結果展開

df_result = pd.merge(
left = df_merge.explode("keyids"),
right = df_keyword,
left_on = "keyids",
right_on = "keyid")
df_result

Python Pandas兩個表格內容模糊匹配的實現(xiàn)

總結

到此這篇關于Python Pandas兩個表格內容模糊匹配搜索服務器之家以前的文章或繼續(xù)瀏覽下面的相關文章希望大家以后多多支持服務器之家！

原文鏈接：https://blog.csdn.net/weixin_43734080/article/details/121228769

一区二区三区在线-一区二区三区亚洲视频-一区二区三区亚洲-一区二区三区午夜-一区二区三区四区在线视频-一区二区三区四区在线免费观看

Python Pandas兩個表格內容模糊匹配的實現(xiàn)

一、方法2

1. 導入庫

2. 構建關鍵詞

3. 構建句子

4. 建立統(tǒng)一索引

5. 表連接

6. 關鍵詞匹配

二、方法2

1. 構建字典

2. 關鍵詞匹配

3. 結果展示

4. 匹配結果展開

總結

延伸 · 閱讀

Python實現(xiàn)ping指定IP的示例

python直接訪問私有屬性的簡單方法

Python3以GitHub為例來實現(xiàn)模擬登錄和爬取的實例講解

Python的dict字典結構操作方法學習筆記

在Windows系統(tǒng)上搭建Nginx+Python+MySQL環(huán)境的教程

使用NumPy和pandas對CSV文件進行寫操作的實例

python 列表轉為字典的兩個小方法(小結)

python 插入Null值數(shù)據(jù)到Postgresql的操作

PyCharm設置SSH遠程調試的方法

Python安裝圖文教程 Pycharm安裝教程

python是什么意思？python有什么用？

使用Python抓取模板之家的CSS模板

Python 列表(List)操作方法詳解