python - 查找列中的关键字并将这些关键字添加到同一行的新列中

标签 python dataframe append contains

我是 python 新手,这是我关于堆栈溢出的第一篇文章。我有一个关键字列表和一个包含多列的数据框。

我想在特定列中搜索这些关键字并编写出现在该列中的关键字。

这就是我正在做的事情。 My code

这是我收到的错误。 The loop with the error

这就是我想要得到的。 Desired output

请帮助找出问题所在或提出更好的方法。谢谢! 如果可以使事情变得更容易,请编写下面的代码。

import pandas as pd

keywords = ["hello","hi","greetings","wassup"]

data = ["hello, my name is Harry", "Hi I am John", "Yo! Wassup", "Greetings fellow traveller","Hey im 
Henry", "Hello there General Kenobi"]

df = pd.DataFrame(data,columns = ['strings'])

df['Keywords'] = ""

df2 = pd.DataFrame(data = None, columns = df.columns)

for word in keywords:
     temp = df[df['strings'].str.contains(word,na = False)]
     temp.reset_index(drop = True)
     temp['Keywords'] = word
     df2.append(temp)

错误:

C:\Users\harka\Anaconda3\lib\site-packages\ipykernel_launcher.py:5:SettingWithCopyWarning: 尝试在 DataFrame 的切片副本上设置一个值。 尝试使用 .loc[row_indexer,col_indexer] = value 代替

请参阅文档中的警告:http://pandas.pydata.org/pandas-docs/stable/indexing.html#indexing-view-versus-copy “”“

最佳答案

我添加了“Yo”以表明它可以返回多个字符串

import pandas as pd

def keyword(row):
  strings = row['strings']
  keywords = ["hello","hi","greetings","wassup",'yo']
  keyword = [key for key in keywords if key.upper() in strings.upper()]
  return keyword

data = ["hello, my name is Harry", "Hi I am John", "Yo! Wassup", "Greetings fellow traveller","Hey im Henry", "Hello there General Kenobi"]

df = pd.DataFrame(data,columns = ['strings'])
df['keyword'] = df.apply(keyword, axis=1)

如果您不喜欢返回的字符串列表,那么也许是逗号分隔的字符串?

import pandas as pd

def keyword(row):
  strings = row['strings']
  keywords = ["hello","hi","greetings","wassup",'yo']
  keyword = [key for key in keywords if key.upper() in strings.upper()]
  return ','.join(keyword)

data = ["hello, my name is Harry", "Hi I am John", "Yo! Wassup", "Greetings fellow traveller","Hey im Henry", "Hello there General Kenobi"]

df = pd.DataFrame(data,columns = ['strings'])
df['keyword'] = df.apply(keyword, axis=1)

关于python - 查找列中的关键字并将这些关键字添加到同一行的新列中,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/60147791/

相关文章:

python - PIL图像转换不使用文件系统

python - 如何使用 Python 在 Blender 2.61 中移动相机

r - sapply使用多列作为变量

python - Pandas groupby 将 ndarrays 的嵌套数组分配回数据帧

javascript - jQuery 在列表中移动/添加 html 文本不起作用

python - 在 Tensorflow 中计算雅可比矩阵

python - 使用 numpy 将数组写入标准输出

apache-spark - PySpark数据帧将异常的字符串格式转换为时间戳

python - 使用 python pandas 将现有的 excel 表 append 到新的数据框

python - 将微型列表 append 到更大的列表