关于人工智能:交互式数据分析和处理新方法pandasai-Pandas-ChatGPT

44次阅读

共计 1938 个字符,预计需要花费 5 分钟才能阅读完成。

Python Pandas 是一个为 Python 编程提供数据操作和剖析性能的开源工具包。这个库曾经成为数据科学家和分析师的必备工具。它提供了一种无效的办法来治理结构化数据 (Series 和 DataFrame)。

在人工智能畛域,Pandas 常常用于机器学习和深度学习过程的预处理步骤。Pandas 通过提供数据清理、重塑、合并和聚合,能够将原始数据集转换为结构化的、随时可用的 2 维表格,并将其输出人工智能算法。

pandas-ai 介绍

PandasAI 将 Pandas 转换为一个会话工具,你能够询问无关数据的问题,它则会以 Pandas dataframe 的模式进行答复。

例如,咱们能够要求 PandasAI 返回一个 DataFrame 中列值大于 5 的所有行,它将返回一个只蕴含这些行的 DataFrame。

 importpandasaspd
 frompandasaiimportPandasAI
 
 # Sample DataFrame
 df=pd.DataFrame({"country": ["United States", "United Kingdom", "France", "Germany", "Italy", "Spain", "Canada", "Australia", "Japan", "China"],
     "gdp": [21400000, 2940000, 2830000, 3870000, 2160000, 1350000, 1780000, 1320000, 516000, 14000000],
     "happiness_index": [7.3, 7.2, 6.5, 7.0, 6.0, 6.3, 7.3, 7.3, 5.9, 5.0]
 })
 
 # Instantiate a LLM
 frompandasai.llm.openaiimportOpenAI
 llm=OpenAI()
 
 pandas_ai=PandasAI(llm)
 pandas_ai.run(df, prompt='Which are the 5 happiest countries?')

除了返回后果以外,还能够生成图表:

 pandas_ai.run(
     df,
     "Plot the histogram of countries showing for each the gpd, using different colors for each bar",
 )

装置和应用

只有应用 pip 装置就能够应用:

 pip install pandasai

然而在应用 pandasai 时须要输出一个 openai 的 api-key,这样才能够让他调用 openai 的语言模型:

而后在应用前先 import,在输出 api 的 key 就能够应用了:

 #Import pandas and pandas-ai 
 importpandasaspd
 frompandasaiimportPandasAI
 # Instantiating my llm using OpenAI API key.
 frompandasai.llm.openaiimportOpenAI
 # OpenAI
 llm=OpenAI(api_token="YOUR_OPENAI_API_KEY")

因为 pandas 的个性,咱们不仅仅能够解决 csv 文件,咱们还能够连贯关系型的数据库,例如 pgsql:

 # creating the uri and connecting to database
 pg_conn="postgresql://YOUR URI HERE"
 
 #Query sql database 
 query="""
 SELECT *
 FROM table_name
 """
 
 #Create dataframe named df
 df=pd.read_sql(query,pg_conn)

而后像下面代码一样,咱们能够间接与它进行对话了:

 # Using pandas-ai!
 pandas_ai=PandasAI(llm)
 pandas_ai.run(df, prompt='Place your prompt here)

最初

ChatGPT、Pandas 是弱小的工具,当它们联合在一起时,能够彻底改变咱们与数据交互和剖析的形式。ChatGPT 凭借其先进的自然语言解决能力,能够更直观地与数据进行相似人类的交互。而 PandasAI 能够加强 Pandas 数据分析体验。通过将简单的数据操作工作转换为简略的自然语言查问,PandasAI 使用户更容易从数据中提取有价值的见解,而无需编写大量代码。

这对于那些还不相熟 Python 或 pandas 操作 / 转换的人来说是一种编程的新办法。咱们不须要为你想要执行的工作编程,而是只是与 AI 代理交谈,明确的额通知它想要的后果,代理会将此音讯转换为计算机可解释的代码,并返回后果。

https://avoid.overfit.cn/post/05d75584fa34404ca8aefcd9ad1ca1ed

正文完
 0