当前位置: 首页 > news >正文

成都行业网站建设十大搜索引擎入口

成都行业网站建设,十大搜索引擎入口,宁波seo推广推荐公司,wordpress导入网站文章我用AI做数据分析之四种堆叠聚合模型的比较 这里AI数据分析不仅仅是指AI生成代码的能力,我想是测试AI数据分析方面的四个能力,理解人类指令的能力、撰写代码的能力、执行代码的能力和解释结果的能力。如果这四个能力都达到了相当的水准,才可…

我用AI做数据分析之四种堆叠聚合模型的比较

这里AI数据分析不仅仅是指AI生成代码的能力,我想是测试AI数据分析方面的四个能力,理解人类指令的能力、撰写代码的能力、执行代码的能力和解释结果的能力。如果这四个能力都达到了相当的水准,才可以说真正实现了AI数据分析。而目前AI作为IDE插件的形式,只能说是半自动的AI数据分析。

之前测试过程中,AI在数据清洗方面,包括更改列名、寻找录入错误等方面体现出了优于一般工具的表现,展现了良好地对任务的理解能力和对表格的处理能力,没有涉及撰写代码等能力。

目的

既然有了AI的辅助,我们需要做一些自己能力之上的事情,之前自己对堆叠聚合模型有了解但是了解不多,且没有用Python进行过编码,在相关知识和编码能力上都不能完成对各种堆叠聚合模型的测试和比较,所以这次定的目标是对“常见堆叠聚合模型的测试比较”。

背景

堆叠聚合模型(Stacking Aggregation Model),也被简称为 Stacking 模型,是一种高级的集成学习技术。它的核心思想是将多个不同的基础模型(如决策树、逻辑回归、神经网络等)的预测结果进行二次建模组合 。在这个过程中,第一层由多个不同的基础模型组成,这些基础模型在训练数据上进行训练,然后对测试数据做出预测。这些预测结果会被当作新的特征,输入到第二层的模型(通常称为元模型)中进行训练和预测。通过这种方式,Stacking 模型能够综合利用各个基础模型的优势,挖掘出数据中更复杂的模式,从而有可能获得比单个模型更好的预测性能。

基础模型选择策略:尽量选择多样化的基础模型,比如线性模型(如线性回归、逻辑回归)与非线性模型(如决策树、支持向量机)相结合。不同类型的模型对数据的理解和捕捉模式的能力不同,组合在一起可以覆盖更广泛的特征空间。例如在一个房价预测任务中,线性回归可以捕捉房价与房屋面积等简单线性关系,而决策树则能发现不同区域、房屋类型等复杂条件下的房价规律。
交叉验证策略:在训练 Stacking 模型时,为了避免过拟合和更有效地利用数据,常使用交叉验证。以 k 折交叉验证为例,将训练数据分成 k 份,每次用 k - 1 份数据训练基础模型,然后对剩下的 1 份数据进行预测。这样重复 k 次,就可以得到所有训练数据的预测结果,这些结果作为元模型的训练数据。这种方式确保了基础模型的预测结果是基于未见过的数据,提高了模型的泛化能力。
元模型选择策略:元模型的选择很关键,它需要能够有效整合基础模型的预测信息。常用的元模型有逻辑回归、决策树、神经网络等。如果基础模型的预测结果之间存在复杂的非线性关系,神经网络可能是更好的选择;若希望模型有较好的可解释性,逻辑回归或决策树可能更合适。比如在一个信用风险评估中,如果只需要简单判断风险高低,逻辑回归作为元模型就可以清晰地展示各基础模型预测结果对最终风险判断的影响权重。

结果

AI推荐了四种常见的堆叠聚合模型的组合,分别是:

组合1: logistic(base) + decision tree(base) +logistic(meta)
组合2:logistic(base) + decision tree(base) + neural network(meta) 组合3:
SVC(base) + KNN(base) +logistic(meta) 组合4: SVC(base) + KNN(base) +
neural network(meta)

另外,使用AI形成了分析的基础代码,代码质量还是可以,用到的库比较单一,主要是用scikit-learn中的代码;

但是AI在执行代码方面遇到问题,显示内核读取失败“kernel iopub read failed ”,看来AI在数据执行方面有一定的局限性;之前还遇到一个执行问题是没有相应的库。

结果是在给定的数据集上,组合1的效果最佳,但是在不同的数据集上可能有不同的表现。在这里插入图片描述
用AI解释结果是没问题的,解释仔细也都对。

最后

AI数据分析需要的四个能力中,代码执行部分是短板,但是借助AI,我们已经能做一些能力之上的事情,基础的事情AI已经能做了,把AI这些基础的能力整合起来,规划一些多步骤的任务说明一定的问题,可能更有意义。
项目代码:https://www.heywhale.com/mw/project/67abfca747828d409e8090ea

http://www.yayakq.cn/news/859611/

相关文章:

  • 舆情网站直接打开在自己的电脑做网站空间
  • 网站开发工具概述与比较成都网站建设上云
  • 手机网站居中显示网站所有页面只显示域名
  • 个人工作室网站wordpress招聘
  • 海口网站建设网站制作北京建工博海建设有限公司网站
  • 来一个网站谢谢了网站模板哪家好
  • wap网站开发语言动态手机网站怎么做的
  • 门户网站建设的公司四川住房和建设厅网站
  • 做网站地图的步骤erp系统哪个品牌最好
  • 培训网站开发公司网络平台怎么建立网站吗
  • 好的网站设计模板江苏网站建设定制
  • 智慧城市展厅设计公司手机网站 搜索优化 百度
  • 建设一个网站大概费用网站开发人员兼职
  • 网站标题flash建设工程管理网站
  • 哪个网站做轴承外贸的人比较多深圳建设网站制作
  • 滕州市建设局网站好的网站建设哪家好
  • 上海网站建设建站旅游网站网页设计
  • mvc4 做网站做vi 设计国外网站
  • 淮阳网站建设wordpress插件清理
  • 为什么做网站要用谷歌浏览器wordpress手机博客主题
  • 百度不更新网站wordpress单页工作室主题
  • 东莞网站系统哪里好wordpress登陆不上
  • 做品牌网站的织梦网站分享插件
  • 优化网站设计有哪些方法工程师报考网站
  • 常用的网站有哪些广州企业公司大全
  • 企业网站php开源系统金融行业网站开发
  • 山东省工程建设造价信息网站网站建设期末试题
  • 网站优化招聘京东网站开发技术
  • 运城环保局网站王建设做网站怎么自定义背景图片
  • 新建文档怎么做网站网络建设公司起名选字