3072-钱海峰-人工智能学科-数据挖掘方向-就业:否 扫二维码继续学习 二维码时效为半小时

(0评价)
价格: 免费

- 常用数据集数据的结构组成:特征值 + 目标值(有些数据集可以没有目标值)

- 样本:一组数据也可以称为一个样本。

- 数据中对于特征的处理:

1. pandas:工具。数据读取非常方便,可以处理数据的基本格式

2. sklearn:可以对特征进行处理——这类处理被称为特征工程

# 机器学习不需要对样本进行去重

【特征工程】

- 特征工程是将原始数据转换为能更好地代表预测模型的潜在问题的特征的过程,从而提高对未知数据的预测准确性

- 安装scikit-learn

[展开全文]

O(n): 多项式的最高阶项

[展开全文]

- 机器学习的数据:文件 csv

- 不用mysql的原因:

1. 具有性能瓶颈、读取速度慢

2. 格式不符合机器学习要求数据的格式

- pandas:读取数据的工具

- numpy(读取速度快)

- 可用数据集:Kaggle、UCI、scikit-learn

- 常用数据集数据的结构组成:特征值 + 目标值(有些数据集没有目标值)

 

[展开全文]

- 什么是机器学习:数据中自动分析获得规律(模型),利用规律对未知数据进行预测

 

[展开全文]

- 影响人工智能发展的重要因素:计算能力、数据大小、算法发展

- 使用场景:无人驾驶的场景识别、图片艺术化、医用彩超辨别、需求销量等数据预测

- 机器学习领域:自然语言处理、图像识别、传统预测

- 机器学习库和框架:scikit learn(机器学习)、tensorflow(深度学习)

- 书籍:统计学习方法、机器学习、python数据分析与挖掘实战、机器学习系统设计、面向机器智能tensorflow实践

- 课程概要:特征工程、模型策略优化、分类回归聚类、tensorflow、神经网络、图像识别、自然语言处理

[展开全文]

sudo进行用户切换。

$一般账户

#超级管理员

 

[展开全文]

微信,如何实现多用户操作?

whoami我是哪个账户。

exit切回去。

 

[展开全文]

python不适用的场景为效率性能要求较高的场景。c/go/java/c++都比他性能高。

[展开全文]
3594_N_ZDQ · 2022-12-02 · 自由式学习 0

cat显示文件内容

mv重新命名文件名移动

 

ln链接快捷键

ln -硬链接相当于复制

cat 1 2》3

把1和2合并到3里。

grep搜索

ls显示文件

cp复制粘贴

-r解决文件夹不让动。

 

 

 

[展开全文]

rmdir 删除文件夹

rm -r可以删非空文件

 

[展开全文]

ctrl+c删除命令行。

mkdir创建文件夹

tree以目录树的方式显示文件夹

-p自动创建文件夹

 

[展开全文]

最后一问结果是99.99999,是对的吗

[展开全文]

numpy多用在大型、多维数组上执行数值运算;

 

[展开全文]
荦荦 · 2022-11-11 · 自由式学习 0

for 遍历所有数值

print(输出便利数值)

for x in 数值

print()

 

[展开全文]
3589 · 2022-11-08 · 自由式学习 0

海龟绘图我pycharm无法输出

[展开全文]
  1. 不要在程序中,行开头处增加空格,空格在py中含有缩进的意义
  2. 符号是英文符号
[展开全文]

折线图:能够显示数据的变化趋势,反应事物的变化情况(变化)

直方图:绘制连续性的数据,展示一组或多组数据的分布情况(统计)

条形图:绘制离散的数据,能够一眼看出各个数据的大小,比较数据之间的差别(统计)

散点图:判断变量之间是否存在数量关联趋势,展示离群点(分布规律)

 

[展开全文]
荦荦 · 2022-10-24 · 自由式学习 0

matplotlib

  1. 可以将数据进行可视化,更直观的呈现,是数据更加客观有说服力;是Python的底层绘图库;
  2. 基本要点:
    1. axis轴:x或y轴;
    2. from matplotlib import pyplot as plt(命名为plt简写)

[展开全文]
荦荦 · 2022-10-19 · 自由式学习 0