博客
关于我
《百面机器学习》读书笔记(一)-特征工程
阅读量:319 次
发布时间:2019-03-04

本文共 2246 字,大约阅读时间需要 7 分钟。

???????????????????????????????????????????????????????????????????????????????????????????????????????

???????

???????????????????????????????????????????????????????????????????????????????????????

??????????????????

?????????????????????????????????????????????????????????Min-Max Scaling?????????Z-Score Normalization??

  • ??????????????????????????????????????????0?1??????

    \boxed{X_{norm} = \frac{X - X_{min}}{X_{max} - X_{min}}}

  • ????????????????????????????0?????1?

    \boxed{z = \frac{x - \mu}{\sigma}}

?????????????????????????????????????????????????????????????????????????????????????????????????????


???????

?????????????????????????????????????????????????????????????????

??????????

?????????????????

  • ??????????????????????????????????
  • ?????One-Hot Coding??????????????????????????????????
  • ??????????????????ID??????????????????????????????
  • ????????????????????????????????????????????????????????????????????????????????????


    ???????????

    ??????????????????????????????????????

    ???????????????????

    ????????????????????????????????????????????

  • ??????PCA?t-SNE??????????????
  • ????????L1/L2????????????????????
  • ????????????????????????????????????????
  • ???????????????????????????????????????????????????????????????


    ????????

    ??????????????????????????????????

    ????????????????????

    ???????????

  • ?????N-gram???

    • ???????????????????
    • N-gram??????????n-gram???
  • ??????Latent Dirichlet Allocation?LDA??????-?????????????

  • ????????????Word2Vec?GloVe?BERT???????????????

  • ?????????

    • ????????????????
    • LDA??????????????????
    • Word2Vec?BERT???????????????????????

    ??Word2Vec

    Word2Vec????2013????????????????????????

    Word2Vec?????????LDA?????????

    Word2Vec?????????????????CBOW?Skip-gram?????

    • CBOW????????????
    • Skip-gram????????????

    ???????????????????????CBOW????????????Skip-gram????????????

    ?LDA???Word2Vec????????????LDA???????????????????????????


    ??????????????

    ????????????????????????

    ??????????????????????????????????????

    ????????????????????????????

  • ???????L1/L2?????????????????
  • ????????????????????????????????
  • ?????????????????????????
  • ??????GAN???????????????????
  • ???????????????????????????????????????????????????????


    ??

    ???????????????????????????????????????????????????????????????????????????????????????????????????????????????????????????????

    转载地址:http://avpq.baihongyu.com/

    你可能感兴趣的文章
    pandas 将通话数据分割为15分钟的间隔
    查看>>
    pandas 找到局部最大值和最小值
    查看>>
    Pandas 按年份分组,按销售列排名,在具有重复数据的数据框中
    查看>>
    pandas 按日期和年份分组,并汇总金额
    查看>>
    pandas 数据帧到PostgreSQL表中使用的是没有SQLAlChemy的心理复制2吗?
    查看>>
    pandas 数据帧多行查询
    查看>>
    Pandas 数据框:使用线性插值重新采样
    查看>>
    pandas 数据框将 INT64 列转换为布尔值
    查看>>
    pandas 数据框将列类型转换为字符串或分类
    查看>>
    pandas 数据框条件 .mean() 取决于特定列中的值
    查看>>
    pandas 数据框至海运分组条形图
    查看>>
    Pandas 数据透视表:列顺序和小计
    查看>>
    pandas 时序统计的高级用法!
    查看>>
    pandas 时间序列重新采样结束给定的一天
    查看>>
    pandas 根据不是常量的第三列的值将值从一列复制到另一列
    查看>>
    pandas 根据值从多列中的一列查找
    查看>>
    Pandas 根据布尔条件选择行和列
    查看>>
    pandas 滚动窗口 - datetime64[ns] 未实现
    查看>>
    pandas 版本兼容特定的蟒蛇和NumPy配置吗?
    查看>>
    pandas 生成excel多级表头
    查看>>