风雨雾凇 风雨雾凇
首页
  • 服务端

    • golang
  • 其他

    • leetcode
  • 学习
  • 面试
  • 心情杂货
  • 实用技巧
  • 友情链接
关于
收藏
  • 分类
  • 标签
  • 归档
GitHub (opens new window)

风雨雾凇

技术小渣渣
首页
  • 服务端

    • golang
  • 其他

    • leetcode
  • 学习
  • 面试
  • 心情杂货
  • 实用技巧
  • 友情链接
关于
收藏
  • 分类
  • 标签
  • 归档
GitHub (opens new window)
  • golang

  • 技术文档

  • GitHub技巧

  • Nodejs

  • 博客搭建

  • leetcode

  • 机器学习

    • 机器学习入门(1)-pandas库的使用
    • 机器学习入门(2)-机器学习主要术语
      • 机器学习入门(3)-线性回归&训练与损失
      • 机器学习入门(4)-降低损失
    • 技术
    • 机器学习
    风雨雾凇
    2018-12-14
    目录

    机器学习入门(2)-机器学习主要术语

    # 监督式机器学习

    机器学习系统通过学习如何组合输入信息来对从未见过的数据做出有用的预测。

    # 标签

    标签是要预测的事物,即线性回归中的 y 变量。例如未来某个股票的涨跌,图片的动物品种。

    简单的说即你想要机器预测的内容。

    # 特征

    特征是输入变量,即简单线性回归中的 x 变量。简单的机器学习项目可能会使用单个特征,而比较复杂的机器学习项目可能会使用数百万个特征,按如下方式指定: $$ { x_1, x_2, ... x_n } $$ 举例在识别垃圾邮件的时候,特征变量可能是:

    • 电子邮件的内容
    • 发件人地址
    • 发件时段
    • 标志词

    等等...

    # 样本

    样本是指数据的特定实例:x。(我们采用粗体 x 表示它是一个矢量。)我们将样本分为以下两类:

    • 有标签样本
    • 无标签样本

    有标签样本即同时包含标签和特征。即:

    labeled examples: {features, label}: (x, y)
    
    1

    我们使用有标签样本来训练模型。

    无标签样本即只包含特征,没有具体标签的样本,我们需要使用训练好的模型来预测该样本的特征。

    举例在识别垃圾邮件中, 我们明确知道是垃圾邮件或正常邮件的为有标签样本,不知道的为无标签样本。

    # 模型

    模型定义了特征与标签之间的关系。例如,垃圾邮件检测模型可能会将某些特征与“垃圾邮件”紧密联系起来。我们来重点介绍一下模型生命周期的两个阶段:

    • 训练表示创建或学习模型。也就是说,您向模型展示有标签样本,让模型逐渐学习特征与标签之间的关系。
    • 推断表示将训练后的模型应用于无标签样本。也就是说,您使用训练后的模型来做出有用的预测 (y')。例如,在推断期间,您可以针对新的无标签样本预测其标签。

    # 回归与分类

    回归模型可预测连续值。例如,回归模型做出的预测可回答的问题如下:

    • 加利福尼亚州一栋房产的价值是多少?
    • 用户点击此广告的概率是多少?

    回归模型可以回答确切数值

    分类模型可预测离散值。例如分类模型做出的预测可回答:

    • 某个指定电子邮件是垃圾邮件还是非垃圾邮件?
    • 这是一张狗、猫还是仓鼠图片?

    分类模型可以回答二分问题

    编辑 (opens new window)
    #术语#机器学习#学习笔记
    上次更新: 2023/02/17, 16:53:03
    机器学习入门(1)-pandas库的使用
    机器学习入门(3)-线性回归&训练与损失

    ← 机器学习入门(1)-pandas库的使用 机器学习入门(3)-线性回归&训练与损失→

    最近更新
    01
    builtin
    02-12
    02
    导读
    02-12
    03
    13-罗马数字转整数
    01-30
    更多文章>
    Theme by Vdoing | Copyright © 2017-2023 风雨雾凇 | 粤ICP备16018321号-2
    博客内容遵循署名-非商业性使用-相同方式共享 4.0 国际 (CC BY-NC-SA 4.0) 协议
    • 跟随系统
    • 浅色模式
    • 深色模式
    • 阅读模式