{
  "schemaVersion": 1,
  "id": "2.1.1",
  "title": "智慧交通中燃油效率模型的数据清洗和标注流程设计",
  "durationMinutes": 20,
  "category": "数据清洗与标注",
  "scenario": "在现代交通中，燃油效率（MPG）是衡量汽车性能和交通系统优化的重要指标之一。高效的燃油利用不仅能够降低车辆运营成本，还能减少碳排放，促进环保。开发一个用于预测汽车燃油效率的模型可以帮助智慧交通系统优化路线规划和车辆调度，从而提升整体交通效率和减少能源消耗。此外，这样的模型还可以帮助消费者做出更明智的购车决策，并帮助厂商优化汽车设计。\n\n现要求根据提供的汽车燃油效率数据集，补全2.1.1.ipynb代码。选择合适的特征，开发一个燃油效率预测模型。在开发预测模型之前，首先要对数据进行数据清洗和标注，请完成下面的数据预处理任务，并设计一套标注流程规范：\n\n(1)正确加载数据集，并显示前五行的数据及数据类型。\n\n(2)检查数据集中的缺失值并删除缺失值所在的行。\n\n(3)将“horsepower”列转换为数值类型，并处理转换中的异常值。\n\n(4)对数值型数据进行标准化处理，确保数据在同一量纲下进行分析。\n\n(5)根据业务需求和数据特性，选择对燃油效率预测最有用的特征：选择以下特征：'cylinders'、'displacement'、'horsepower'、'weight'、'acceleration'、'model year'、'origin'\n\n(6)将“mpg”设为目标变量并标注；\n\n(7)对数据进行标注和划分；\n\n(8)保存处理后的数据，并命名为：2.1.1_cleaned_data.csv，保存到考生文件夹；\n\n(9)制定数据清洗和标注规范，将答案写到答题卷文件中，答题卷文件命名为“2.1.1.docx”，保存到考生文件夹；\n\n(10)将以上代码以及运行结果，以html格式保存并命名为2.1.1.html，保存到考生文件夹，考生文件夹命名为“准考证号+身份证后6位”。",
  "skillRequirements": "（1）能够结合人工智能技术要求和业务特征，设计数据清洗和标注流程；\n\n（2）能够结合人工智能技术要求和业务特征，制定数据清洗和标注规范。",
  "qualityIndicators": "（1）深入理解业务，训练符合业务需求的模",
  "tasks": [
    {
      "id": "code-fill",
      "type": "code-fill",
      "title": "补全代码任务",
      "instructions": "依据公开题面和附件补全代码空位；仅检查完成度与提交格式，不公开标准内容。",
      "codeBlocks": [
        "import pandas as pd\n\n# 加载数据集并显示数据集的前五行 1分\ndata = __________\nprint(\"数据集的前五行:\")\nprint(__________)\n\n# 显示每一列的数据类型\nprint(data.dtypes)\n\n# 检查缺失值并删除缺失值所在的行  2分\nprint(\"\\n检查缺失值:\")\nprint(__________.__________.__________)  \ndata = __________\n\n# 将 'horsepower' 列转换为数值类型，并（删除）处理转换中的异常值 1分\ndata['horsepower'] = __________(data['horsepower'], errors='coerce')\ndata = __________\n\n# 显示每一列的数据类型\nprint(data.horsepower.dtypes)\n\n# 检查清洗后的缺失值\nprint(\"\\n检查清洗后的缺失值:\")\nprint(data.isnull().sum())\n\nfrom sklearn.preprocessing import StandardScaler\n# 对数值型数据进行标准化处理 1分\nnumerical_features = ['displacement', 'horsepower', 'weight', 'acceleration']\nscaler = StandardScaler()\ndata[numerical_features] = __________\n\nfrom sklearn.model_selection import train_test_split\n# 选择特征、自变量和目标变量 2分\nselected_features = __________\nX = __________\ny = __________\n\n# 划分数据集为训练集和测试集（训练集占8成） 1分\nX_train, X_test, y_train, y_test = __________(__________, random_state=42)\n\n\n# 将特征和目标变量合并到一个数据框中\ncleaned_data = X.copy()\ncleaned_data['mpg'] = y\n\n# 保存清洗和处理后的数据（不存储额外的索引号） 1分\n__________('2.1.1_cleaned_data.csv', __________)\n\n# 打印消息指示文件已保存\nprint(\"\\n清洗后的数据已保存到 2.1.1_cleaned_data.csv\")",
        ""
      ],
      "blanks": [
        {
          "id": "blank-1",
          "block": 1,
          "placeholder": "__________",
          "gradingMode": "completion-and-format-only"
        },
        {
          "id": "blank-2",
          "block": 1,
          "placeholder": "__________",
          "gradingMode": "completion-and-format-only"
        },
        {
          "id": "blank-3",
          "block": 1,
          "placeholder": "__________",
          "gradingMode": "completion-and-format-only"
        },
        {
          "id": "blank-4",
          "block": 1,
          "placeholder": "__________",
          "gradingMode": "completion-and-format-only"
        },
        {
          "id": "blank-5",
          "block": 1,
          "placeholder": "__________",
          "gradingMode": "completion-and-format-only"
        },
        {
          "id": "blank-6",
          "block": 1,
          "placeholder": "__________",
          "gradingMode": "completion-and-format-only"
        },
        {
          "id": "blank-7",
          "block": 1,
          "placeholder": "__________",
          "gradingMode": "completion-and-format-only"
        },
        {
          "id": "blank-8",
          "block": 1,
          "placeholder": "__________",
          "gradingMode": "completion-and-format-only"
        },
        {
          "id": "blank-9",
          "block": 1,
          "placeholder": "__________",
          "gradingMode": "completion-and-format-only"
        },
        {
          "id": "blank-10",
          "block": 1,
          "placeholder": "__________",
          "gradingMode": "completion-and-format-only"
        },
        {
          "id": "blank-11",
          "block": 1,
          "placeholder": "__________",
          "gradingMode": "completion-and-format-only"
        },
        {
          "id": "blank-12",
          "block": 1,
          "placeholder": "__________",
          "gradingMode": "completion-and-format-only"
        },
        {
          "id": "blank-13",
          "block": 1,
          "placeholder": "__________",
          "gradingMode": "completion-and-format-only"
        },
        {
          "id": "blank-14",
          "block": 1,
          "placeholder": "__________",
          "gradingMode": "completion-and-format-only"
        },
        {
          "id": "blank-15",
          "block": 1,
          "placeholder": "__________",
          "gradingMode": "completion-and-format-only"
        },
        {
          "id": "blank-16",
          "block": 1,
          "placeholder": "__________",
          "gradingMode": "completion-and-format-only"
        }
      ]
    },
    {
      "id": "2-1-response",
      "type": "rubric-response",
      "title": "清洗与标注说明",
      "instructions": "说明清洗、标注、复核及输出质量。",
      "sections": [
        {
          "id": "response",
          "label": "作答内容"
        }
      ],
      "rubric": [
        {
          "id": "criterion-1",
          "label": "缺失、重复和异常处理合理",
          "weight": 25
        },
        {
          "id": "criterion-2",
          "label": "标注规则一致且可追溯",
          "weight": 25
        },
        {
          "id": "criterion-3",
          "label": "包含抽检或质量复核机制",
          "weight": 25
        },
        {
          "id": "criterion-4",
          "label": "输出满足题面质量指标",
          "weight": 25
        }
      ]
    },
    {
      "id": "artifact-submission",
      "type": "artifact-submission",
      "title": "选择结果文件",
      "instructions": "文件仅在本机选择并校验，不上传，也不持久化文件内容。",
      "items": [
        {
          "id": "artifact-1",
          "label": "提交文件：2.1.1_cleaned_data.csv",
          "filename": "2.1.1_cleaned_data.csv",
          "extensions": [
            ".csv"
          ],
          "minCount": 1,
          "maxCount": 1,
          "maxSize": 104857600
        },
        {
          "id": "artifact-2",
          "label": "提交文件：2.1.1.docx",
          "filename": "2.1.1.docx",
          "extensions": [
            ".docx"
          ],
          "minCount": 1,
          "maxCount": 1,
          "maxSize": 104857600
        },
        {
          "id": "artifact-3",
          "label": "提交文件：2.1.1.html",
          "filename": "2.1.1.html",
          "extensions": [
            ".html"
          ],
          "minCount": 1,
          "maxCount": 1,
          "maxSize": 104857600
        }
      ]
    }
  ],
  "attachments": [
    {
      "name": "2.1.1.docx",
      "url": "assets/2.1.1/2.1.1.docx",
      "size": 14681,
      "sha256": "91b98647dc3f19025b794f57484c8058c8d02ff6f9b9936b18ce4d9303f49515",
      "mime": "application/vnd.openxmlformats-officedocument.wordprocessingml.document"
    },
    {
      "name": "2.1.1.ipynb",
      "url": "assets/2.1.1/2.1.1.ipynb",
      "size": 2808,
      "sha256": "c9de87137eeaa0ce7bedfca14722b1f251dc8b759a6a9d51efb94b72d30af60c",
      "mime": "application/x-ipynb+json"
    },
    {
      "name": "2.1.1.md",
      "url": "assets/2.1.1/2.1.1.md",
      "size": 2447,
      "sha256": "1b718d31a3ed8b66c1ded6f8be8c2b66230d08c6cd73b25a6e79094aacfd1c72",
      "mime": "text/markdown"
    },
    {
      "name": "auto-mpg.csv",
      "url": "assets/2.1.1/auto-mpg.csv",
      "size": 18108,
      "sha256": "6fc0f7dcca8ffdae68e2592993e8dd8883e9e52627affdb7532f69e4b54a8ad4",
      "mime": "text/csv"
    }
  ],
  "grading": {
    "mode": "completion-and-format-only"
  },
  "review": {
    "status": "approved",
    "notice": "由公开题面通用生成，未使用答案树。",
    "conflicts": []
  },
  "contentVersion": "361b8e8f7e2ef95f"
}
