{
 "cells": [
  {
   "cell_type": "code",
   "execution_count": null,
   "id": "2f22cc8f",
   "metadata": {
    "vscode": {
     "languageId": "plaintext"
    }
   },
   "outputs": [],
   "source": [
    "import pandas as pd\n",
    "import numpy as np\n",
    "\n",
    "# 读取数据集 1分\n",
    "data = ______________________________"
   ]
  },
  {
   "cell_type": "code",
   "execution_count": null,
   "id": "c911cb09",
   "metadata": {
    "vscode": {
     "languageId": "plaintext"
    }
   },
   "outputs": [],
   "source": [
    "# 1. 统计住院天数超过7天的患者数量及其占比\n",
    "# 创建新列'RiskLevel'，根据住院天数判断风险等级 3分\n",
    "_____________ = _____________(_____________, '高风险患者', '低风险患者')\n",
    "# 统计不同风险等级的患者数量 2分\n",
    "risk_counts = data_____________._____________\n",
    "# 计算高风险患者占比 1分\n",
    "high_risk_ratio = risk_counts['高风险患者'] / _____________\n",
    "# 计算低风险患者占比 1分\n",
    "low_risk_ratio = risk_counts['低风险患者'] / _____________\n",
    "\n",
    "# 输出结果\n",
    "print(\"高风险患者数量:\", risk_counts['高风险患者'])\n",
    "print(\"低风险患者数量:\", risk_counts['低风险患者'])\n",
    "print(\"高风险患者占比:\", high_risk_ratio)\n",
    "print(\"低风险患者占比:\", low_risk_ratio)"
   ]
  },
  {
   "cell_type": "code",
   "execution_count": null,
   "id": "60069bb0",
   "metadata": {},
   "outputs": [],
   "source": [
    "# 2. 统计不同BMI区间中高风险患者的比例和统计不同BMI区间中的患者数\n",
    "# 定义BMI区间和标签\n",
    "bmi_bins = [0, 18.5, 24, 28, np.inf]\n",
    "bmi_labels = ['偏瘦', '正常', '超重', '肥胖']\n",
    "# 根据BMI值划分指定区间 4分\n",
    "data['BMIRange'] = _____________(_____________, _____________, _____________, right=False)  # 使用左闭右开区间\n",
    "# 计算每个BMI区间中高风险患者的比例 2分\n",
    "bmi_risk_rate = _____________(_____________)['RiskLevel'].apply(lambda x: (x == '高风险患者').mean())\n",
    "# 统计每个BMI区间的患者数量 1分\n",
    "bmi_patient_count = data_____________\n",
    "\n",
    "# 输出结果\n",
    "print(\"BMI区间中高风险患者的比例和患者数:\")\n",
    "print(bmi_risk_rate) \n",
    "print(bmi_patient_count)"
   ]
  },
  {
   "cell_type": "code",
   "execution_count": null,
   "id": "b74be779",
   "metadata": {},
   "outputs": [],
   "source": [
    "# 3. 统计不同年龄区间中高风险患者的比例和统计不同年龄区间中的患者数\n",
    "# 定义年龄区间和标签\n",
    "age_bins = [0, 26, 36, 46, 56, 66, np.inf]\n",
    "age_labels = ['≤25岁', '26-35岁', '36-45岁', '46-55岁', '56-65岁', '＞65岁']\n",
    "# 根据年龄值划分指定区间 4分\n",
    "data['AgeRange'] = _____________(_____________, _____________, _____________, right=False)  # 使用左闭右开区间\n",
    "# 计算每个年龄区间中高风险患者的比例 2分\n",
    "age_risk_rate = _____________(_____________)['RiskLevel'].apply(lambda x: (x == '高风险患者').mean())\n",
    "# 统计每个年龄区间的患者数量 1分\n",
    "age_patient_count = data_____________\n",
    "\n",
    "# 输出结果\n",
    "print(\"年龄区间中高风险患者的比例和患者数:\")\n",
    "print(age_risk_rate) \n",
    "print(age_patient_count) "
   ]
  }
 ],
 "metadata": {
  "language_info": {
   "name": "python"
  }
 },
 "nbformat": 4,
 "nbformat_minor": 5
}
