MySQL如何查看数据库占用的磁盘空间大小?

作者:袖梨 2026-07-13
information_schema.TABLES 是唯一能从 SQL 层聚合数据库逻辑空间的来源,但仅估算数据+索引字节数,不含日志、碎片等;真实磁盘占用须用 du 命令查看。

information_schema.TABLES 是唯一能从 SQL 层聚合出数据库逻辑空间的来源,但它的结果不是磁盘真实占用——只反映数据+索引的估算字节数,不含日志、碎片、临时文件等。真要查磁盘用了多少,必须结合系统命令。

查指定数据库的逻辑总大小(SQL 层)

SUM() 聚合当前库所有表的 DATA_LENGTHINDEX_LENGTH,再转为 MB:

SELECT   TABLE_SCHEMA AS '数据库名',  CONCAT(ROUND(SUM(DATA_LENGTH + INDEX_LENGTH) / 1024 / 1024, 2), ' MB') AS '总大小',  CONCAT(ROUND(SUM(DATA_LENGTH) / 1024 / 1024, 2), ' MB') AS '数据大小',  CONCAT(ROUND(SUM(INDEX_LENGTH) / 1024 / 1024, 2), ' MB') AS '索引大小'FROM information_schema.TABLES WHERE TABLE_SCHEMA = 'your_db_name'  AND TABLE_TYPE = 'BASE TABLE'  AND ENGINE IS NOT NULLGROUP BY TABLE_SCHEMA;
  • 必须加 TABLE_TYPE = 'BASE TABLE':否则会混入视图、系统表,导致统计偏高或权限报错
  • ENGINE IS NOT NULL 过滤掉 MEMORYCSV 等无持久化存储的引擎,它们的 DATA_LENGTH 恒为 0
  • 别漏 WHERE TABLE_SCHEMA = 'your_db_name':不加就查全实例,结果冗长且可能越权
  • 这个值是 InnoDB 的页级估算,大量 DELETE 后没 OPTIMIZE TABLEDATA_LENGTH 可能变小但磁盘不释放

查整个 MySQL 实例各库的逻辑大小排序

适合快速定位哪个库“看起来”最大,用于初步排查:

SELECT   TABLE_SCHEMA AS '数据库名',  CONCAT(ROUND(SUM(DATA_LENGTH + INDEX_LENGTH) / 1024 / 1024, 2), ' MB') AS '总大小'FROM information_schema.TABLES WHERE TABLE_SCHEMA NOT IN ('mysql', 'information_schema', 'performance_schema', 'sys')  AND TABLE_TYPE = 'BASE TABLE'  AND ENGINE IS NOT NULLGROUP BY TABLE_SCHEMAORDER BY SUM(DATA_LENGTH + INDEX_LENGTH) DESC;
  • 排除系统库是硬性要求,否则 mysql 库里某些内部表会拉高数值
  • 结果仍是逻辑估算,比如 innodb_file_per_table = OFF 时,所有表共享 ibdata1,这里算出来的和物理文件大小完全对不上
  • 如果某库返回空行,说明它没有 InnoDB 表,或者当前用户没权限读取该库的 information_schema.TABLES

验证真实磁盘占用必须用 du

information_schema 的值不能代替磁盘用量报告。真实空间包含:ibdata1ibtmp1ib_logfile*、binlog、slow log、临时文件(若 tmpdir 指向数据目录)——这些全都不在 TABLES 里。

  • 查整个 MySQL 数据目录:运行 du -sh /var/lib/mysql(Linux 默认路径)
  • 查单个库的物理目录:如数据库叫 myapp,执行 du -sh /var/lib/mysql/myapp,注意这和 TABLE_SCHEMA 名一致,但目录结构受 lower_case_table_names 影响
  • 找最大文件:用 ls -lSh /var/lib/mysql | head -10,重点看 ibdata1ibtmp1mysql-bin.* 是否异常膨胀
  • 误删 ibdata1ib_logfile* 会导致 MySQL 启动失败,它们不是普通表文件

为什么不能只信 DATA_LENGTH

很多人只取 DATA_LENGTH 就当“表大小”,其实它只是聚簇索引中有效数据的近似字节数,完全不含二级索引、B+ 树非叶子节点、全文索引——这部分全在 INDEX_LENGTH 里。漏掉它,低估幅度常达 30%–200%。

  • DATA_LENGTH + INDEX_LENGTH 才是逻辑上“数据+索引”的总和,单位字节
  • DATA_FREEinnodb_file_per_table = OFF(共享表空间)下必须计入,独立表空间可忽略
  • TABLE_ROWS 是采样估算,InnoDB 下偏差极大,别用它反推大小
  • 压缩表(ROW_FORMAT=COMPRESSED)的 DATA_LENGTH 是解压后估算值,和磁盘实际占用偏差更大
真实磁盘占用永远大于 information_schema.TABLES 聚合值,差多少取决于日志量、碎片、临时操作频率——这些无法从 SQL 层感知,只能靠 duls 看见。

相关文章

精彩推荐