利用Python读取文件独特行数

文件独特行数指的是文件中不重复的行的数量。统计文件独特行数是一个常见的需求,尤其是在处理日志文件、数据集或文本文件时。

以下是使用 Python 实现统计文件独特行数的方法:


方法 1:使用集合(Set)

集合(Set)是一种无序且不重复的数据结构,非常适合用来统计独特行数。

代码实现
def count_unique_lines(file_path):
    unique_lines = set()  # 用集合存储独特行
    with open(file_path, 'r', encoding='utf-8') as f:
        for line in f:
            unique_lines.add(line.strip())  # 去除换行符并添加到集合
    return len(unique_lines)  # 返回独特行数

# 示例调用
file_path = 'example.txt'
unique_count = count_unique_lines(file_path)
print(f"文件 '{file_path}' 中的独特行数为: {unique_count}")
优点
  • 代码简洁,易于理解。

  • 集合自动去重,无需额外处理。

缺点
  • 如果文件非常大,集合可能会占用较多内存。

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

甯公子_

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值