目录

Mini Text Stats:英文词频统计小工具

一个使用 Python 标准库编写的小型开源示例项目。输入一段英文文本或 UTF-8 文本文件,统计英文单词出现次数,按频次从高到低排序;同频次时按字母顺序排列。不依赖任何第三方库。

运行环境

Python 3.9 或更新版本。

快速运行

在项目根目录运行:

python main.py --text "Open source makes software open. Open source is useful." --top 5

预期输出:

单词    次数
open    3
source  2
is      1
makes   1
software 1

也可以从文本文件读取:

python main.py --file example.txt --top 10

注意:这个示例只统计英文单词,不进行中文分词。

测试

python -m unittest discover -s tests -v

许可证(License)

本项目使用 MIT License,许可证全文见根目录 LICENSE 文件。

选择理由:项目规模小且代码完全独立编写,希望老师、同学和其他开发者能方便地学习、复制、修改与复用;MIT 允许商业和非商业使用,也允许修改后采用其他许可证分发,但再分发时须保留原版权声明和许可证文本。MIT 同时提供“按现状提供、不作保证”的免责声明。

版权声明:Copyright (c) 2026 Liu Xuyue。上传前请确认版权人姓名与你自己的实际情况一致。

关于

用于开源课程作业2

32.0 KB
邀请码
    Gitlink(确实开源)
  • 加入我们
  • 官网邮箱:gitlink@ccf.org.cn
  • QQ群
  • QQ群
  • 公众号
  • 公众号

版权所有:中国计算机学会技术支持:开源发展技术委员会
京ICP备13000930号-9 京公网安备 11010802047560号