本研究探索基于聚类的网络新闻热点发现方法,通过结合层次聚类、K-means聚类和增量聚类算法,实现对大规模网络新闻数据中热点事件的快速准确发现。研究首先使用层次聚类对每天的新闻网页进行微类划分,接着通过K-means聚类对每月的微类进行进一步聚类,最后利用增量聚类算法对每年的事件进行整合,得出一年的热点新闻事件。系统流程包括新闻网页预处理、聚类算法设计和热点计算公式设计。实验表明,结合多种聚类算法的热点发现方法能够满足人们对网络新闻热点事件快速准确发现的需求。