一种简单的文本聚类算法：single-pass

2020-04-28 15:12:08 數據科學漫遊

0引言

在生活里，我们经常需要将一些物品按类别存放。比如，我们需要把所有的袜子集合起来，放在一个抽屉里；把所有的拖鞋集合起来，放在鞋架上；等等。

类似的，数据类业务里，经常需要将样本按照类别聚合，然后以类别为单位对数据进行处理或使用。例如，我们可以训练一个KNN,对文档的主题类别进行判断，这样所有的文档就带有的主题标签，在搜索或者推荐的时候就可以基于主题标签对搜索结果进行某种过滤。当然了，这个方案要求我们定义一下主题的类别体系，还需要收集一定量的有标签数据(通常来说，这就是要标注数据了)。

当我们的聚合粒度比较小，到了“事件”这么小，人工定义分类体系就不现实了。一般我们采用聚类算法来实现较小粒度的文档聚合。

最有名的聚类算法应该是k-means了。这个算法思想简单直观，效果还不错，大家因此比较喜欢。实际上，还有一些比k-means更简单的聚类算法，比如single-pass。

1 single-pass简介

Single-pass就像它的名字一样，直白简洁。

1.1 single-pass的工作流程

如图1-1，我在遍历文本。一开始的时候，一个簇都没有。

图1-1 混沌未开，没有簇

然后，我遍历到了第1篇文档。通过考察1号文档与所有簇的匹配度，发现没有足够匹配的。因此，我认为1号文档表述了一个独特的主题，就以1号文档为核心定义了一个新的簇，如图1-2。

图1-2 混沌初开，有一个簇

接下来遍历到了第2篇文档，它和1号簇(的核心文档)非常匹配，我认为它俩描述了同一个主题，因此把2号文档添加到了1号簇中。

然后是3号文档。它和所有的簇都不够匹配，描述了一个新的主题。因此，我以3号文档为核心定义了一个新的簇，如图1-3。

重复图1-2和1-3的操作，直到遍历完毕，我们会得到若干簇。分析一下每个簇内文档的内容，就可以给它们各自添加一些标题、标签之类的描述——这就算完成无监督的聚合了。

图1-3 定义一个新的簇

1.2 single-pass的关键组件

1.2.1一个簇的结构与创建条件

在single-pass中，一个簇有两个必备组成部分：（1）簇成员;（2）簇核心。

簇成员指的是构成一个簇的所有文档。聚类任务的结果，就是将原始数据集划分为若干小集合——这些小集合内部有一定的相似性，就是常说的“簇”。“簇”是从“cluster”翻译过来的一个词语，本意是“聚集的团或堆”。

簇核心是我们对一个簇的简要表示。最简单情况下，我们会以第一个进入这个簇的文档作为簇核心。如图1-1，混沌未开的时候，1号文档由于找不到匹配的簇，只好自立门户、建立一个新的簇，并自荐为这个簇的核心。

簇核心是用来干什么的呢？“匹配”是什么呢？

1.2.2“匹配”与否的判断——文本相似度和阈值

当一篇文档内容与某个簇的内容足够接近或者相关(比较多的情况是相似)，我们称这篇文档和该簇匹配。为什么这里要强调“匹配”呢？首先，文档和簇不是一个维度的概念，前者是一篇文档，而后者是若干文档的集合；其次，我们有时候会用相似度计算之外的算法来判断，一篇文档是否应该加入一个簇，比如用分类算法如图1-2，当遍历到2号文档的时候，我需要判断已有簇中，有没有和2号文档“匹配”的。

具体计算方式就是，直接计算所有簇的核心与2号文档的匹配度(这里是相似度)，然后将2号文档添加到相似度高于阈值的簇中——为了简单，这里规定一篇文档只能属于一个簇，因此在发现第一个匹配的簇时，就可以停止计算了。

1.2.3计算复杂度分析

我们来捋一下原始版single-pass的计算时间复杂度。为了简单，这里定义，一次文本相似度计算的代价是1；其他的都是毛毛雨啦。

极端悲观情况下，每一篇文档都特立独行、各自成簇：（1）1号文档不需要计算相似度，当前簇个数是1；（2）2号文档需要和一个簇计算相似度，当前簇个数是2；（3）3号文档需要和2个簇计算相似度，当前簇个数是3；…;N号文档需要和N-1个簇计算相似度。用高斯小朋友的算法可以快速算出，我们需要进行的相似度计算次数是:

计算时间复杂度是O(N方)。假设一次相似度计算耗时0.001秒，当输入是1万篇文档的时候，聚类任务的总耗时就是10万秒，也就是超过一天。这时候，老板的脸色就如图1-4。为了大家的饭碗，我们要想办法让聚类任务算的快一点。

1-4 等你算出来，公司就黄了

1.3 single-pass文本聚类的python实现

<code>'''
Created on 2019年11月9日 

@author: Administrator
'''
from pyhanlp import HanLP
HanLP.Config.ShowTermNature = False

class Document():

    def __init__(self, doc_id, content, features):
        self.doc_id = doc_id
        self.features = features#文本的特征，这里是分词结果
        self.content = content#原文
       

class Cluster():

    def __init__(self, cluster_id, center_doc_id):
        self.cluster_id = cluster_id#簇的id，用来从map中获取这个簇的信息
        self.center_doc_id = center_doc_id#核心文档的id，用来从map红获取这个文档的信息。为了减少文档信息的备份数量，簇里只存储这个
        self.members = [center_doc_id]#簇成员的id列表。由于只遍历一遍(这是single-pass的核心竞争力之一)，不存在重复的可能，这里使用list

    def add_doc(self, doc_id):
        self.members.append(doc_id)


#一个简单的single-pass文本聚类算法
class SimpleSinglePass():

    def __init__(self):

        self.document_map = {}#存储文档信息，id-content结构。当然value也可以使用对象存储文档的其他信息。
        self.cluster_list = []#存储簇的信息，id-cluster_object结构。

    #提取文本特征
    def get_words(self, text): 

        words = HanLP.segment(text)
        words = list(map(str, words))
        return words

    #输入文档列表，进行聚类。现实中，我们遇到的文档会带有id等信息，这里为了简单，只有文本内容，所以需要生成id,一遍存取。
    def fit(self, document_list):
        #对文档进行预处理
        self.preprocess(document_list)
        self.clutering()

    def similar(self, cluster, document):
        cluster_feature = set(self.document_map[cluster.center_doc_id].features)
        document_feature = set(document.features)
#         print(cluster_feature, document_feature)
        similarity = len(cluster_feature & document_feature) / len(cluster_feature | document_feature)
        if similarity > 0.2:
            return True
        else:
            return False

    def clutering(self):
        for doc_id in self.document_map:
#             print(doc_id, self.document_map[doc_id])
            if_特立独行 =  True
            for cluster in self.cluster_list:
                if self.similar(cluster, self.document_map[doc_id]):
                    cluster.add_doc(doc_id)
                    if_特立独行 = False
                    break
            if if_特立独行:
                new_cluser_id = "cluster_" + str(len(self.cluster_list))
                print(new_cluser_id)
                new_cluster = Cluster(new_cluser_id, doc_id)
                self.cluster_list.append(new_cluster)

    #对所有文档分词，并生成id
    def preprocess(self, document_list):
        for i in range(len(document_list)):
            doc_id = "document_" + str(i)
            content = document_list[i]
            words = self.get_words(content)
            document = Document(doc_id, content, words) 

            self.document_map[doc_id] = document

    #打印所有簇的简要内容
    def show_clusters(self):
        for cluster in self.cluster_list:
            print(cluster.cluster_id, cluster.center_doc_id, cluster.members)

if __name__ == '__main__':
    docs = ["我爱北京天安门，天安门上太阳升。",
            "我要开着火车去北京，看天安门升旗。",
            "我们的家乡，在希望的田野上。",
            "我的老家是一片充满希望的田野。"]
    single_passor = SimpleSinglePass()
    single_passor.fit(docs)
    single_passor.show_clusters()/<code>

2升级single-pass的主要策略

2.1用倒排索引加速聚类

前面的方案中，每遍历到一个文档，我们都需要从所有的簇中找一个匹配的，作为文档的归属。我们可以换一个角度来理解这个操作：从已有簇中，搜索一个与当前文档匹配的簇。

一般来说，在大量数据中搜索时，我们会用倒排索引来提升搜索的效率。

2.1.1倒查索引的构建方式

如果文档A的所有词语，没有出现在文档B中，即A和B的词语列表的交集是空集。如果两篇文档没有一个“共同词语”，真相只有一个，那就是二者的内容完全无关(当然凡事无绝对，总有漏网之鱼)；反过来讲，只有文档B包含A中的某一个词语，B才有可能与A相似，即成为A的候选相似文档。一般来说，文本切分(分词，ngram之类)后得到的特征是比较稀疏的，除了一些高频词，大部分词语只出现在一小部分文档里。“小部分”的意思是比全体文档要小若干数量级。我们只要在这一小部分文档里去找与A相似的。

我们可以用倒查索引来把包含一个词语的所有簇都存储起来，这样，就可以在遍历文档的时候，把一篇文档内词语对应的所有候选匹配簇找出来。接下来，遍历候选簇、找到匹配簇，然后加入它。

这个方案有个隐患：像“的”这样没啥信息量的词语，以及“我”这样的高频词，会出现在几乎每一个文档中。这会导致一些篇文档的候选簇个数接近全体规模。这个系统还需要优化一下。

2.1.2用python实现引入倒排的single-pass

2.2特征工程

2.2.1使用关键词作为为本特征

简单说来，2.1.1说到的“隐患”，是一些低质高频词语出现导致的。自然地，我们可以用停用词过滤、关键词抽取等方法，把词汇表精简一下。这样，每个词语的候选簇数量就可以控制得比较稳定。这时候，大家的饭碗就保住了，如图2-1。

图2-1 姚式表情

2.2.2基于关键词特征的single-pass

<code>import sys, os 
path = os.path.dirname(os.getcwd())
sys.path.append(path)
from single_pass_v1 import SinglePassV1, Cluster, Document

#增加倒排索引
class SinglePassV2(SinglePassV1):
    
    def __init__(self):
        self.document_map = {}#存储文档信息，id-content结构。当然value也可以使用对象存储文档的其他信息。
        self.cluster_map = {}#存储簇的信息，id-cluster_object结构。
        self.cluster_iindex = {}#word-cluster_ids结构

    #对所有文档分词，并生成id
    def preprocess(self, document_list):
        for i in range(len(document_list)):
            doc_id = "document_" + str(i)
            content = document_list[i]
            words = self.get_key_words(content)
            document = Document(doc_id, content, words)
            self.document_map[doc_id] = document
            
    #提取文本特征。这里使用文档内频次最高的K个词语。实际应用中可以用TF-IDF
    def get_key_words(self, text, K=5):
        words = self.get_words(text)
        word_freq = {}
        for word in words:
            word_freq[word] = word_freq.get(word, 0) + 1
        keywords = sorted(word_freq.items(), key=lambda x: x[1],reverse=True)[:K]
        keywords = list(map(lambda x: x[0], keywords))
        return keywords
        
    def clutering(self):
        for doc_id in self.document_map:
#             print(doc_id, self.document_map[doc_id]) 

            words = self.document_map[doc_id].features
            if_特立独行 =  True
            for cluster_id in self.get_cand_clusters(words):
                cluster = self.cluster_map[cluster_id]
                if self.similar(cluster, self.document_map[doc_id]):
                    cluster.add_doc(doc_id)
                    if_特立独行 = False
                    break
            if if_特立独行:
                new_cluser_id = "cluster_" + str(len(self.cluster_map))
                print(new_cluser_id)
                new_cluster = Cluster(new_cluser_id, doc_id)
                self.cluster_map[new_cluser_id] = new_cluster
                
                for word in self.document_map[new_cluster.center_doc_id].features:
                    if word not in self.cluster_iindex: self.cluster_iindex[word] = []
                    self.cluster_iindex[word].append(new_cluser_id)
                    
    def get_cand_clusters(self, words):
        cand_cluster_ids = []
        for word in words:
            cand_cluster_ids.extend(self.cluster_iindex.get(word, []))
        return cand_cluster_ids
        
    #打印所有簇的简要内容
    def show_clusters(self):
        for cluster_id in self.cluster_map:
            cluster = self.cluster_map[cluster_id]
            print(cluster.cluster_id, cluster.center_doc_id, cluster.members)
            
if __name__ == '__main__':
    docs = ["我爱北京天安门，天安门上太阳升。",
            "我要开着火车去北京，看天安门升旗。",
            "我们的家乡，在希望的田野上。",
            "我的老家是一片充满希望的田野。"]
    single_passor = SinglePassV2()
    single_passor.fit(docs)
    single_passor.show_clusters()/<code>

3结语

Single-pass是一个挺不错的聚类算法，我们可以在这个算法的基础上做很多变化，来满足各种各样的需求。

注意：本文为李鹏宇(知乎个人主页https://www.zhihu.com/people/py-li-34)原创作品，受到著作权相关法规的保护。如需引用、转载，请注明来源信息：（1）作者名，即“李鹏宇”；（2）原始网页链接，即https://zhuanlan.zhihu.com/p/91007237。如有疑问，可发邮件至我的邮箱:[email protected]。

分享到:

閱讀更多 數據科學漫遊 的文章

關鍵字: 类别 Python 鞋架

商汤提出基于空间修剪的 NAS 算法

Learning To Rank 算法 RankNet

【算法】排序算法之基数排序

【算法】排序算法之桶排序

【算法】排序算法之计数排序

【算法】排序算法之堆排序

数据结构与算法：算法

【算法】位运算与经典八皇后问题

什么是算力？算法？一文看懂算法学习拓扑图

查找-hash 算法

争取能让大家都能看懂的 DFA 算法

视频分析与对象跟踪-CamShift 算法

史上最全GAN综述2020版：算法、理论及应用

人工智能的灵魂——算法

阿里2020年内部PPT全栈分享：架构、大数据、算法

深入理解 React diff 算法

03.03 史上最全GAN综述2020版：算法、理论及应用

图像分割实战-分水岭分割方法和GrabCut 算法

03.02 分布式系统ID的生成方法之UUID、数据库、算法、Redis、Leaf方案

02.25 《GANs生成式对抗网络综述：算法、理论与应用》最新论文

Python 算法 10 -- 广度优先搜索（BFS）

一文读懂 MD5 算法

Python 算法 09 -- 散列表

Python 算法 08 -- 快速排序

浅显介绍“二进制枚举”算法

分布式系统ID的生成方法之UUID、数据库、算法、Redis、Leaf方案

01.20 Python 算法 08 -- 冒泡排序及其优化

01.17 Python 算法 06 --“又爱又恨”的递归算法

01.16 Python 算法 05 -- 3+4*5-6=？在栈中的调用

Python 算法 01--二分查找

C++基础知识-算法

palindrome(回文)算法

12.07 面试又被问到一致性 Hash 算法？这样回答秒杀面试官

算法--我的红黑树学习过程

用讲故事的办法帮你理解 SMO 算法

漫画说什么是 LRU 算法？

算法--平衡二叉树AVL原理分析以及代码实现

算法-二叉查找树BST

10.12 CPK的“另类”算法

「分布式」看完这个动画秒懂 Raft 算法

贝叶斯个性化排序(BPR)算法

01.10 路径规划之 A* 算法

算法：时间复杂度+二分查找法(Java

算法：加权轮询算法

算法：分治算法

06.29 「算法」如何判断链表有环

06.19 算法——初级排序算法

刚刚工作的毕业生，一个月只有2000多，是不是太少了？

刚刚:刚刚工作的毕业生，一个月只有2000多，是不是太少了？根据你城市消费水平来看啊，还有你从事的工作，假如你在二三线城市做一份事业单位或者是编制类的工作，薪资水平是随着你工作年限逐年增长的，而且在年终也有很多福利补贴待遇等等，算下来收入也是可观的，再举一个例:-毕业生 2000

为什么只有edg赚钱？

电竞行业作为一个新兴产业，这几年发展势头越来越好，IG战队，FPX战队先后夺得了s8-s9世界赛的冠军，据俱乐部知情人士透露，除了国内的几家豪门俱乐部之外，其他俱乐部基本都是亏钱在做的，当然EDG也是:-edg 赚钱:为什么只有edg赚钱？

网上罗马仕充电宝20000毫安的，参数怎么很多样？哪个是真的？

20000:网上罗马仕充电宝20000毫安的，参数怎么很多样？哪个是真的？天猫旗舰店，或者淘宝旗舰店，或者京东旗舰店肯定包真，质量好，再说可以官方验证啊，不能图那十块五块的便宜，毕竟一个充电宝要用好久呢，一两年没问题的。:-罗马仕马仕毫安

我们买的新商品房还没有拿到房产证，怎么转卖最好？

没有取得房抄产证的房子可以转让。但如果确定无法取得房产证的，房产转让不受法律保袭护。一般情况下，只有取得房产证的房屋才能确定房屋产权人，才具有转让的条件。但如果房屋是合法取得的，以百后可以依法办理度房:-转卖房产证商品房拿到:我们买的新商品房还没有拿到房产证，怎么转卖最好？

为什么突厥人可以成功复国？是大唐的刀不锋利了么？

锋利突厥人你这样说只能说明你对历史非常不了解，我先用一句话概括突厥被大唐雄兵打的有多惨：三次灭国，背井离乡，远赴西亚，打不过，俺躲着你还不行吗？突厥的意思是中间怂起的头盔。其来历已经不可靠，可能有着匈奴、鲜卑或:-复国大唐:为什么突厥人可以成功复国？是大唐的刀不锋利了么？

小高层16层高楼间距60米哪一层比较好？

小高层 60:小高层16层高楼间距60米哪一层比较好？首先需要明白，选择层数居住与楼间距毫无关系，住在哪一层，肉眼看对面楼的距离，是相差不大的。设定楼间距60米，纯粹是混淆视听。其实，一幢楼的楼层总数确定的情况下，到底哪一层最佳？很简单，取总层数乘以黄金:-楼间距层高

金银花盆栽好养吗？怎么养？

金银花可以盆栽，很好养的！金银花，是忍冬科的常绿缠绕灌木，枝条柔韧修长，多攀爬或匍匐生长。金银花生性强健，在我国的很多南方省份野外很多地区都能看到它的身影，叶子常年翠绿，到夏季开花，飘香四溢。所以，有:-金银花盆栽:金银花盆栽好养吗？怎么养？

长城对于抵御古代匈奴和蒙古人起到了多大作用？

长城真的无用吗？在今天许多人认为长城无用，古代国家举国之力建造的长城不过只是文物，就连康熙都曾作诗讽刺，原文如下：万里经营到海涯，纷纷调发逐浮夸。当时用尽生民力，天下何曾属尔家。-康熙但真的如此吗？小:-匈奴抵御长城:长城对于抵御古代匈奴和蒙古人起到了多大作用？蒙古人

什么树可以嫁接腊梅？

腊梅只能嫁接在不同品种的腊梅上，其他的树种不行！腊梅的繁殖可以用播种，压条，嫁接，分株等繁殖方法。播种法因不易保持花卉的原有优良特性，且播种的优点是在于大量繁殖，而腊梅大都只需培植少量几株，故一般都不:-腊梅嫁接:什么树可以嫁接腊梅？

行情堪忧，还有多少教育机构的老师们五一假期有课上的？课时量多不多？

堪忧五一假期:行情堪忧，还有多少教育机构的老师们五一假期有课上的？课时量多不多？事实上，因为教育培训都是预收费用的模式。但凡有一点点规模的培训机构老师。在上半年，带课量是可以得到保证。:-课时量

在农村“立夏节”都有哪些民间习俗？

民间习俗农村:在农村“立夏节”都有哪些民间习俗？在农村“立夏节”都有哪些民间习俗一、农村立夏常见的习俗风俗活动：1、吃鸡蛋“立夏吃蛋”习俗由来已久，俗话说“立夏吃了蛋，夏天不疰夏”。据说立夏开始天气越来越热，村里小孩儿会有身体疲劳四肢无力的感觉，吃:-立夏节

男朋友失望分手，但对我还有感觉，答应我两个月之后可以在一起，我应该怎么做，才能改变之前他对我的看法？

失望分手看法:男朋友失望分手，但对我还有感觉，答应我两个月之后可以在一起，我应该怎么做，才能改变之前他对我的看法？你的这个问题特别的有趣，我觉得你先不要看你要怎么做才让他才能让他对你的印象有所改变，你要去看为什么是两个月之后可以在一起，这两个月他会用来做什么，为什么会有这两个月？例如他的身体碰到了什么样的问题吗？:-答应我

工程分包乙方人员伤残谁承担？

承担:工程分包乙方人员伤残谁承担？分包乙方分包致人伤残责任谁承担？严格来说，需要了解更多伤残原因才能区分的，作为非专业人士，自己发表一点浅见供题主参考：1、如果甲方是央企的话，他们合同中的责任、义务等条款内已经将自己的责任全部撇开了，更会:-乙方伤残

有哪些看起来毫不相关的两个历史人物实际上有过联系？

实际上:有哪些看起来毫不相关的两个历史人物实际上有过联系？历史人物联系这个词貌似太宽泛了，就好像有一个调皮的答案说的，胡亥和溥仪相隔2000多年，牵强的找，也有联系：都是亡国之君不是。我想题主的意思是两个看起来应该风马牛不相及的人物，在历史上居然是熟悉或是一个时代的:-毫不相关

13年雪铁龙世嘉自动挡7万多公里，没有水泡事故，多少钱能买？

法系车不保值，如果准备常开可以入手，性价比高，价格应该在二至三万之间，二手车一车一况，一况一价，居体价格看车况。:-钱能水泡:13年雪铁龙世嘉自动挡7万多公里，没有水泡事故，多少钱能买？世嘉自动挡

22+吃土少女17年就有驾驶证了，今年才开始开车，想买个二手昂克赛拉，或者有什么好建议吗？

17年驾驶证二手:22+吃土少女17年就有驾驶证了，今年才开始开车，想买个二手昂克赛拉，或者有什么好建议吗？建议买日系二手车，开顺了卖了，买新车，昂克赛拉无法再次出手时获得好价格，而且也不省油，开完日系车直接换德系:-昂克赛拉

如何骑车去台湾骑行？

骑车在台湾没有回归内地前，最好不要去台湾，一是国内政策不允许你去台湾，因为已停止了台湾个人游。二是你偷着去台湾旅游，安全没有保障，偷渡客在哪里也没有安全保障的。以后内地政策允许个人去台湾旅游了，建议那时再:-骑行台湾:如何骑车去台湾骑行？

本人预算5万左右，想买一辆二手法系车！求推荐？

预算:本人预算5万左右，想买一辆二手法系车！求推荐？ 5万预算5万元左右，想买一辆二手法系车？推荐东风标致老款308车型。1 5万元可以买标致308车况好的，没大事故呢，年限15年左右，公里数3万左右，手动档车型。2 标致308车型，底盘调教扎实，跑高速稳定:-法系二手

14年进口马自达5PK进口10年道奇酷威买哪个划算？

道奇你好，好高兴回答你的问题！14年进口马自达5和10年月道奇酷威个人感觉马自达5比较划算。新车价马5报价29.99万，酷威19.38万两款车都是原装进口，马5属于日系，酷威属于美系。两款车不属于同类车型:-酷威马自达 14年:14年进口马自达5PK进口10年道奇酷威买哪个划算？

2020年，河南教育行业国务院特殊津贴推荐，河南大学并列第三，大家怎么看？

特殊津贴高校人才就要重视，河南省高校人才更要重视，这个人才不是评出了的，而是推荐出来的，没有推荐，连参评的资格都没有。国务院特殊津贴人员推荐，不推荐是百分百没希望，推荐了希望就非常，那么是什么是国务院特殊津贴:-河南大学并列 2020年:2020年，河南教育行业国务院特殊津贴推荐，河南大学并列第三，大家怎么看？

本田CRV2019款1.5T舒适版油耗高吗？

李老猫说车为你非专业解答各种选车用车问题本田crv定位于一款紧凑级suv产品，主要对飚丰田荣放，日产奇骏，这款车整体市场表现非常突出，2019年全年累计销量为18.44万台，平均月销1.5万以上，其深:-舒适版本田油耗:本田CRV2019款1.5T舒适版油耗高吗？

国外疫情如果没有得到有效控制，世界会发生什么事情？头脑风暴？

1.世界经济遭到重创疫情影响之下，各行各业基本属于停工停产的状态，在世界经济趋于一体化的今天，停工停产势必会造成一系列的连锁反应，最后导致的结果可能会引发金融危机。2.世界格局可能发生改变美国仍是世界:-头脑风暴控制:国外疫情如果没有得到有效控制，世界会发生什么事情？头脑风暴？疫情国外

本田XRV这款车的整体表现怎么样？我想买1.5T自动豪华版，全款多少钱？

如果有15万元的预算，让你选择一台空间和动力都很不错的小型SUV，我觉得很多的读者都会想到本田XRV这款车型。因为本田XRV确实太出色了，和同级别的其他盒子SUV车型相比，这款车在空间和动力上都有优势:-xrv 自动:本田XRV这款车的整体表现怎么样？我想买1.5T自动豪华版，全款多少钱？本田豪华版

现在存款有14万，借了5万还没收回来，该做什么好？

何去何从:现在存款有14万，借了5万还没收回来，该做什么好？续租存款利息率较低，可以投资较高收益的项目，比如投资基金，一般情况下可获得6%一10%的回报。如果行情好可达到50%以上收益，去年不少基金超过这目标。目前受疫情影响，股市在低位震荡，也是基金投资的机会。一:-存款 2300

2070super和5700xt买哪个比较好？

如果是玩游戏毫无疑问选择n卡，也就是2070 suep。如果追求性价比可以选择a卡，也就是5700xt. 为什么游戏选n卡呢？首先游戏厂商针对n卡优化比较多，然后就是功耗小，然后N卡架构执行效率极高，:-:2070super和5700xt买哪个比较好？

生完二胎后，感觉自己有点抑郁，总是想发火，特别烦躁，怎么办？

二胎我是两个孩子的妈妈，曾经的我和你一样，生完宝宝我也抑郁了，我知道抑郁症真的很痛苦，产后的那段日子我整天都不开心，做什么事也没积极性，谁也不想搭理，别人给我说话我就觉得很烦。忍不住冲家人发脾气。每当一个:-生完抑郁:生完二胎后，感觉自己有点抑郁，总是想发火，特别烦躁，怎么办？发火

人这一生遇到的人和事为什么感觉都像是必然的经历？

感觉:人这一生遇到的人和事为什么感觉都像是必然的经历？正所谓有因必有果，所以你今天的因，就会产生明天的果。所以这一切你就会觉得是必然的。生活中大部分是普通人大家的生活规律，生活方式，大致相同。当你看到别人家庭的果，自己家也产生同样的果，你就会觉得这一切是:-人和经历

现在校内校外到底教的是美式英语还是英式英语还是混搭英语？

校内:现在校内校外到底教的是美式英语还是英式英语还是混搭英语？校外英式答案肯定是不唯一的！美式英语现在是主流，少量英式发音也个别存在！但对于孩子来说，肯定是混搭英语，因为孩子肯定不是一直一位老师教下去，肯定会换老师！而老师的发音肯定是既有英式的，也有美式的！就连一些英语:-美式英语

上有老下有小，我们真的跳不出这个人生循环了吗？

上有老魔咒:上有老下有小，我们真的跳不出这个人生循环了吗？的确如此，尽管现在不结婚，晚婚的人很多，但是从人类繁洐生息的历史和大多数人来看，成家立业，生儿育女，家庭仍是主流，一个人的生理，心理和生存需求決定了生存状态，生儿育女，瞻养父母即是义务责任，也是生活动:-下有小

如果外面正在下小雨，你会突然想起了谁？

想起:如果外面正在下小雨，你会突然想起了谁？我最不忘，还是秋日的雨夜，天又凉了几分，已经需要披上一件薄薄的外套了。临窗而望，眼见窗台上的几株小植物，叶片上沾了几滴小雨珠，我总喜欢，用小手电去照它们，这样的小水滴看起来晶莹晶莹的，有一种清清凉凉的:-小雨

初中同学许久未见大学期间突然联系请吃饭，态度还良好，我给推了，会不会让人很烦？

初中同学:初中同学许久未见大学期间突然联系请吃饭，态度还良好，我给推了，会不会让人很烦？吃饭许久未见，意思就是交情不怎么样，无功不受禄，人家凭什么那么热情，难道真的是多年一来忘不了咱们之间的同学情谊，倍感想念了吗，不是请帮忙、做业务、就是借钱，十有八九十借钱。我建议还是不要去的好，大家都很忙:-许久未见

现在我觉得认真对某个人说我喜欢你什么的这种话好恶心，我爱你更说不出口，好恶心，是什么心理？

出口心理:现在我觉得认真对某个人说我喜欢你什么的这种话好恶心，我爱你更说不出口，好恶心，是什么心理？爱你更多的是心里问题，可能对方还没有优秀到你满意的程度，更没有到那种离不开的地步！爱情最终还是要回归生活，而生活离不开两个人的相处，父母终究会老，孩子终究会飞，所以选择自己的伴侣尤为重要，你现在觉得恶心更:-喜欢你

剧版的《何以笙箫默》和《再见王沥川》哪一个更好看呢？

再见王沥川好看:剧版的《何以笙箫默》和《再见王沥川》哪一个更好看呢？《遇见王沥川》吧，高以翔的王沥川太招人稀罕了。长相，身材，家世，人品，才能样样好，简直完美，挑不出任何毛病，实在要说一个缺点的话，那就是太tm完美，天妒英才、才让他饱受病魔折磨。偶像剧、深情帅气的男主:-何以笙箫默

计算机专业本科能够进入字节跳动、华为这些公司做开发吗？是否还需要继续读研？

学历是求职必备条件。有了工作不能停止对知识的探索。更高的学历，可以让你有更专业的技术能力和学习能力，可以让你拓展自己的交际圈，可以让你更知名。总之，活到老，学到老，学习对人总是有好处的，技多不压身嘛！:-字节跳动:计算机专业本科能够进入字节跳动、华为这些公司做开发吗？是否还需要继续读研？读研计算机专业

生完二胎的你们，现在有什么感想？

二胎家庭日常是什么样的？是不是觉得家里多了一个小人儿，温馨多了？不存在的！生二胎根本是妈妈们的渡劫磨砺！以前周末睡到自然醒，现在全年无休，时刻警醒着，能睡一次懒觉跟过年似的，黑眼圈不说，头发呼啦啦地掉:-生完二胎感想:生完二胎的你们，现在有什么感想？

华北适合种植蚕豆吗？

华北适合种植蚕豆，种蚕豆的面积大，在西北，华北，都在种植蚕豆，蚕豆茎秆根部有根瘤菌是种植其它农作物的好茬地，特别是土壤培养和防病虫害起到作用。:-蚕豆种植适合:华北适合种植蚕豆吗？华北

华为手机更新EMUI10.1系统后效果咋样？

大家知道现在智能手机的性能不仅仅跟智能手机的硬件有关，还跟智能手机的系统软件息息相关，在国产智能手机操作系统里，小米的MIUI系统跟华为的EMUI系统都是比较优秀的操作系统。最近小米推出了小米MIUI:-咋样华为华为手机更新:华为手机更新EMUI10.1系统后效果咋样？

大热天蜜蜂老是爬到箱外结群正常吗？

蜜蜂爬到:大热天蜜蜂老是爬到箱外结群正常吗？盗蜂现在正是夏季，很多地方蜜源稀少，蜂群中可能缺蜜，也是胡蜂猖獗的时间，所以蜂群中是非常容易发生盗蜂的。在蜂群中发生盗蜂的时候，蜂群守卫蜂会增多，但是这种情况引发的蜜蜂在蜂箱外一般不会结团，只是蜜蜂来:-大热天

辣椒正是生长最佳期，偏偏有的辣椒苗蔫，不是病虫害是咋回事？

最佳期雾都山客来回答您的问题。最近山客家乡的村民正在进行辣椒移栽，确实有像题主提到的情形，辣椒苗移栽前长势葱葱，嫩绿喜人，但是移栽后几天内就出现萎蔫现象，细心观察也不是被病虫害危害。那究竟是什么原因导致辣椒:-苗蔫辣椒咋回事:辣椒正是生长最佳期，偏偏有的辣椒苗蔫，不是病虫害是咋回事？

手机相机发展的最终形态会是怎样的？

最近这几年手机在电子产品行业里可谓是发展速度非常快，苹果和华为两大公司可以说也是，明争暗斗，产品一次比一次有卖点，前一段时间华为和苹果还都推出了手机新品，两家都在大力宣传强调着拍照功能，像iPhone:-形态相机手机最终:手机相机发展的最终形态会是怎样的？

华为为什么不出一款5寸全面屏手机呢？我想应该会有很多人支持吧？

5寸手机支持:华为为什么不出一款5寸全面屏手机呢？我想应该会有很多人支持吧？很高兴回答你的问题，刷头条刷出来的问题，看到很多人回答，感觉还有一些观点没有写出，所以我来回答一下。首先，华为为什么不出小尺寸全面屏手机？其实并不只有华为一家没有出小屏手机，放眼近期各大手机厂商发布的:-华为

生吃山芋，生吃胡萝卜，还有哪些蔬菜可以生吃呢？

胡萝卜蔬菜:生吃山芋，生吃胡萝卜，还有哪些蔬菜可以生吃呢？第一种，黄瓜。这个瓜，可不是菜市场中堆放满满的青瓜。各位可要睁大眼睛看清楚了，这个黄瓜，青中带黄，品种属以前乡下农户少量种植的，形态上面来看这种瓜矮、短、圆，表面覆盖有比较淡的细毛，经水轻轻冲洗之后整:-山芋

为什么马铃薯不宜过早过迟播种？

不宜:为什么马铃薯不宜过早过迟播种？播种过早为什么马铃薯不宜过早过迟播种？马铃薯的种植主要是由于气候条件的限制，过早出苗后容易遇到低温被冻死，种植晚了容易遇到干旱和高温，影响产量。马铃薯种植时间的早晚必须根据种植地方的气候条件来确定。马铃薯生长:-马铃薯

疫情愈发严重，原油为何反而大涨？

原油愈发:疫情愈发严重，原油为何反而大涨？疫情愈发严重和原油大涨没有必然关系。但是资金总是从高处流向低处，原油价格跌的越多，投资价值越明显，相对于其他产业更有投资价值。举个例子：深圳南山房价均价大约6万左右，宝安均价5万左右，如果南山房价涨到:-疫情

生菜球很好吃，怎么种植才能高产呢？

种植:生菜球很好吃，怎么种植才能高产呢？高产对环境条件的要求、1.温度生菜球为喜冷凉、忌高温作物，种子在4度以上可发芽、以15～20度为发芽适温。幼苗能耐较低温度，日平均温度12度时生长壮健，叶球生长最适温度为13～16度。不过目前有些结球生菜:-生菜

装修高手来帮忙看下144平，套内122平，怎么三房改四房？？

看下这个户型三房改四房，改一个小房间，应该没有问题。△原户型图这个户型改四房，能改的方案比较多，但是修改以后是否好用，是一件值得考虑的事情。一、主卧室变为两个卧室可以将主卧室改为两个卧室，但是这样的改动占:-房改 122:装修高手来帮忙看下144平，套内122平，怎么三房改四房？？ 144

大家帮忙看看这个房子如果要砸墙的话，怎么改比较好？

房子:大家帮忙看看这个房子如果要砸墙的话，怎么改比较好？这个户型砸墙，当然可以砸墙，但是在砸墙之前，要搞清楚为什么要砸墙，砸墙以后有什么优劣。△原户型原户型图上的白色墙体部分不是承重墙，理论上说否可以砸掉。但是外墙和与旁边户型或者是公共区域的共用墙体和图上:-帮忙

意蜂夏季喝什么水降温？

降温意蜂夏季喝什么水降温？气温高，蜂巢温度高的情况下，蜜蜂是通过采水的办法挂在蜂箱的四壁来蒸发带走热量，降低蜂巢温度同时也能帮助蜂群维持正常的湿度。在平常的情况下，蜜蜂是在室外采自然水的。夏季消耗的水量:-意蜂夏季:意蜂夏季喝什么水降温？

黄瓜种子催芽后种植需要打底水吗？

黄瓜种子:黄瓜种子催芽后种植需要打底水吗？你好很高兴回答这个问题。答案：不用。1-2天可出芽。黄瓜种子催芽：选用饱满的种子，用30℃水浸泡4小时后催芽。也可用100倍福尔马林溶液浸泡种子10-20分钟，洗净后清水浸种3-4小时，然后于25-3:-催芽黄瓜打底

书友们展示一下自我感觉发挥较好的作品，一起学习？

自我较好这幅作品是参赛的，色彩的搭配，纸张的拼接都是自己设计完成的，一如既往的清新淡雅感觉。书体用的魏碑中楷书，增加了书写的趣味性。:-书友展示:书友们展示一下自我感觉发挥较好的作品，一起学习？