M_Milvus包含向量数据库基本操作以及对md和pdf文档的处理,使用glm_embedding计算分割后文档的向量值,在start.py中进行向量检索,查找出前k个相似值。文档分割出还有问题,全部文档内容获取以后,分割为300字为一段的内容进行向量计算,存入向量数据库中。
本地部署向量数据库milvus对接基于ollama本地部署的codegexx4进行向量检索,该仓库包含本地部署向量数据库milvus和ollama部署的操作文档,以及对应的python代码。
赛事背景 在数字化时代,企业积累了大量对话数据,这些数据不仅是交流记录,还隐藏着宝贵的信息。群聊对话分角色要素提取是企业营销和服务的重要策略,通过分析这些数据,企业可以更好地理解客户需求,提供个性化服务,提升客户满意度和商业价值。 赛事任务 从给定的<客服>与<客户>的群聊对话中,提取出指定的字段信息,具体待提取的字段信息见下文。