当前位置: 首页 > news >正文

如何通过Python SDK在Collection中进行相似性检索

前提条件

已创建Cluster

已获得API-KEY

已安装最新版SDK

接口定义

Python示例:

Collection.query_group_by(

self,

vector: Optional[Union[List[Union[int, float]], np.ndarray]] = None,

*,

group_by_field: str,

group_count: int = 10,

group_topk: int = 10,

id: Optional[str] = None,

filter: Optional[str] = None,

include_vector: bool = False,

partition: Optional[str] = None,

output_fields: Optional[List[str]] = None,

sparse_vector: Optional[Dict[int, float]] = None,

async_req: bool = False,

) -> DashVectorResponse:

使用示例

说明

需要使用您的api-key替换示例中的YOUR_API_KEY、您的Cluster Endpoint替换示例中的YOUR_CLUSTER_ENDPOINT,代码才能正常运行。

Python示例:

import dashvector

import numpy as np

client = dashvector.Client(

api_key='YOUR_API_KEY',

endpoint='YOUR_CLUSTER_ENDPOINT'

)

ret = client.create(

name='group_by_demo',

dimension=4,

fields_schema={'document_id': str, 'chunk_id': int}

)

assert ret

collection = client.get(name='group_by_demo')

ret = collection.insert([

('1', np.random.rand(4), {'document_id': 'paper-01', 'chunk_id': 1, 'content': 'xxxA'}),

('2', np.random.rand(4), {'document_id': 'paper-01', 'chunk_id': 2, 'content': 'xxxB'}),

('3', np.random.rand(4), {'document_id': 'paper-02', 'chunk_id': 1, 'content': 'xxxC'}),

('4', np.random.rand(4), {'document_id': 'paper-02', 'chunk_id': 2, 'content': 'xxxD'}),

('5', np.random.rand(4), {'document_id': 'paper-02', 'chunk_id': 3, 'content': 'xxxE'}),

('6', np.random.rand(4), {'document_id': 'paper-03', 'chunk_id': 1, 'content': 'xxxF'}),

])

assert ret

根据向量进行分组相似性检索

Python示例:

ret = collection.query_group_by(

vector=[0.1, 0.2, 0.3, 0.4],

group_by_field='document_id', # 按document_id字段的值分组

group_count=2, # 返回2个分组

group_topk=2, # 每个分组最多返回2个doc

)

# 判断是否成功

if ret:

print('query_group_by success')

print(len(ret))

print('------------------------')

for group in ret:

print('group key:', group.group_id)

for doc in group.docs:

prefix = ' -'

print(prefix, doc)

参考输出如下

query_group_by success

4

------------------------

group key: paper-01

- {"id": "2", "fields": {"document_id": "paper-01", "chunk_id": 2, "content": "xxxB"}, "score": 0.6807}

- {"id": "1", "fields": {"document_id": "paper-01", "chunk_id": 1, "content": "xxxA"}, "score": 0.4289}

group key: paper-02

- {"id": "3", "fields": {"document_id": "paper-02", "chunk_id": 1, "content": "xxxC"}, "score": 0.6553}

- {"id": "5", "fields": {"document_id": "paper-02", "chunk_id": 3, "content": "xxxE"}, "score": 0.4401}

根据主键对应的向量进行分组相似性检索

Python示例:

ret = collection.query_group_by(

id='1',

group_by_field='name',

)

# 判断query接口是否成功

if ret:

print('query_group_by success')

print(len(ret))

for group in ret:

print('group:', group.group_id)

for doc in group.docs:

print(doc)

print(doc.id)

print(doc.vector)

print(doc.fields)

带过滤条件的分组相似性检索

Python示例:

# 根据向量或者主键进行分组相似性检索 + 条件过滤

ret = collection.query_group_by(

vector=[0.1, 0.2, 0.3, 0.4], # 向量检索,也可设置主键检索

group_by_field='name',

filter='age > 18', # 条件过滤,仅对age > 18的Doc进行相似性检索

output_fields=['name', 'age'], # 仅返回name、age这2个Field

include_vector=True

)

带有Sparse Vector的分组向量检索

Python示例:

# 根据向量进行分组相似性检索 + 稀疏向量

ret = collection.query_group_by(

vector=[0.1, 0.2, 0.3, 0.4], # 向量检索

sparse_vector={1: 0.3, 20: 0.7},

group_by_field='name',

)

http://www.cnnetsun.cn/news/15128.html

相关文章:

  • 零基础搞定Umi项目自动化部署:从代码到上线的完整指南
  • 数学分析简明教程——6.2
  • SSM物业缴费管理系统u8mx4(程序+源码+数据库+调试部署+开发环境)带论文文档1万字以上,文末可获取,系统界面在最后面
  • 如何在PowerPoint中轻松插入LaTeX公式:终极解决方案
  • Ultralytics YOLOv11终极性能优化:从配置到实战的完整指南
  • 突破传统:3大实战方法让GLM语言模型成为你的AI生产力工具
  • 3步快速解决HeyGem.ai性能问题:终极优化指南
  • 自助项目全解析:适配老板画像业态选择指南
  • 传统链表OUT了!侵入式链表让Nginx、TCMalloc 性能飞跃的秘密武器
  • MinIO效率革命:传统存储方案对比实测
  • AI如何帮你彻底理解box-sizing的奥秘
  • 如何用AI自动生成OpenRGB灯光控制脚本
  • 告别深夜改Bug!CodeGenie帮你快速“驯服”鸿蒙编译错误!
  • 企业IT运维:批量处理设备启动故障(代码10)实战
  • 3天掌握VAR模型:零基础搭建GPT式图像生成系统
  • Headless Recorder完整指南:从零掌握浏览器自动化脚本生成
  • 终极指南:如何用ConvNeXt实现高效语义分割(UperNet完整教程)
  • 包装设计创意大比拼,谁才是行业王者?
  • 项目分享|Tabby:打造你自己的智能代码补全服务
  • 终极音频解锁指南:3分钟掌握浏览器端音乐格式转换
  • Word中批量给手机号打码,分享2种高效加密方法!
  • 5大核心优势解析:为什么Screenbox成为Windows平台最佳免费播放器
  • 【必学收藏】RAG技术详解:解决大模型幻觉的终极指南,从入门到实战
  • 有序数组的平方——双指针
  • DBeaver数据库对象搜索失效的5分钟紧急修复指南
  • PHP 15 个高效开发的小技巧
  • 三级防护+119种语言:Qwen3Guard-Gen重新定义2025大模型安全标准
  • Brotli解压引擎深度解密:从位流到字节的魔法转换
  • 深度解析 MySQL 与 MCP 集成:从环境构建到 AI 驱动的数据交互全流程
  • 5个理由选择Google Assistant SDK Python版打造智能语音设备