정규식Compatible with Milvus 2.5.11+

regex 필터는 정규식 필터로, 토큰 생성기가 생성한 토큰은 사용자가 제공한 표현식과 일치하는 경우에만 유지되며 그 외의 토큰은 모두 삭제됩니다.

구성

regex 필터는 Milvus의 사용자 지정 필터입니다. 이 필터를 사용하려면 필터 구성에 "type": "regex" 을 지정하고 expr 매개변수를 지정하여 원하는 정규식을 지정하세요.

{
    "tokenizer": "standard",
    "filter": [{
        "type": "regex",
        "expr": "^(?!test)" # keep tokens that do NOT start with "test"
    }]
}
// java
// node
// go
# curl

regex 필터는 다음과 같은 구성 가능한 매개변수를 허용합니다.

파라미터

설명

expr

각 토큰에 적용되는 정규식 패턴입니다. 일치하는 토큰은 유지되고 일치하지 않는 토큰은 삭제됩니다. 정규식 구문에 대한 자세한 내용은 구문을 참조하세요.

regex 필터는 토큰 생성기에 의해 생성된 용어에 대해 작동하므로 토큰 생성기와 함께 사용해야 합니다.

analyzer_params 을 정의한 후 컬렉션 스키마를 정의할 때 VARCHAR 필드에 적용할 수 있습니다. 이렇게 하면 Milvus가 지정된 분석기를 사용하여 해당 필드의 텍스트를 처리하여 효율적인 토큰화 및 필터링을 수행할 수 있습니다. 자세한 내용은 사용 예시를 참조하세요.

예제

분석기 구성을 컬렉션 스키마에 적용하기 전에 run_analyzer 메서드를 사용하여 그 동작을 확인하세요.

분석기 구성

{
    "tokenizer": "standard",
    "filter": [{
        "type": "regex",
        "expr": "^(?!test)"
    }]
}
// java
// node
// go
# curl

다음을 사용하여 확인 run_analyzer

# Sample text to analyze
sample_text = "testItem apple testCase banana"

# Run the standard analyzer with the defined configuration
result = MilvusClient.run_analyzer(sample_text, analyzer_params)
print(result)
// java
// node
// go
# curl

예상 출력

['apple', 'banana']

번역DeepL

관리형 Milvus를 무료로 사용해 보세요

Zilliz Cloud는 번거로움이 없으며, Milvus 기반으로 10배 더 빠릅니다.

시작하기
피드백

이 페이지가 도움이 되었나요?