Definição
$substrBytesRetorna a substring de uma string. A substring começa com o caractere no índice de bytes UTF-8 especificado (baseado em zero) na string e continua para o número de bytes especificados.
$substrByteshas the following operator expression syntax:{ $substrBytes: [ <string expression>, <byte index>, <byte count> ] } CampoTipoDescriçãostring expressionstring
A string da qual a substring será extraída.
string expressionpode ser qualquer expressão válida desde que resolva para uma string. Para mais informações sobre expressões, consulte Expressões.If the argument resolves to a value of
nullor refers to a field that is missing,$substrBytesreturns an empty string.If the argument does not resolve to a string or
nullnor refers to a missing field,$substrBytesreturns an error.byte indexnúmero
Indica o ponto de partida da substring.
byte indexpode ser qualquer expressão válida, desde que resolva para um número inteiro não negativo ou número que possa ser representado como um número inteiro (como 2.0).byte indexnão pode se referir a um índice inicial localizado no meio de um caractere UTF-8 de vários bytes.byte countnúmero
Pode ser qualquer expressão válida, desde que resolva para um número inteiro não negativo ou número que possa ser representado como um número inteiro (como 2.0).
byte countnão pode resultar em um índice final que esteja no meio de um caractere UTF-8.
Comportamento
O operador utiliza os índices $substrBytes de8 bytes codificados UTF- onde cada ponto de código , ou caractere, pode utilizar entre um e quatro bytes para codificar.
Por exemplo, os caracteres US-ASCII são codificados usando um byte. Caracteres com diacríticos e caracteres alfabéticos latinos adicionais (caracteres latinos fora do alfabeto inglês) são codificados usando dois bytes. Caracteres chineses, tailandeses e coreanos normalmente exigem três bytes, e outros planos de unicode (emoji, símbolos matemáticos etc.) exigem quatro bytes.
É importante estar atento ao conteúdo do string expression porque fornecer um byte index ou byte count localizado no meio de um caractere UTF-8 resultará em um erro.
$substrBytes differs from $substrCP in that $substrBytes counts the bytes of each character, whereas $substrCP counts the code points, or characters, regardless of how many bytes a character uses.
Exemplo | Resultados | ||
|---|---|---|---|
| | ||
| | ||
| | ||
| | ||
| Erro com mensagem:
| ||
| Erro com mensagem:
|
Exemplo
Conjunto de caracteres de byte único
Considere uma coleção inventory com os seguintes documentos:
db.inventory.insertMany( [ { _id: 1, item: "ABC1", quarter: "13Q1", description: "product 1" }, { _id: 2, item: "ABC2", quarter: "13Q4", description: "product 2" }, { _id: 3, item: "XYZ1", quarter: "14Q2", description: null } ] )
The following operation uses the $substrBytes operator separate the quarter value (containing only single byte US-ASCII characters) into a yearSubstring and a quarterSubstring. The quarterSubstring field represents the rest of the string from the specified byte index following the yearSubstring. It is calculated by subtracting the byte index from the length of the string using $strLenBytes.
db.inventory.aggregate( [ { $project: { item: 1, yearSubstring: { $substrBytes: [ "$quarter", 0, 2 ] }, quarterSubstring: { $substrBytes: [ "$quarter", 2, { $subtract: [ { $strLenBytes: "$quarter" }, 2 ] } ] } } } ] )
A operação retorna os seguintes resultados:
{ _id: 1, item: "ABC1", yearSubstring: "13", quarterSubstring: "Q1" } { _id: 2, item: "ABC2", yearSubstring: "13", quarterSubstring: "Q4" } { _id: 3, item: "XYZ1", yearSubstring: "14", quarterSubstring: "Q2" }
Conjunto de caracteres de byte único e multibyte
Criar uma coleção food com os seguintes documentos:
db.food.insertMany( [ { _id: 1, name: "apple" }, { _id: 2, name: "banana" }, { _id: 3, name: "éclair" }, { _id: 4, name: "hamburger" }, { _id: 5, name: "jalapeño" }, { _id: 6, name: "pizza" }, { _id: 7, name: "tacos" }, { _id: 8, name: "寿司sushi" } ] )
A seguinte operação utiliza o operador $substrBytes para criar um menuCode de três bytes a partir do valor name :
db.food.aggregate( [ { $project: { "name": 1, "menuCode": { $substrBytes: [ "$name", 0, 3 ] } } } ] )
A operação retorna os seguintes resultados:
{ _id: 1, name: "apple", menuCode: "app" } { _id: 2, name: "banana", menuCode: "ban" } { _id: 3, name: "éclair", menuCode: "éc" } { _id: 4, name: "hamburger", menuCode: "ham" } { _id: 5, name: "jalapeño", menuCode: "jal" } { _id: 6, name: "pizza", menuCode: "piz" } { _id: 7, name: "tacos", menuCode: "tac" } { _id: 8, name: "寿司sushi", menuCode: "寿" }
Dica