Introdução
NumPy é uma biblioteca Python popular utilizada para trabalhar com arrays. Um dos submódulos do NumPy é o módulo char, que fornece várias operações de string que podem ser aplicadas em arrays NumPy. Neste tutorial de laboratório, discutiremos a função encode() do módulo char do NumPy. Aprenderemos como usar esta função para codificar uma string de entrada fornecida. Cobriremos a sintaxe, os parâmetros e os valores retornados da função encode() usando exemplos.
Dicas da VM
Após a inicialização da VM, clique no canto superior esquerdo para mudar para a aba Notebook e acessar o Jupyter Notebook para praticar.
Às vezes, pode ser necessário aguardar alguns segundos para que o Jupyter Notebook termine de carregar. A validação das operações não pode ser automatizada devido a limitações no Jupyter Notebook.
Se você enfrentar problemas durante o aprendizado, sinta-se à vontade para perguntar ao Labby. Forneça feedback após a sessão, e resolveremos o problema prontamente para você.
Importar a biblioteca NumPy
Começamos importando a biblioteca NumPy, que é necessária para usar a função encode(). O bloco de código a seguir importa o NumPy:
import numpy as np
Usar a função encode() com diferentes esquemas de codificação
Agora usaremos a função encode() com dois esquemas de codificação diferentes: 'cp037' e 'utf-8'. Para isso, primeiro definimos um array de strings.
a = ['aAaAaA', ' aA ', 'abBABba','dffgs','ttsred']
Usando o esquema de codificação 'cp037'
Usamos a função encode() com o esquema de codificação 'cp037' passando o array de entrada e o tipo de codificação como parâmetros. O bloco de código a seguir demonstra isso:
x = np.char.encode(a, encoding='cp037', errors=None)
O bloco de código acima lê o array de entrada a e o codifica usando o esquema de codificação 'cp037'. A string codificada é armazenada na variável x. Como nenhum mecanismo de tratamento de erros é especificado, o parâmetro errors é definido como None. Agora imprimimos o array de entrada e a string codificada da seguinte forma:
print("Input is:")
print(a)
print("Encoded String is:")
print(x)
Saída:
Input is:
['aAaAaA', ' aA ', 'abBABba', 'dffgs', 'ttsred']
Encoded String is:
[b'\x81\xc1\x81\xc1\x81\xc1' b'@@\x81\xc1@@'
b'\x81\x82\xc2\xc1\xc2\x82\x81' b'\x84\x86\x86\x87\xa2'
b'\xa3\xa3\xa2\x99\x85\x84']
Usando o esquema de codificação 'utf-8'
Usamos a função encode() com o esquema de codificação 'utf-8' passando o array de entrada e o tipo de codificação como parâmetros. O bloco de código a seguir demonstra isso:
x = np.char.encode(a, encoding='utf-8', errors=None)
O bloco de código acima lê o array de entrada a e o codifica usando o esquema de codificação 'utf-8'. A string codificada é armazenada na variável x. Como nenhum mecanismo de tratamento de erros é especificado, o parâmetro errors é definido como None. Agora imprimimos o array de entrada e a string codificada da seguinte forma:
print("Input is:")
print(a)
print("Encoded String is:")
print(x)
Saída:
Input is:
['aAaAaA', ' aA ', 'abBABba', 'dffgs', 'ttsred']
Encoded String is:
[b'aAaAaA' b' aA ' b'abBABba' b'dffgs' b'ttsred']
Resumo
Neste laboratório, aprendemos sobre a função encode() do módulo char da biblioteca NumPy. Cobrimos como ela é usada, sua sintaxe e os valores retornados por esta função. Também discutimos diferentes esquemas de codificação, como 'cp037' e 'utf-8', e demonstramos seu uso com exemplos. A função encode() permite a codificação de uma string de entrada de forma elementar (element-wise) e retorna a string codificada.



