🚀PROMO #PLANCARRERA2024 - 🔥Bonificaciones, Precios Congelados y Cuotas

 X 

✒️ABAP HANA La búsqueda de textos y el análisis de datos no estructurados

ABAP HANA La búsqueda de textos y el análisis de datos no estructurados

ABAP HANA La búsqueda de textos y el análisis de datos no estructurados

Las ayudas de búsqueda y la búsqueda de textos en SAP HANA

SAP HANA nos permite desarrollar ayudas de búsqueda que funcionan de manera similar a las búsquedas modernas de Internet. Proporcionan una cierta tolerancia a los errores y pueden procesar términos y sinónimos multilingües.

Reconocimiento de patrones en SAP HANA

Ser "similar", podría significar que el apellido y la dirección de un cliente nuevo y existente son casi idénticos.

La función de análisis de texto no sólo nos permite realizar búsquedas dentro de los textos, sino también extraer información adicional de los textos.Por ejemplo, podemos reconocer las relaciones o incluso las intenciones dentro de los textos.

En una tienda online, nos permitiría analizar si un producto específico provoca comentarios más positivos o negativos.

Principios básicos de la búsqueda de textos en SAP HANA

Las características de la búsqueda de textos en SAP HANA son:

  • Búsqueda de estilo libre: El usuario no necesita saber las columnas exactas de la base de datos en las que se supone que se realizará la búsqueda.
  • Búsqueda tolerante a errores (búsqueda difusa o fuzzy search): El usuario puede variar la ortografía ligeramente en sus solicitudes de búsqueda.
  • Búsqueda lingüistica y búsqueda de sinónimos
  • Sugerencias de valor: El sistema identifica de manera eficiente los resultados de búsqueda probables mientras el usuario escribe y los presenta al usuario en tiempo real.
  • Ranking de resultados: La secuencia de los resultados de la búsqueda se optimiza para que los resultados de la tasa de probabilidad más altas se presenten en la parte superior de la lista.
  • Facetas de búsqueda: Los resultados de la búsqueda se cuentan y agrupan según criterios específicos.
  • Análisis de texto (particularmente análisis de sentimiento): Se extrae información adicional de los textos, que nos permite obtener información sobre aspectos semánticos.

Búsquedas tolerantes a errores (fuzzy search)

Implica la búsqueda de cadenas de caracteres en datos basados en texto, donde los datos no tienen que corresponder exactamente con la solicitud de búsqueda. Los algoritmos matemáticos determinan el grado en que un registro de datos debe corresponder a la solicitud de búsqueda. El resultado del cálculo es un valor numérico. La función de búsqueda de textos en SAP HANA determina un valor entre 0 y 1. Como programador, debemos definir un valor de umbral (por ejemplo 0,8), a partir del cual un valor de conjunto de datos que se ha buscado se clasifica de acuerdo con la solicitud.

Además se puede adaptar para tipos de datos específicos (semánticos). Por ejemplo, en la búsqueda de una fecha, 01/01/1909 no es similar a 01/01/1990.

Expresiones utilizadas en las búsquedas:

Búsqueda linguística: Se reconocen las palabras como "casa", "casas", "vivienda", etc.

Lista de sinónimos: Es útil para abreviaturas y conceptos específicos de la industria.

Stop words: No todos los términos en una solicitud de búsqueda tienen la misma selectividad. Por ejemplo, es más importante el nombre de la empresa que el término "S.A.". Podemos ingresar una lista de stop words (o noise words) que se consideran menos importantes que otras palabras (artículos, pronombres, etc).

Tipos de datos e índices de texto completo en SAP HANA

La búsqueda difusa en SAP HANA se basa en los tipos de datos del almacen de columnas. El tipo SHORTTEXT se usa para cadenas de caracteres de una longitud determinada, mientras que TEXT representa un objeto grande. Los textos se fragmentan en tokens, que forman la base para búsquedas y análisis. Desafortunadamente, en ABAP no hay soporte nativo disponible para estos tipos, lo que hace que sea imposible crear una tabla a través del DDIC con estos tipos de datos. Aunque la función de búsqueda difusa también es compatible con otros tipos de datos (por ejemplo VARCHAR y NVARCHAR), esta compatibilidad no es lo suficientemente extensa. Sin la capacidad de dividir los textos en tokens, el sistema no puede reconocer la permutación de palabras.

Índice de texto completo (Full Text Index)

Debe ser único dentro de un esquema. Cuando creamos un índice de texto completo para una columna de la tabla, el sistema crea una columna interna invisible del tipo TEXTO, que contiene los mismos datos pero en una representación optimizada para las solicitudes de búsqueda. En este contexto, el texto se fragmenta en tokens y se genera un diccionario adicional.

CREATE FULLTEXT INDEX <index name>

ON <table name> ( <column name> )

[<parameter_list>]


Ej: CREATE FULLTEXT INDEX scarr~name ON scarr(carrname);

A partir de la versión 7.4, también es posible crearlos a través del DDIC. En la SE11 debemos definir un índice para una
tabla, o más bien, un índice de extensión (para una extensión sin modificación de una tabla estándar de SAP). Esto contiene sólo la columna requerida como un campo y se crea exclusivamente en la base de datos SAP HANA.

A través de Goto -> Full Text Index, podemos activar el índice de texto completo y configurar una variedad de parámetros, que corresponden a la sentencia anteriormente vista. La configuración estándar y la de idioma suelen ser suficientes para una búsqueda difusa.

Uso de la búsqueda de textos a través de SQL

La palabra clave CONTAINS:

SELECT <field_list>

FROM <table or view>

WHERE CONTAINS (<columns>,<search_request>,<parameter>);


Ej: SELECT * FROM scarr WHERE CONTAINS ( carrname, 'lusthansa', FUZZY(0.8)); --> Lufthansa


Búsqueda exacta / Búsqueda linguística:

La adición EXACT busca coincidencias exactas con palabras completas. Representa el valor predeterminado. Podemos usar los comodines '*'. A diferencia de LIKE, la cláusula CONTAINS nos permite realizar búsquedas en varias columnas.


HIGHLIGHTED devuelve todo el texto con la coincidencia resaltada. SNIPET devuelve un fragmento de texto alrededor de la coincidencia.


Uso de la búsqueda de textos en ABAP

Como desarrollador, podemos definir una ayuda de búsqueda especificando el nombre de una tabla o vista, y seleccionando los campos para el cuadro de diálogo. A partir de ABAP 7.4 SP06, también podemos especificar los parámetros para una búsqueda aproximada aquí. Utilizaremos la SE11. En las opciones avanzadas (Enhanced Options), podemos seleccionar si los valores se muestran directamente, si se ejecuta una búsqueda de texto completo en varias columnas y qué nivel de detalle se aplica. No es necesario crear un índice de texto completo para este propósito.


 

 

 


Sobre el autor

Publicación académica de Sergio Ariel Del Sordo, en su ámbito de estudios para el Máster ABAP for HANA.

SAP SemiSenior

Sergio Ariel Del Sordo

Profesión: Analista Programador Abap - Argentina - Legajo: LE26W

✒️Autor de: 13 Publicaciones Académicas

🎓Egresado del módulo:

Presentación:

Soy analista programador universitario y la mayor parte de mi actividad laboral la desarrollé como programador abap. me interesa aprender sobre hana, ya que es lo que se está usando en las empresas.

Certificación Académica de Sergio Del

✒️+Comunidad Académica CVOSOFT

Continúe aprendiendo sobre el tema "La búsqueda de textos y el análisis de datos no estructurados" de la mano de nuestros alumnos.

SAP SemiSenior

Unidad 2: Lección 4 Búsqueda de textos y el análisis de datos no estructurados 1. Introducción a la búsqueda de textos y análisis de datos no estructurados 1.1 Ayudas de búsqueda y búsqueda de textos Las ayudas de búsqueda representan un excelente escenario de uso para las búsquedas de texto en SAP HANA 1.2 Ayudas de búsqueda y búsqueda de textos en SAP HANA Nos permite desarrollar ayudas de búsqueda que funcionan de manera similar a las búsquedas modernas en internet Búsqueda tolerante a errores también conocida como Búsqueda difusa o Fuzzy search 1.3 Reconocimiento de patrones El reconocimiento de patrones en textos y...

Acceder a esta publicación

Creado y Compartido por: Alejandra Soto Guerrero

*** CVOSOFT - Nuestros Alumnos - Nuestro Mayor Orgullo como Academia ***

SAP Junior

Búsqueda textos y datos no estructurados Análisis de datos no estructurados Mejorar escenarios de búsqueda Reconocimiento de patrones Ayudas de Búsqueda Búsquedas sin conocer detalle exacto de los que se está buscando. Incluye variaciones ortográficas Búsqueda tolerante a errores. Fuzzy search Reconocimiento de patrones Análisis de texto. P ej: búsqueda de cliente ya existente. (concepto idéntico) Patrones en SAP Hana Reconocer las relaciones e incluso las intenciones o emociones dentro de los textos Principios básicos: Usabilidad optimizada de la búsqueda Estilo libre Tolerante a errores Lingüística y sinónimos Sugerencias de valor...

Acceder a esta publicación

Creado y Compartido por: Danilo Cortes

*** CVOSOFT - Nuestros Alumnos - Nuestro Mayor Orgullo como Academia ***

BUSQUEDA DE TEXTOS Y ANALISIS DE DATOS NO ESTRUCTURADOS. *Ayudas de búsqueda / búsquedas de textos / reconocimientos de patrones Principios básicos de las búsquedas de texto: *Permite a los usuarios utilizar las interfaces de una forma optimizada.(características comunes a los motores de búsqueda de internet, incluye funciones con un significado especial para las aplicaciones empresariales). características: Búsquedas de estilo libre. Búsqueda tolerante a errores fuzzy search - se incluyen entradas similares en el conjunto de resultados.. Búsqueda lingúistica y de sinónimos Sugerencias de Valor Ranking de resultados Facetas de búsquedas...

Acceder a esta publicación

Creado y Compartido por: Susana Mora

*** CVOSOFT - Nuestros Alumnos - Nuestro Mayor Orgullo como Academia ***

SAP SemiSenior

Búsqueda de textos y Análisis de datos no estructurados Ayudas de búsqueda y la búsqueda de textos en SAP HANA que funcionan de manera similar a las búsquedas modernas en internet. Principios básicos de búsqueda de textos en SAP HANA proporciona una usabilidad optimizada de las interfaces de búsqueda. Algunas características son: Búsqueda de estilo libre donde el usuario no necesita saber la columna exacta en la BD se puede incluir todos los datos de una dirección como calle, código postal, ciudad, etc. Búsqueda tolerante a errores (búsqueda difusa o fuzzy search) donde el usuario puede variar de ortografía en su solicitud de búsqueda...

Acceder a esta publicación

Creado y Compartido por: Diego Fernando Delgado Ortiz / Disponibilidad Laboral: PartTime + Carta Presentación

*** CVOSOFT - Nuestros Alumnos - Nuestro Mayor Orgullo como Academia ***

SAP SemiSenior

SAP HANA ofrece unas funciones para analizar datos ABAP: - obtener mas información al reconocer patrones en los conjuntos de datos existentes - busca y analiza textos, mas formas de utilizar esta función en aplicaciones empresariales y hasta ahora no se utilizaban. Ayudas de búsqueda y búsqueda de textos en SAP HANA, permite desarrollar ayudas similar a las búsquedas de internet: 1. Búsqueda difusa o Fuzzy search de tolerancia a errores y procesar términos y sinónimos multilingües. 2. Reconocimiento de patrones: comprobar entradas idénticas. Objetivos de la búsqueda en SAP HANA es proporcionar a los usuarios uso optimizado del las interfases de búsqueda. Características...

Acceder a esta publicación

Creado y Compartido por: Maria Sanchez

*** CVOSOFT - Nuestros Alumnos - Nuestro Mayor Orgullo como Academia ***

SAP Junior

1.2 Las ayudas de búsqueda y la búsqueda de textos en SAP HANA Tiene una búsqueda difusa o Fuzzy Search. 1.3 Reconocimiento de patrones en SAP HANA Permite realizar búsquedas dentro de los textos, sino también extraer información adicional de los textos. 2. PRINCIPIOS BASICOS DE LA BUSQUEDA DE TEXTOS EN SAP HANA * Búsqueda de estilo libre * Búsqueda tolerante a errores (búsqueda difusa o fuzzy search) se puede variar la ortografia ligeramente en sus solicitudes de búsqueda. * Búsqueda linguistica y búsqueda de sinónimos. * Sugerencias de valor * Ranking de resultados se muestran los resultados con la tasa de probabilidad más alta se presenten...

Acceder a esta publicación

Creado y Compartido por: Maria Xiomara Rodriguez Panqueva / Disponibilidad Laboral: FullTime

*** CVOSOFT - Nuestros Alumnos - Nuestro Mayor Orgullo como Academia ***

SAP Expert


INTRODUCCIÓN A LA BÚSQUEDA DE TEXTOS Y ANÁLISIS DE DATOS NO ESTRUCTURADOS Características de búsqueda de textos en SAP HANA Búsqueda de texto libre Búsqueda tolerante a errores (búsqueda difusa o fuzzy search): implica la búsqueda de caenas de caracteres. Búsqueda lingüistica y búsqueda de sinónimos. Podemos almacenar una lista de términos equivalentes. Sugerencias de valor (identificacion de búsquedas probables) Ranking de resultados Facetas de búsqueda Análisis de texto Tipos de datos de texto e índices...

Acceder a esta publicación

Creado y Compartido por: Juan Ignacio De Tejada Santiago / Disponibilidad Laboral: FullTime

*** CVOSOFT - Nuestros Alumnos - Nuestro Mayor Orgullo como Academia ***

---- Audio 1 Podemos obtener documentación completa acerca de la sentencia de Creación de los FULLTEXT INDEX en help.sap.com/hana. Debemos tener en cuenta que el nombre del índice de texto completo (FULLTEXT INDEX) debe ser único dentro de un esquema por lo que tiene sentido prefijar el nombre del índice con el nombre de la tabla base de datos para evitar posibles conflictos de nombres. ---- Audio 2 Tal como mencionamos podemos utilizar SQL para búsqueda de textos en SAP HANA, sin embargo actualmente hay un par de limitaciones con respecto a las combinaciones que son compatibles, una de ellas es que solo podemos utilizar la clausula CONTAINS para la búsqueda de textos en tablas que sean columnares....

Acceder a esta publicación

Creado y Compartido por: Vanessa Yadira Mendoza Zelaya

*** CVOSOFT - Nuestros Alumnos - Nuestro Mayor Orgullo como Academia ***

SAP SemiSenior

Búsqueda de textos y análisis de datos no estructurados. SAP HANA nos ofrece una función para analizar datos no estructurados. Si aprovechamos esta capacidad, podemos mejorar considerablemente la facilidad de uso de los escenarios de búsqueda dentro de los programas ABAP. Podemos obtener más información al reconocer los patrones en los conjuntos de datos existentes. 1- Las ayudas de búsqueda y la búsqueda de textos Las ayudas de búsqueda son un excelente escenario para las búsquedas de texto en SAP HANA. Los usuarios en ocasiones buscan un conjunto de datos muy grande sin saber los detalles de entrada o sin tener estos datos a la mano al momento de usar una ayuda de búsqueda....

Acceder a esta publicación

Creado y Compartido por: Jesús Heriberto Quiñonez López / Disponibilidad Laboral: FullTime + Carta Presentación

*** CVOSOFT - Nuestros Alumnos - Nuestro Mayor Orgullo como Academia ***

SAP Senior

1. Las ayudas de búsqueda y la búsqueda de textos en SAP HANA La función de búsqueda de texto de SAP HANA nos permite desarrollar ayudas de búsqueda que proporcionan una cierta tolerancia a errores y pueden procesar términos y sinónimos multilingües. Por ejemplo, podemos ingresar "buenes eires tele" en una ayuda de búsqueda y se interpretara correctamente a pesar de la ortografía incorrecta. Sin embargo, los usuarios no siempre pueden determinar fácilmente si el resultado devuelto es el esperado en este tipo de búsqueda tolerante a errores (Fuzzy search). La función de análisis de texto en SAP HANA no solo nos permite realizar búsquedas...

Acceder a esta publicación

Creado y Compartido por: Ricardo Daniel Tovar Barrera

 


 

👌Genial!, estos fueron los últimos artículos sobre más de 79.000 publicaciones académicas abiertas, libres y gratuitas compartidas con la comunidad, para acceder a ellas le dejamos el enlace a CVOPEN ACADEMY.

Buscador de Publicaciones:

 


 

No sea Juan... Solo podrá llegar alto si realiza su formación con los mejores!