Consulta nuestras guías de comparación:
X API: Diccionario de datos de nivel empresarial
Introducción
Enterprise
Las Publicaciones son la unidad atómica fundamental de todo en X. Todas las X API que devuelven Publicaciones proporcionan esos datos codificados en formato JavaScript Object Notation (JSON). JSON se basa en pares clave-valor, con atributos con nombre y valores asociados. Los objetos de Publicación recuperados a través de la API incluyen la “actualización de estado” de un Usuario de X, pero los Retweets, las respuestas y los Tweets citados también son objetos de Publicación. Si una Publicación está relacionada con otra Publicación, como un Retweet, una respuesta o un Tweet citado, cada una se identificará o se incluirá en el objeto de Publicación. Incluso la Publicación más sencilla en el formato de datos nativo de X tendrá objetos JSON anidados para representar otros atributos de una Publicación, como el autor, los usuarios mencionados, la ubicación del lugar etiquetado, los hashtags, los símbolos de cashtag, los contenidos multimedia o los enlaces URL. Al trabajar con datos de X, este es un concepto importante que debes entender. El formato de los datos de la Publicación que recibirás desde la X API depende del tipo de Publicación recibida, de la X API que estés utilizando y de la configuración de formato.
Los endpoints de Enterprise que devuelven objetos de Publicación se han actualizado para proporcionar los metadatos necesarios para comprender el historial de edición de la Publicación. Obtén más información sobre estos metadatos en la página de fundamentos de “Editar Publicaciones”.
En el formato nativo de X, el payload JSON incluirá atributos de «nivel raíz» y objetos JSON anidados (representados aquí con la notación
{}):
Formatos de datos disponibles
Tenga en cuenta: se recomienda encarecidamente utilizar el formato Enriched Native para las APIs de datos empresariales.Las APIs de datos empresariales entregan datos en dos formatos diferentes. El formato empresarial más cercano al formato estándar v1.1 nativo es Native Enriched. El formato empresarial de datos heredado es Activity Streams, implementado originalmente y utilizado por Gnip como un formato normalizado en X y otros proveedores de datos de redes sociales en ese momento. Aunque este formato sigue estando disponible, X solo ha invertido en nuevas funciones y desarrollos en el formato Native Enriched desde 2017. El formato Native Enriched es exactamente lo que su nombre indica: incluye objetos nativos de X, así como enriquecimientos adicionales disponibles para los productos de datos empresariales, como metadatos de expansión de URL, geolocalización de perfil, metadatos de encuestas y métricas de interacción adicionales.
- El formato Enriched Native incluye todos los metadatos nuevos desde 2017, como los metadatos de encuestas, y métricas adicionales como
reply_countyquote_count.- El formato Activity Streams no se ha actualizado con nuevos metadatos ni enriquecimientos desde la actualización de caracteres en 2017.
- Enriquecimiento de URL expandidas y mejoradas
- Enriquecimiento de reglas de coincidencia
- Enriquecimiento de metadatos de encuestas
- Enriquecimiento de geolocalización de perfil
Comparación de objetos por formato de datos
Mejores prácticas de análisis
- El JSON de X se codifica en UTF-8.
- Los analizadores deben tolerar sin problemas la variación en el orden de los campos. Debe suponerse que el JSON de la Publicación se sirve como un hash de datos no ordenado.
- Los analizadores deben tolerar la incorporación de campos “nuevos”.
- Los analizadores de JSON deben tolerar la ausencia de campos, ya que no todos los campos aparecen en todos los contextos.
- En general, es seguro considerar un campo con valor nulo, un conjunto vacío y la ausencia de un campo como equivalentes.
Objetos de datos de Enterprise Native Enriched
Objeto Tweet de Native Enriched
¿Te interesa aprender más sobre cómo el formato de datos Native Enriched se corresponde con el formato de X API v2? Consulta nuestra guía comparativa: Native Enriched comparado con X API v2
Objeto Post
id, created_at y text. Los objetos Post también tendrán objetos anidados que incluyen user, entities y extended_entities. Los objetos Post también tendrán otros objetos Post anidados, como retweeted_status, quoted_status y extended_tweet. El formato nativo enriquecido también tendrá un objeto matching_rules.
Diccionario de datos de X
Atributos adicionales de la Publicación
Atributos obsoletos
Objetos de Publicación anidados
retweeted_status. El objeto de nivel raíz encapsula el propio Retweet, incluido un objeto de User para la cuenta que realiza la acción de Retweet y la hora del Retweet. Hacer Retweet es una acción para compartir una Publicación con tus seguidores, y no se puede añadir ningún contenido nuevo. Además, no se puede proporcionar una ubicación (nueva) con un Retweet. Aunque la Publicación «original» pueda estar geolocalizada, los objetos geo y place del Retweet siempre serán null.
Incluso antes de la introducción de las Publicaciones extendidas, el objeto entities de nivel raíz estaba en algunos casos truncado e incompleto debido a que se agregaba la cadena RT @username al mensaje de la Publicación a la que se hacía Retweet. Ten en cuenta que, si a un Retweet se le vuelve a hacer Retweet, el retweet_status seguirá apuntando a la Publicación original, lo que significa que el Retweet intermedio no se incluye. Se observa un comportamiento similar al usar x.com para «mostrar» un Retweet. Si copias el id de Publicación único asignado a la «acción» de Retweet, se muestra la Publicación original.
A continuación se muestra una estructura de ejemplo para un Retweet. De nuevo, al analizar Retweets, es clave analizar el objeto retweeted_status para obtener el mensaje completo de la Publicación original y los metadatos de entidades.
Tweets citados
Publicaciones extendidas
Objeto de usuario enriquecido nativo
Diccionario de datos de usuario
Atributos en desuso (ya no admitidos)
Ejemplo de objeto de usuario:
Objetos Geo Nativos Enriquecidos
place siempre está presente cuando una Publicación está etiquetada con ubicación mediante un Place. Los Places son ubicaciones específicas y con nombre, con coordenadas geográficas correspondientes. Cuando los usuarios deciden asignar una ubicación a su Publicación, se les presenta una lista de X Places candidatos. Cuando se usa la API para publicar, se puede adjuntar un X Place especificando un place_id al publicar. Las Publicaciones asociadas con Places no necesariamente se emiten desde esa ubicación, sino que también podrían potencialmente tratarse sobre esa ubicación.
Los objetos geo y coordinates solo están presentes (no nulos) cuando a la Publicación se le asigna una ubicación exacta. Si se proporciona una ubicación exacta, el objeto coordinates proporcionará un arreglo [long, lat] con las coordenadas geográficas, y se asignará un X Place que corresponda a esa ubicación.
Diccionario de datos de Place
Diccionario de datos del objeto Geo
Diccionario de datos del objeto Coordinates
Ubicaciones derivadas
Ejemplos:
Entidades de X
Introducción
Las entidades proporcionan metadatos e información contextual adicional sobre el contenido publicado en X. La secciónentities proporciona arrays de elementos comunes incluidos en las Publicaciones: hashtags, menciones de usuarios, enlaces, símbolos bursátiles (tickers), encuestas de X y medios adjuntos. Estos arrays son prácticos para los desarrolladores al procesar Publicaciones, ya que X ha preprocesado, o preanalizado, esencialmente el cuerpo de texto. En lugar de tener que buscar y encontrar explícitamente estas entidades en el cuerpo de la Publicación, tu analizador puede ir directamente a esta sección JSON y allí estarán.
Además de proporcionar estas facilidades de análisis, la sección entities también ofrece metadatos útiles que “añaden valor”. Por ejemplo, si estás usando el Enhanced URLs enrichment, los metadatos de URL incluyen las URL totalmente expandidas, así como los títulos y descripciones de los sitios web asociados. Otro ejemplo es cuando hay menciones de usuarios; los metadatos de entidades incluyen el id numérico de usuario, que es útil al realizar solicitudes a muchas X API.
Cada carga útil JSON de una Publicación incluye una sección entities, con el conjunto mínimo de atributos hashtags, urls, user_mentions y symbols, incluso si ninguna de esas entidades forma parte del mensaje de la Publicación. Por ejemplo, si examinas el JSON de una Publicación con un cuerpo de “Hello World!” y sin medios adjuntos, el JSON de la Publicación incluirá el siguiente contenido con arrays de entidades que contienen cero elementos:
- las entidades media y polls solo aparecerán cuando ese tipo de contenido forme parte de la Publicación.
- si trabajas con contenido multimedia nativo (fotos, videos o GIFs), el Extended Entities object es la opción recomendada.
Objeto Entities
entities y extended_entities están compuestas por arrays de objetos de entidad. A continuación se incluyen descripciones de cada uno de estos objetos de entidad, incluidos diccionarios de datos que describen los nombres de los atributos del objeto, sus tipos y una breve descripción. También indicaremos qué operadores de PowerTrack coinciden con estos atributos e incluiremos algunos ejemplos de payloads JSON.
Una colección de entidades comunes que se encuentran en las Publicaciones, incluidas las etiquetas (hashtags), los enlaces y las menciones de usuarios. Este objeto entities sí incluye un atributo media, pero su implementación en la sección entiites solo es completamente precisa para Publicaciones con una sola foto. Para todas las Publicaciones con más de una foto, un video o un GIF animado, se remite al lector a la sección extended_entities.
Diccionario de datos de Entities
entities es un contenedor de arrays de otros subobjetos de entidades. Después de ilustrar la estructura de entities, se proporcionarán diccionarios de datos para estos subobjetos y los Operadores que coinciden con ellos.
Objeto de hashtag
entities contendrá un array hashtags con un objeto por cada hashtag incluido en el cuerpo de la Publicación, e incluirá un array vacío si no hay hashtags presentes.
El operador PowerTrack # se utiliza para hacer coincidir el atributo text. El operador has:hashtags coincidirá si hay al menos un elemento en el array.
Objeto multimedia
entities contendrá un array media que incluirá un único objeto multimedia si se ha “adjuntado” algún objeto multimedia a la Publicación. Si no se ha adjuntado contenido multimedia nativo, no habrá ningún array media en entities. Por las siguientes razones, se debe usar la sección extended_entities para procesar el contenido multimedia nativo de la Publicación:
- El
typedel contenido multimedia siempre indicaráphotoincluso en los casos en que se adjunte un video o un GIF a la Publicación. - Aunque se pueden adjuntar hasta cuatro fotos, solo la primera se incluirá en la sección
entities.
has:media coincidirá si este array contiene elementos.
Objetos de tamaño de contenido multimedia
Objeto Sizes
Objeto de tamaño
Formato de URL de medios de fotos
media_url o media_url_https se pueden cargar por sí solos, lo que dará como resultado que se cargue la variante de tamaño medio de forma predeterminada. Sin embargo, es preferible proporcionar una URL de medios de fotos completamente formateada cuando sea posible.
Hay tres partes en una URL de medios de fotos:
Tomamos estas tres partes (URL base, formato y nombre) y las combinamos en la URL de medios de fotos que se va a cargar. Hay 2 formatos para cargar imágenes de esta manera, legacy y modern. Todas las cargas de imágenes deben dejar de usar el formato legacy y usar el formato modern. Usar el formato modern dará como resultado una mejor tasa de aciertos en la CDN para quien realiza la llamada, mejorando así las latencias de carga al ser menos probable que tenga que generar y cargar los medios desde el centro de datos.
Objeto URL
entities contendrá un array urls que incluye un objeto por cada enlace incluido en el cuerpo de la Publicación, y un array vacío si no hay enlaces presentes.
El operador has:links coincidirá si hay al menos un elemento en el array. El operador url: se utiliza para hacer coincidir el atributo expanded_url. Si estás utilizando el Expanded URL enrichment, el operador url: se utiliza para hacer coincidir el atributo unwound.url (URL completamente expandida). Si estás utilizando el Exhanced URL enrichment, los operadores url_title: y url_decription: se utilizan para hacer coincidir los atributos unwound.title y unwound.description.
Si estás utilizando los enriquecimientos Expanded y/o Enhanced URL, los siguientes metadatos están disponibles en el atributo
unwound:
Objeto de mención de usuario
entities contendrá un arreglo user_mentions que incluye un objeto por cada mención de usuario incluida en el cuerpo de la Publicación, y un arreglo vacío si no hay ninguna mención de usuario.
El operador PowerTrack @ se utiliza para hacer coincidir el atributo screen_name. El operador has:mentions coincidirá si hay al menos un elemento en el arreglo.
Objeto Symbol
entities contendrá un array symbols que incluye un objeto por cada $cashtag incluido en el cuerpo de la Publicación, y un array vacío si no hay ningún símbolo presente.
El operador $ de PowerTrack se utiliza para hacer coincidencias con el atributo text. El operador has:symbols coincidirá si hay al menos un elemento en el array.
Objeto poll
entities contendrá un arreglo polls que incluirá un único objeto poll si la Publicación contiene una encuesta. Si no se incluye ninguna encuesta, no habrá un arreglo polls en la sección entities.
Ten en cuenta que estos metadatos de encuestas solo están disponibles con las siguientes APIs Enterprise:
- Flujos de volumen (Decahose )
- Real-time PowerTrack
- APIs de búsqueda de X (Full-Archive Search y 30-Day Search)
Detalles de Retweets y Tweets citados
Retweets












http://wapo.st/2w8iwPQ #Testing
En el ejemplo anterior, tanto la URL como el hashtag se vieron afectados. Dado que el hashtag se truncó por completo y la URL se truncó parcialmente, estos faltan en las entities de nivel superior. También verás la user_mentions adicional de nivel superior que proviene del prefijo «RT @floodsocial: » en el campo text.
Sin embargo, el texto de la Publicación y las entities en retweeted_status reflejan perfectamente la Publicación original sin truncamiento ni entities incorrectas; por lo tanto, recomendamos confiar en el objeto anidado retweeted_status para los Retweets.
Tweets citados
Los Tweets citados se introdujeron en 2016 y se diferencian de los Retweets en que, cuando “citas” una Publicación, agregas contenido nuevo “sobre” una Publicación compartida. Este contenido nuevo puede incluir casi cualquier elemento que pueda tener una Publicación original, como texto adicional, hashtags, menciones y URL. Los Tweets citados pueden contener contenido multimedia nativo (fotos, videos y GIF) y aparecerán en el objeto entities. Dado que se pueden agregar entidades de X, es probable que las entidades del Tweet citado sean diferentes de las entidades originales. En este ejemplo, se colocaron una nueva URL y un nuevo hashtag al final del Tweet citado. Esta Publicación, https://x.com/FloodSocial/status/907983973225160704, tiene el siguiente texto de la Publicación: strange and equally tragic when islands flood… trans-atlantic testing of quote tweets | @thisuser @thatuserhttp://bit.ly/2vMMDuu #testing En este caso, las entidades de nivel superior no reflejan los detalles del Tweet citado. Sin embargo, el texto de la Publicación y las entities enextended_tweet reflejan perfectamente el Tweet citado, sin truncaciones ni entidades incorrectas; de ahí nuestra recomendación de confiar en el objeto anidado _extended_tweet _objeto para los Tweets citados.
Entidades para el objeto user
Ejemplo de JSON
Entidades extendidas de X
Introducción
extended_entities. El objeto extended_entities contiene un único arreglo media de objetos media (consulta la sección entities para ver su diccionario de datos). Ningún otro tipo de entidad, como hashtags y enlaces, se incluye en la sección extended_entities. El objeto media en la sección extended_entities es idéntico en estructura al que se incluye en la sección entities.
Las Publicaciones solo pueden tener un tipo de contenido multimedia adjunto. Para fotos, se pueden adjuntar hasta cuatro fotos. Para videos y GIF, se puede adjuntar uno. Dado que los metadatos type del medio en la sección extended_entities indican correctamente el tipo de medio (“photo”, “video” o “animated_gif”) y admiten hasta 4 fotos, es la fuente de metadatos preferida para contenido multimedia nativo.
Ejemplos de Publicaciones y cargas útiles en JSON
Esta es la sección
entities de esta Publicación:
extented_entities para esta Publicación:
Publicación con video nativo
video_info se reemplazará por un objeto additional_media_info.
El objeto additional_media_info contendrá información de medios adicional proporcionada por el editor, como title, description y embeddable flag. El contenido de video solo está disponible para los clientes oficiales de X cuando embeddable=false. En este caso, todas las URL de video proporcionadas en el payload estarán basadas en X, de modo que el usuario pueda abrir el video en una propiedad de X haciendo clic en el enlace.
Aquí tienes un ejemplo de cómo se verá el objeto extended entities en esta situación:
entities que tiene incorrectamente el type asignado a ‘photo’. Nuevamente, se prefiere la sección extended_entities para todos los tipos de medios nativos, incluidos ‘video’ y ‘animated_gif’.
Publicación con un GIF animado
A continuación se muestran los metadatos de extended entities para esta Publicación con un GIF animado:
Ejemplos de payloads con enriquecimiento nativo
Publicación
Respuesta a una Publicación
Publicación extendida
Publicación con extended_entitites
Retweet
Tweet citado
Retuit de Tweet citado
Objetos de datos de Enterprise Activity Streams
¿Quieres obtener más información sobre cómo el formato de datos de Activity Streams se corresponde con el formato de X API v2?
Ten en cuenta: se recomienda encarecidamente usar el formato Enriched Native para las API de datos empresariales.
- El formato Enriched Native incluye todos los metadatos nuevos desde 2017, como los metadatos de encuestas, y métricas adicionales como reply_count y quote_count.
- El formato Activity Streams no se ha actualizado con nuevos metadatos ni enriquecimientos desde la actualización de caracteres en 2017.
Objeto de actividad
note, person, place y service. Las Publicaciones pueden tener otros objetos de actividad de Publicación anidados para Retweets u otros, incluyendo twitter_quoted_status, long_object.
El tipo de objeto de nivel básico activity es similar al objeto de nivel básico de Post del formato nativo enriquecido. Se pueden encontrar ejemplos de cargas útiles en formato Activity Streams aquí.
Diccionario de datos
Atributos adicionales de la Publicación
Atributos obsoletos
Objetos de actividad de Publicaciones anidadas
{ "id": "tag:search.x.com,2005:222222222222", "objectType": "activity", "verb": "post", "body": "Quoting a Tweet: https://t.co/mxiFJ59FlB", "actor": { "displayName": "TheQuoter2" }, "object": { "objectType": "note", "id": "object:search.x.com,2005:111111111", "summary": "https://t.co/mxiFJ59FlB" }, "twitter_entities": {}, "twitter_extended_entities": {}, "gnip": {}, "twitter_quoted_status": { "id": "tag:search.x.com,2005:111111111", "objectType": "activity", "verb": "post", "body": "console.log('Happy birthday, JavaScript!');", "actor": { "displayName": "TheOriginalTweeter" }, "object": { "objectType": "note", "id": "object:search.x.com,2005:111111111" }, "twitter_entities": {} } }
Tweet citado retuiteado:
Objeto long
Objeto Actor
Diccionario de datos
Atributos que ya no se admiten (obsoletos)
Ejemplos:
Objeto Location
Diccionario de datos de Location
objetos derivados de profileLocations
Ejemplos
Objeto de entidades de X
twitter_entities tiene el mismo formato y diccionario de datos que en el formato enriquecido nativo objeto entities aquí.
Ejemplo:
Objeto de entidades extendidas de X
twitter_extended_entities utiliza el mismo formato y diccionario de datos que se muestra en el formato nativo enriquecido en el objeto extended_entities aquí.
Ejemplo:
Objeto Gnip
Diccionario de datos
Ejemplo:
Ejemplos de cargas útiles de Activity Streams
twitter_extended_entities
Cronología de metadatos de Tweet
Introduction**
En esencia, X es una red de comunicación pública, en tiempo real y global. Desde 2006, la evolución de X ha estado impulsada tanto por los patrones de uso y las convenciones de los usuarios como por nuevas funciones y mejoras de producto. Si usas datos de X para investigación histórica, entender la cronología de esta evolución es importante para poder encontrar Publicaciones de interés en el archivo de datos. X se lanzó como una sencilla App móvil basada en SMS y ha crecido hasta convertirse en una plataforma de comunicación completa. Una plataforma con un conjunto completo de APIs. Las APIs siempre han sido un pilar de la red de X. La primera API se puso en marcha poco después del lanzamiento de X. Cuando el etiquetado geográfico de Publicaciones se introdujo por primera vez en 2009, se ofreció mediante una Geo API (y más tarde la capacidad de “etiquetar geográficamente” una Publicación se integró en la interfaz de usuario de X.com). Hoy en día, las APIs de X impulsan la red de comunicación bidireccional que se ha convertido en la fuente de noticias de última hora y de intercambio de información. Las oportunidades para crear soluciones sobre este canal de comunicación global y en tiempo real son infinitas. X pone a disposición dos APIs históricas que proporcionan acceso a cada Publicación disponible públicamente: Historical PowerTrack y la Full-Archive Search API. Ambas APIs ofrecen un conjunto de operadores que se utilizan para consultar y recopilar Publicaciones de interés. Estos operadores buscan coincidencias en una variedad de atributos asociados con cada Publicación, cientos de atributos como el contenido de texto de la Publicación, el nombre de cuenta del autor y los enlaces compartidos en la Publicación. Las Publicaciones y sus atributos se codifican en JSON, un formato de intercambio de datos de texto muy común. Por lo tanto, a medida que se introducían nuevas funciones, aparecían nuevos atributos JSON y, normalmente, se introducían nuevos operadores de API para hacer coincidir esos atributos. Si tu caso de uso incluye la necesidad de escuchar lo que el mundo ha dicho en X, cuanto mejor entiendas cuándo los operadores empezaron a disponer de metadatos JSON con los que buscar coincidencias, más eficaces podrán ser tus filtros históricos de PowerTrack. A continuación, presentaremos algunos conceptos clave que sientan las bases para entender cómo las actualizaciones en los metadatos de las Publicaciones afectan a la búsqueda de tu señal de datos de interés.Conceptos clave**
De convenciones de usuario a objetos de primera clase en X
Metadatos de la Publicación, mutabilidad, actualizaciones y vigencia
Contenido multimedia “nativo”
has:videos, has:images y has:media. Estos solo coincidirán con contenido multimedia que se haya compartido a través de funciones de X. Para hacer coincidir otro contenido multimedia alojado fuera de la plataforma de X, deberás usar Operadores que coincidan con metadatos de la URL.
Entonces, antes de profundizar en los detalles del producto Historical PowerTrack y Full-Archive Search, hagamos un recorrido por cómo X, como producto y plataforma, ha evolucionado con el tiempo.
Cronología de X
A continuación encontrarás una cronología seleccionada de X. La mayoría de estas actualizaciones de X afectaron de alguna manera, de forma fundamental, el comportamiento de los usuarios, el contenido JSON de las Publicaciones, los Operadores de consulta o los tres. Si consideramos X como una plataforma de API, los siguientes eventos afectaron de alguna manera las cargas (payloads) JSON que se utilizan para codificar Publicaciones. A su vez, esos detalles JSON afectan cómo las API históricas de X coinciden con ellas.
Ten en cuenta que esta lista cronológica es en general precisa, pero no exhaustiva.
2006
- Octubre
- @replies pasa a ser una convención.
- Cashtags pasaron a ser un enlace sobre el que se podía hacer clic y que se podía buscar en junio de 2012.
- Noviembre - Se introducen los Favoritos.
2007
- Enero - las @replies se convierten en un objeto de primera clase con un botón de respuesta en la interfaz de usuario y metadatos
in_reply_to. - Abril - los Retweets se convierten en una convención.
- Agosto - los #hashtags surgen como una herramienta principal para buscar y organizar Publicaciones.
2009
- Febrero - los $cashtags se convierten en una convención común para hablar de símbolos bursátiles.
- Mayo - se introduce la versión ‘beta’ del Retweet con “Via @” añadido al cuerpo de la Publicación.
- Junio - se introducen las cuentas verificadas.
- Agosto - los Retweets se convierten en un objeto de primera clase con el patrón “RT @” y nuevos metadatos
retweet_status. - Octubre - se lanza la función de Listas.
- Noviembre - se lanza la API de geotagging de Publicaciones, que proporciona el primer método para que los usuarios compartan su ubicación a través de apps de terceros.
2010
- Junio: se introduce X Places para geoetiquetar Publicaciones.
- Agosto: se lanza el botón de Publicación para sitios web, lo que facilitó compartir enlaces.
2011
- Mayo: se introduce el botón Seguir (Follow), que facilita seguir cuentas asociadas a sitios web.
- Agosto: se introducen las fotos nativas.
2012
- junio: los $Cashtags se convierten en un enlace en el que se puede hacer clic y que se puede buscar.
2014
- Marzo - se admite el etiquetado de fotos y hasta cuatro fotos. Se introdujeron los metadatos de X Entities extendidos.
- Abril - los emoji se admiten de forma nativa en la interfaz de usuario de X. Los emoji se utilizaban habitualmente en Publicaciones al menos desde 2008.
2015
- abril: un cambio en el diseño de la interfaz de usuario de las Publicaciones de X provoca que se etiqueten geográficamente menos Publicaciones.
- octubre: se introdujeron las encuestas de X. Inicialmente, las encuestas admitían dos opciones con un período de votación de 24 horas. En noviembre, las encuestas empezaron a admitir cuatro opciones con períodos de votación de 5 minutos a siete días. Los metadatos de las encuestas se pusieron a disposición (solo en formato nativo enriquecido) en febrero de 2017.
2016
- Febrero: Searchable GIFs natively hosted in Post compose.
- Mayo: “Doing More with 140” (dmw140) se anunció, indicando planes para nuevas formas de gestionar las respuestas y los medios adjuntos con respecto al límite de 140 caracteres de una Publicación.
- Junio: Native video support.
- Junio: los Retweets citados están disponibles de forma general.
- Junio: Stickers introduced for adding to photos.
- Septiembre: ‘Native attachments’ introduced, donde la URL final no se cuenta en los 140 caracteres (“dmw140, parte 1”).
2017
- Febrero: los metadatos de encuestas de X se incluyen en los metadatos de la Publicación (solo formato nativo enriquecido).
- Abril: se introducen las “Simplified Replies”, con las cuentas a las que se responde sin contarse dentro de los 140 caracteres (“dmw140, part 2”).
- Mayo: con las actualizaciones por el RGPD,
user.time_zonese establece en null,user.utc_offsetse establece en null yuser.profile_background_image_urlse establece en el valor predeterminado. - Junio: actualización de los cambios en el formato de quoteTweet
- 29 de septiembre: se habilita la capacidad de editar Publicaciones para un pequeño grupo de prueba. Los metadatos de Publicaciones editadas se añaden al objeto de la Publicación cuando corresponde. Esto incluye los objetos
edit_historyyedit_controls. Estos metadatos no se devolverán para Publicaciones que se crearon antes de que se añadiera la funcionalidad de edición. No hay Operators asociados para estos metadatos. Para obtener más información sobre cómo funcionan las ediciones de Publicaciones, consulta los Fundamentos de edición de Publicaciones
lang:, que se usa para hacer coincidir Publicaciones en un idioma específico. X proporciona un servicio de clasificación de idioma (que admite más de 50 idiomas), y las APIs de X proporcionan estos metadatos en el JSON que se genera para cada Publicación. Así, si una Publicación está escrita en español, el atributo JSON lang se establece en es. Por lo tanto, si creas un filtro con la cláusula lang:es, solo coincidirá con Publicaciones clasificadas como español.
La información de la cronología también puede ayudar a interpretar mejor los datos de las Publicaciones recibidas. Supongamos que investigas el intercambio de contenido sobre los Juegos Olímpicos de Verano de 2008 y 2012. Si aplicas únicamente el operador is:retweet para hacer coincidir Retweets, no habría datos que coincidan en 2008. Sin embargo, para 2012 probablemente habría millones de Retweets. A partir de esto, podrías concluir erróneamente que en 2008 los Retweets no eran una convención de uso, o que simplemente nadie hizo Retweet sobre esos Juegos Olímpicos. Dado que los Retweets se convirtieron en un objeto de primera clase en 2009, debes añadir una cláusula de regla "RT @" para ayudarte a identificarlos en 2008.
Tanto los Retweets como la clasificación por idioma de las Publicaciones son ejemplos de atributos de Publicación con una larga historia y muchos detalles de producto. A continuación, hablaremos con más detalle sobre estas y otras clases de atributos importantes para hacer coincidencias y para comprender los datos de X.
Reconocer falsos negativos
has:videos, que hace coincidir Publicaciones con videos nativos, esa cláusula no coincidirá con ninguna Publicación anterior a 2015.
Sin embargo, compartir videos ha sido común en X mucho antes de 2015. Antes de esa fecha, los usuarios compartían enlaces a videos alojados en otros sitios, pero en 2015 X incorporó nuevas funciones de “compartir video” directamente en la plataforma. Para encontrar estas Publicaciones anteriores de interés, deberías incluir una cláusula de regla como url:"youtube.com".
Ten en cuenta que, con las APIs de Search, hay algunos ejemplos de metadatos que se han “rellenado retrospectivamente” a medida que se reconstruía su índice. Un buen ejemplo son los cashtag en 2015, se reconstruyó el índice de Search y, en ese proceso, la entidad del símbolo se extrajo de todos los cuerpos de las Publicaciones, incluidos los de principios de 2006, cuando $ se usaba principalmente como jerga: “I hope it $oon!”.
Identificar y filtrar atributos de Publicaciones importantes para tu caso de uso
Perfiles de X
Publicación original y Retweets
is:retweet permite a los usuarios incluir o excluir Retweets. Si se extraen datos de antes de agosto de 2009, los usuarios necesitan dos estrategias para hacer coincidir (o no) los Retweets. Antes de agosto de 2009, es necesario comprobar el propio texto de la Publicación, utilizando coincidencia de frase exacta, para buscar coincidencias con el patrón “@RT ”. Para periodos posteriores a agosto de 2009, el operador is:retweet está disponible.
Clasificaciones de idioma de las Publicaciones
lang: está disponible para todo el archivo de Publicaciones. Con Historical PowerTrack, los metadatos de clasificación de idioma de X están disponibles en el archivo a partir del 26 de marzo de 2013.
Georreferenciar Publicaciones
- Referencias geográficas en el mensaje de una Publicación
- Publicaciones etiquetadas con ubicación por el usuario
- Ubicación «principal» del perfil de la cuenta configurada por un usuario