Ir al contenido

AFP publica un estudio hasta ahora, y no tiene resultados aún: el benchmark de comentario a MD, cuyo método para medir la tasa de coincidencia, la tasa de entrega y el tiempo al primer MD está escrito antes de que existan datos. Ningún número medido aparece en ninguna parte de esta sección hoy. Cuando la primera ejecución termine, sus resultados y el conjunto de datos sin procesar se publican en la misma página que el método que los produjo.

EstudioLa pregunta que respondeEstado
Metodología del benchmark de comentario a MD¿Cómo debería medirse el rendimiento de la automatización de comentario a MD?Metodología publicada; recolección de datos no iniciada

Cinco reglas aplican a cada página en esta sección, y una página que no puede cumplirlas no se publica como investigación.

  1. Definiciones antes de números. Cada métrica está definida con suficiente precisión que un extraño leyendo solo la definición contaría los mismos eventos.
  2. El procedimiento se publica completo — muestra, duración, entorno, qué se mantuvo fijo y qué no — así el estudio se puede volver a ejecutar por alguien que no trabaja en AFP.
  3. El conjunto de datos sin procesar se publica, en un formato documentado, junto al resumen. Un resumen sin un conjunto de datos detrás es una afirmación.
  4. Las limitaciones se listan. Cualquier cosa que haría a un lector descontar el resultado se declara en la página en lugar de dejarse para ser descubierto.
  5. Cada número es medido. Ninguna cifra se estima, se redondea desde una corazonada o se trae de otro estudio, y cada una tiene fecha y se atribuye a la ejecución que la produjo.

¿Por qué el método se publica antes de los números?

Sección titulada «¿Por qué el método se publica antes de los números?»

Un número sin método detrás no se puede comprobar, así no tiene peso — y un protocolo escrito después de que los datos están siempre se puede moldear para favorecer el resultado. Publicar el procedimiento primero fija qué cuenta como éxito antes de que nadie sepa cómo fue la ejecución, y le permite a un lector estar en desacuerdo con el diseño en lugar de argumentar con una cifra desnuda.

Nada sobre un estudio sin terminar está oculto aquí. La columna de estado arriba dice exactamente qué tan lejos ha llegado cada uno, y cambia solo cuando una ejecución termina.

Tres superficies en el producto registran lo que la automatización hizo, y cada medición en esta sección se construye desde ellas en lugar de desde instrumentación que un lector no puede ver.

SuperficieQué registraPara qué sirve
Historial de ejecución de campañaEl camino que cada ejecución tomó por el grafo, el nodo en el que se detuvo y el error registrado contra un falloSi un comentario coincidió, y qué rama tomó
Feed de actividadUna fila por comentario que AFP manejó en una página conectada, con el resultado registrado contra él y un filtro de errores sobre los tres tipos de falloContar resultados entre páginas y encontrar comentarios sobre los que AFP no pudo actuar
Exportación de actividadEl feed filtrado como una descarga JSON, con la hora de exportación en el nombre del archivoAnálisis fuera del producto y publicar un conjunto de datos

El historial de ejecución muestra las 20 ejecuciones más recientes de una campaña y no se refresca solo, lo cual es la principal restricción práctica en el tamaño del lote en cualquier estudio que lo lea. Probar y depurar una campaña cubre cómo leer ambas vistas.

Las ejecuciones de prueba deliberadamente no son un instrumento de medición para entrega o temporización. Recorren el mismo grafo que una ejecución real pero no hacen llamadas a Facebook o Instagram, así pueden confirmar qué rama toma un mensaje y nada sobre qué tan rápido o si un MD llega.

  • No hay números de rendimiento de la competencia. AFP no ha medido ninguno, y las páginas de comparación marcan cada afirmación de la competencia como material público no verificado en lugar de disfrazarlo de datos.
  • No hay afirmaciones de entregabilidad o alcance. Lo que Facebook e Instagram hacen con un mensaje una vez que AFP lo entrega está fuera de cualquier cosa medida aquí.
  • No hay cifras de límites de plan. Los límites son configuración por plan que cambia; Límites de plan explica qué límites existen sin fijar números que se volverían obsoletos.
  • La versión en inglés es la autoridad. El método y el conjunto de datos tienen una versión autoritaria en inglés; las traducciones son informativas.