¿Has usado esta herramienta? Valórala
¿Has usado esta herramienta? Valórala
Appen es una empresa de datos de entrenamiento de IA que vende datos producidos y validados por personas, anotación de datos y evaluación de modelos a equipos que crean sistemas de IA. Fundada en Sídney en 1996, al principio se centró en datos de voz y lenguaje para los primeros sistemas de NLP. Hoy cotiza en la Australian Securities Exchange con el código APX. Appen describe su labor como entregar datos validados por expertos que entrenan modelos de vanguardia, para que los sistemas de IA comprendan matices, contexto y complejidad a gran escala.
Trabaja en los dos lados de un mismo mercado:
Appen dice contar con más de 1 millón de colaboradores verificados, más de 170 países representados y más de 235 idiomas admitidos. En 2018, año de su salida a bolsa en la ASX, Appen adquirió Figure Eight para ampliar las capacidades de su plataforma.
Appen agrupa su trabajo de datos a medida en seis líneas de productos, cada una para una parte del desarrollo de modelos modernos:
Para este RLHF experto, Appen afirma que las clasificaciones de preferencias y la retroalimentación comparativa proceden de doctores, médicos y juristas verificados en medicina, derecho, ciencia y finanzas, y alega que la anotación colaborativa estándar no puede juzgar si un diagnóstico clínico o un argumento jurídico es correcto. Sus auditorías regulatorias evalúan las salidas de los modelos según la Ley de IA de la UE, el NIST AI RMF y marcos éticos organizativos.
Una línea de código aparte ofrece conjuntos de datos a nivel de repositorio para entrenar y evaluar LLM y agentes de programación: más de 60 entornos, más de 50 lenguajes y 500 tareas de RL verificables. Los entornos se describen como privados y fuera de los índices de código públicos, así que las evaluaciones pueden hacerse sin solapamiento conocido con los datos de entrenamiento.
ADAP es la plataforma de anotación de datos de Appen; según Appen, combina automatización y supervisión humana para entregar datos en una amplia variedad de modalidades y casos de uso de IA. Sus principales capacidades, según Appen:
El catálogo de Appen reúne 596 conjuntos de datos en ocho categorías, desde tareas de RL y verificadores hasta voz, código y datos empresariales. Cada conjunto trae una ficha técnica con fuente, consentimiento, método de anotación, limitaciones conocidas y condiciones de licencia. Appen plantea la elección así: los conjuntos listos para usar cubren categorías comunes en condiciones estándar y se entregan en días, y la recopilación a medida se usa cuando un proyecto necesita perfiles demográficos concretos, entornos acústicos controlados o cobertura de un dominio especializado.
Appen gestiona además un programa del lado de la oferta: las empresas licencian los flujos de trabajo y el conocimiento operativo con los que ya funcionan a laboratorios de IA que crean nuevos modelos, y Appen se ocupa de la extracción, la anonimización y el diálogo con los laboratorios. Abarca tres categorías de datos operativos: documentación operativa, registros de decisiones y escalados, y sistemas de registro.
Los casos de estudio publicados por Appen muestran el abanico de trabajos que asume; las cifras son de la propia empresa.
Appen encaja con:
Encaja peor con:
Las tareas móviles consisten sobre todo en fotografiar objetos, grabar vídeo o grabar audio, y Appen recomienda un ordenador para algunos pasos de registro y selección de proyectos antes de trabajar en la app.
Appen no publica precios para compradores. En las páginas oficiales revisadas para esta reseña, incluido el mapa del sitio completo, no hay lista de precios, tabla de planes ni pago de autoservicio, y el formulario de contacto del equipo de datos de IA indica que es solo para consultas comerciales y de ventas.
La licencia estándar del catálogo es perpetua y no exclusiva, con derechos de entrenamiento comercial, y el tipo de licencia figura en la ficha técnica de cada conjunto. Para los datos empresariales, cada alianza se presupuesta individualmente, las condiciones se acuerdan por escrito antes de extraer nada y se paga a la aceptación. Appen asume extracción, anonimización, preparación y transferencia, sin costes iniciales, sin tarifas de configuración ni deducciones de lo que se paga a los socios. El valor crece con la rareza del conocimiento operativo, el grado de conexión de los sistemas de origen, y el volumen de datos y su profundidad temporal.
CrowdGen anuncia $100+/h como pago horario máximo, con una nota al pie según la cual la tarifa depende de la ubicación y las habilidades. Clínicos y expertos jurídicos tienen los topes por dominio más altos, hasta $450/h y hasta $400/h; los ingenieros de software llegan hasta $150/h y los lingüistas hasta $95/h. En finanzas, los topes van de un máximo de $150/h para gestores de inversiones a un máximo de $180/h para analistas de FP&A, y los administradores sanitarios tienen un tope de hasta $90/h. Son topes, no ingresos típicos. CrowdGen afirma que las tarifas se indican claramente antes de empezar. Appen asegura además que nunca pedirá a los colaboradores que paguen nada por unirse a sus proyectos.
Servicios que se solapan con Appen, resumidos según su propio posicionamiento:
La oferta propia de Appen añade un catálogo de conjuntos de datos con licencia, un programa para licenciar datos operativos empresariales y datos de IA física capturados, sincronizados y anotados de principio a fin en instalaciones construidas para ello.
Sí. CrowdGen se presenta como la plataforma de colaboradores de Appen, y la página antiestafas de Appen incluye crowdgen.com y app.crowdgen.com entre sus webs oficiales.
Appen afirma que nunca pedirá a nadie enviar dinero para postularse o empezar un trabajo, que nunca envía cheques por adelantado y que solo envía correos oficiales desde direcciones @appen.com.
La mayoría de las ganancias se expresan en dólares estadounidenses y se pagan en moneda local, con retiros por transferencia bancaria, PayPal, Payoneer, Airtm y otros métodos.