Já usou esta ferramenta? Avalie-a
Já usou esta ferramenta? Avalie-a
A Appen é uma empresa de dados de treinamento de IA que vende dados produzidos e validados por pessoas, anotação de dados e avaliação de modelos a equipes que criam sistemas de IA. Fundada em Sydney em 1996, começou focada em dados de fala e linguagem para os primeiros sistemas de NLP. Hoje está listada na Australian Securities Exchange com o código APX. A Appen descreve sua missão como entregar dados validados por especialistas que treinam modelos de ponta, para que os sistemas de IA entendam nuance, contexto e complexidade em escala.
Atua nos dois lados do mesmo mercado:
A Appen informa mais de 1 milhão de colaboradores verificados, mais de 170 países representados e mais de 235 idiomas suportados. Em 2018, ano de sua listagem na ASX, a Appen adquiriu a Figure Eight para ampliar as capacidades da plataforma.
A Appen organiza o trabalho de dados sob medida em seis linhas de produtos, cada uma voltada a uma etapa do desenvolvimento de modelos modernos:
Para esse RLHF especializado, a Appen afirma que classificações de preferência e retorno comparativo vêm de doutores, médicos e juristas verificados em medicina, direito, ciência e finanças, e argumenta que a anotação colaborativa padrão não pode julgar se um diagnóstico clínico ou um argumento jurídico está correto. Suas auditorias regulatórias avaliam as saídas dos modelos com base na Lei de IA da UE, no NIST AI RMF e em estruturas éticas organizacionais.
Uma linha separada de código oferece conjuntos de dados em nível de repositório para treinar e avaliar LLMs e agentes de programação, com mais de 60 ambientes, mais de 50 linguagens e 500 tarefas de RL verificáveis. Os ambientes são descritos como privados e fora de índices públicos de código, então as avaliações podem ocorrer sem sobreposição conhecida com os dados de treinamento.
O ADAP é a plataforma de anotação de dados da Appen; segundo a Appen, une automação e supervisão humana para entregar dados em ampla gama de modalidades e casos de uso de IA. Seus principais recursos, segundo a Appen:
O catálogo da Appen reúne 596 conjuntos de dados em oito categorias, de tarefas de RL e verificadores a fala, código e dados corporativos. Cada conjunto traz uma ficha técnica com fonte, consentimento, método de anotação, limitações conhecidas e termos de licença. A Appen apresenta a escolha assim: conjuntos prontos cobrem categorias comuns em condições padrão e são entregues em dias, e a coleta sob medida serve quando um projeto precisa de perfis demográficos específicos, ambientes acústicos controlados ou cobertura de domínios especializados.
A Appen também mantém um programa do lado da oferta: empresas licenciam os fluxos de trabalho e o conhecimento operacional com que já funcionam a laboratórios de IA que criam novos modelos, e a Appen cuida da extração, da anonimização e das conversas com os laboratórios. O programa abrange três categorias de dados operacionais: documentação operacional, registros de decisões e escalonamentos, e sistemas de registro.
Os estudos de caso publicados pela Appen mostram o leque de trabalhos assumidos; os números são da própria empresa.
A Appen é indicada para:
É menos indicada para:
As tarefas móveis são sobretudo fotografar objetos, gravar vídeo ou gravar áudio, e a Appen recomenda um computador para algumas etapas de cadastro e seleção de projetos antes de trabalhar no app.
A Appen não publica preços para compradores. Nas páginas oficiais verificadas para esta análise, incluindo o mapa do site completo, não há tabela de preços, quadro de planos nem pagamento por autoatendimento, e o formulário de contato da equipe de dados de IA é indicado apenas para consultas comerciais e de vendas.
A licença padrão do catálogo é perpétua e não exclusiva, com direitos de treinamento comercial, e o tipo de licença consta na ficha técnica de cada conjunto. Para dados corporativos, cada parceria tem cotação individual, os termos são acordados por escrito antes de qualquer extração e o pagamento ocorre no aceite. A Appen cobre extração, anonimização, preparação e transferência, sem custos iniciais, sem taxas de configuração nem descontos sobre o que os parceiros recebem. O valor cresce com a raridade do conhecimento operacional, o grau de conexão dos sistemas de origem, o volume de dados e sua profundidade histórica.
O CrowdGen anuncia $100+/h como maior pagamento por hora, com uma nota de rodapé dizendo que a taxa depende da localização e das habilidades. Clínicos e especialistas jurídicos têm os tetos mais altos por área, até $450/h e até $400/h; engenheiros de software chegam a até $150/h e linguistas a até $95/h. Em finanças, os tetos vão de no máximo $150/h para gestores de investimentos a no máximo $180/h para analistas de FP&A, e administradores de saúde têm teto de até $90/h. São tetos, não ganhos típicos. O CrowdGen afirma que as taxas são informadas claramente antes do início do trabalho. A Appen também diz que nunca pedirá aos colaboradores que paguem nada para participar de seus projetos.
Serviços que se sobrepõem à Appen, resumidos segundo o próprio posicionamento:
A oferta própria da Appen acrescenta um catálogo de conjuntos de dados licenciáveis, um programa de licenciamento de dados operacionais corporativos e dados de IA física capturados, sincronizados e anotados de ponta a ponta em instalações construídas para isso.
Sim. O CrowdGen se descreve como a plataforma de colaboradores da Appen, e a página antigolpes da Appen lista crowdgen.com e app.crowdgen.com entre seus sites oficiais.
A Appen afirma que nunca pedirá que enviem dinheiro para se candidatar ou começar um trabalho, nunca envia cheques antecipadamente e só envia e-mails oficiais de endereços @appen.com.
A maior parte dos ganhos é informada em dólares americanos e paga em moeda local, com saques por transferência bancária, PayPal, Payoneer, Airtm e outros métodos.