Todos los puestos abiertos
Equipo técnico (incl. Producto)Tiempo completoSan Francisco (presencial)

Miembro del equipo técnico (investigación aplicada de IA)

Sobre Artificial Analysis

Artificial Analysis es la empresa independiente líder en benchmarking de IA. Ayudamos a laboratorios, ingenieros y empresas a entender las capacidades de la IA y a tomar decisiones críticas sobre sus estrategias de IA. Somos la referencia para entender la IA, desde laboratorios y empresas hasta medios, inversores y responsables de políticas públicas. Nuestros benchmarks no solo miden la frontera de la IA: ayudan activamente a definirla.

Nuestros benchmarks y análisis cuentan con la confianza de cientos de miles de usuarios y son una referencia para laboratorios de IA líderes como OpenAI, Google, Meta, NVIDIA y Anthropic, y para publicaciones como The Wall Street Journal, Bloomberg, Financial Times y The Economist.

Somos un equipo de más de 40 personas, en camino de triplicarnos antes de fin de año, respaldado por Nat Friedman (Github, Meta), Daniel Gross (SSI), Andrew Ng (Google Brain, DeepLearning.ai, Amazon), Adam D'Angelo (Quora, Poe, OpenAI), Clem Delangue (Hugging Face) y otros líderes de la industria.

La oportunidad

Nuestras evaluaciones deciden cómo el mundo mide la IA. Cuando un laboratorio de frontera lanza un modelo, nuestros benchmarks son la forma en que la industria descubre qué puede hacer realmente, y los propios laboratorios usan nuestros resultados para guiar lo que construyen a continuación. Este puesto te sitúa en la frontera de la medición: no solo observarás la vanguardia, tu trabajo definirá qué significa estar en la vanguardia.

Estamos contratando miembros del equipo técnico (investigación aplicada de IA) para diseñar las evaluaciones que marcan el estándar de cómo se mide la IA: construir benchmarks y datasets novedosos, evaluar todos los modelos principales a medida que se lanzan, trabajar con los laboratorios de frontera en modelos pre-lanzamiento antes de que el mundo los vea y publicar el análisis en el que confían laboratorios, empresas, medios y responsables de políticas públicas. El listón de éxito es convertirse en una autoridad mundial en IA moderna.

Es investigación aplicada con consecuencias inmediatas en la industria: ciclos más cortos que en la academia, más rigor que en el comentario de industria y una audiencia mayor que ambos. El centro del puesto es construir: la gran mayoría de tu tiempo se dedica a diseñar y lanzar evaluaciones, con el análisis y la colaboración con la industria construidos alrededor de ese trabajo.

Qué harás

  • Diseñar evaluaciones de frontera: concebir, construir y lanzar metodologías de evaluación novedosas que hagan avanzar cómo se miden las capacidades de la IA y que se adelanten a lo que pueden hacer los modelos de frontera
  • Construir datasets e infraestructura de evaluación: construir los datasets, harnesses y sistemas de puntuación que hay detrás de nuestros benchmarks, diseñados para resistir la contaminación y ser reproducibles a escala de frontera
  • Evaluar todos los modelos principales: ejecutar nuestra suite de evaluación sobre los lanzamientos de frontera a medida que llegan y asumir la integridad de los resultados que la industria cita
  • Publicar análisis influyentes: producir los informes, índices y visualizaciones de datos que dan forma a cómo los laboratorios, las empresas y la industria en general entienden el progreso de la IA
  • Trabajar con laboratorios de frontera en modelos pre-lanzamiento: evaluar los sistemas de los laboratorios líderes, incluidos modelos pre-lanzamiento y recién lanzados, trabajando directamente con sus equipos de investigación; nuestro equipo comercial lleva el día a día de las relaciones con clientes, así que tu tiempo se queda en la ciencia
  • Adoptar un flujo de trabajo AI-native: usar herramientas de IA de vanguardia para generar apalancamiento en una industria que cambia rápido y mantener nuestra ventaja competitiva en benchmarking de IA

Qué buscamos

Requerimos más de 3 años de experiencia profesional relevante, en industria o investigación. Tienes un interés intenso por la IA, el deseo de convertirte en experto/a mundial en el campo y sólidas habilidades analíticas y de programación para respaldarlo.

Más allá de ese listón, contratamos desde tres tipos de perfiles. Deberías encajar claramente en uno de ellos:

IA y machine learning

Perfiles habituales: ML Engineer, ML Researcher, Research Engineer, AI Engineer, Forward Deployed Engineer, Technical PM o roles similares en empresas de IA o equipos centrados en IA.

Tienes experiencia práctica con sistemas modernos de IA y entiendes cómo funcionan los modelos a nivel técnico. Quieres que tu trabajo se lance más rápido que un paper e importe más que un dashboard: evaluaciones que ve toda la industria, en un ciclo medido en días.

Consultoría estratégica

Perfiles habituales: Management Consultant, Associate, Engagement Manager, Data Scientist o roles similares en firmas como McKinsey, BCG, Bain o equivalentes. Daremos preferencia a candidatos con experiencia en una división de Data Analytics como QuantumBlack, AI by McKinsey, BCG X o equivalentes.

Sabes estructurar problemas ambiguos, construir marcos analíticos y comunicar hallazgos a stakeholders senior. Diferenciador clave: interés técnico genuino por la IA y capacidad para programar. Sigues los lanzamientos de modelos, tienes opiniones sobre hacia dónde va la tecnología y quieres estar más cerca del tema de lo que permite la consultoría.

Product management técnico

Perfiles habituales: Founding Engineer, Product Manager, cofundador/a técnico/a, Head of Product o roles generalistas en empresas de IA early-stage.

Has construido y lanzado productos de IA en entornos rápidos, operando simultáneamente entre investigación, ingeniería, producto y negocio. Buscas un rol donde esa amplitud sea el trabajo, no un efecto secundario de estar temprano en una empresa pequeña.

En los tres perfiles requerimos:

  • Sólidas habilidades analíticas y de pensamiento crítico
  • Dominio de Python y análisis de datos
  • Interés y conocimiento genuinos y demostrables de la IA de frontera. Buscamos personas con opiniones informadas sobre hacia dónde va la IA, no solo personas que usan herramientas de IA

¿Por qué Artificial Analysis?

  • Influye en cómo se construye la IA: los laboratorios líderes siguen nuestros benchmarks y los usan para guiar sus prioridades de desarrollo. Tu trabajo influirá directamente en la dirección de la IA.
  • Conviértete en experto/a mundial en IA: evaluarás todos los modelos principales, en todas las capacidades relevantes, a medida que se lanzan. Muy pocos puestos ofrecen esta amplitud de exposición a la IA de frontera.
  • Trabaja con los actores más importantes de la IA: gestionarás relaciones con equipos de los principales laboratorios de IA y grandes empresas como una voz independiente y de confianza.
  • Únete en un momento decisivo: somos más de 40 personas, en camino de duplicarnos antes de fin de año, respaldados por algunos de los inversores mejor conectados en IA. Quienes se unan ahora darán forma al producto, al equipo y a la estrategia mientras escalamos.
  • Compensación competitiva, incluida participación accionaria

¿Te interesa este puesto?

Envíanos tu candidatura y nos pondremos en contacto.