技术团队成员(推理)
关于 Artificial Analysis
Artificial Analysis 是领先的独立 AI 基准测试公司。我们帮助实验室、工程师和企业理解 AI 能力,并就其 AI 战略做出关键决策。从 AI 实验室和企业,到媒体、投资者与政策制定者,我们都是了解 AI 的首选权威。我们的基准测试不仅衡量 AI 的前沿,还在积极塑造这一前沿。
我们的基准测试与分析受到数十万用户信赖,是 OpenAI、Google、Meta、NVIDIA 和 Anthropic 等领先 AI 实验室,以及《华尔街日报》、Bloomberg、《金融时报》和《经济学人》等主要媒体的首选参考。
我们是一支 40 多人的团队,有望在年底前将规模扩大至三倍,支持者包括 Nat Friedman(Github、Meta)、Daniel Gross(SSI)、Andrew Ng(Google Brain、DeepLearning.ai、Amazon)、Adam D'Angelo(Quora、Poe、OpenAI)、Clem Delangue(Hugging Face)及其他行业领袖。
职位机会
语言模型推理是 AI 领域变化最快的市场:数十家服务商、价格与性能持续变动,以及依赖独立数据的数十亿美元部署决策。我们的推理基准测试是行业参考标准,我们正在招聘一名技术团队成员来推动这项工作。
你将负责 serverless 推理格局的覆盖:对各接入点进行质量、速度与价格基准测试,将我们的方法扩展到缓存定价、接入点准确率和智能体性能等新维度,并直接与依据我们数据发布的推理服务商和 neocloud 合作。
你将负责
- 对推理格局进行基准测试:负责整个服务商生态中 serverless API 推理的性能与价格覆盖,从前沿实验室到专业服务商
- 扩展我们的方法:推动包括缓存定价、接入点准确率和智能体性能在内的新基准测试维度,使我们的衡量始终领先于行业部署方式
- 与服务商合作:直接与推理服务商和 neocloud 合作,对其接入点进行基准测试,解决方法问题,并塑造市场衡量服务性能的方式
- 分析市场:产出行业用于理解推理性能与经济性的分析,从吞吐量和首 Token 延迟到性价比前沿
- 推动产品方向:与我们的工程师和支柱负责人共同塑造推理基准测试平台的路线图
- 采用 AI 原生工作方式:拥抱 AI 原生工作流,利用前沿 AI 工具在快速变化的行业中提高效能,并保持我们在 AI 基准测试领域的竞争优势
我们期待你
你应当从内部了解推理市场。
相关背景包括:在推理服务商和 neocloud(如 Together AI、Fireworks、Baseten、Cerebras、Novita、Parasail、DeepInfra、Modal、CoreWeave、Lambda、Nebius、Crusoe 或同类公司)担任工程、产品、Developer Relations 或技术 GTM 职位,或在大规模生产环境中提供模型服务的团队。
要求:
- 3 年以上专业经验,其中至少 2 年在推理服务商、neocloud 或生产环境模型服务团队就职,或与其密切合作
- 出色的分析与批判性思维能力
- 熟练掌握 Python 和数据分析
- 熟悉模型服务栈(如 vLLM、SGLang、TensorRT-LLM)及各服务商的推理 API
- 精通推理性能指标与经济性:每秒 token 数、首 Token 延迟、吞吐量与延迟的权衡、每 token 成本
- 对前沿 AI 具有真实、可证明的兴趣和了解。我们需要的是对 AI 发展方向有充分依据的见解,而不仅仅是会使用 AI 工具的人
为什么选择 Artificial Analysis?
- 影响 AI 的构建方式:领先的 AI 实验室会追踪我们的基准测试,并以此指导开发重点。你的工作将直接影响 AI 的发展方向。
- 成为世界级 AI 专家:每当重要模型发布时,你都会从各项主要能力维度对其进行评估。很少有职位能让你如此广泛地接触前沿 AI。
- 与 AI 领域最重要的参与者合作:你将作为值得信赖的独立声音,与领先 AI 实验室和大型企业的团队建立并管理合作关系。
- 在关键时刻加入:我们有 40 多人,正按计划在年底前将规模扩大一倍,并获得了 AI 领域人脉最广泛的一批投资者支持。现在加入的人将在公司规模扩张的过程中塑造产品、团队和战略。
- 具有竞争力的薪酬,包括股权