募集中のポジション一覧
プラットフォーム/Forward Deployed Engineeringフルタイムサンフランシスコ(オンサイト)

Forward Deployed Engineer(言語モデル)

Artificial Analysisについて

Artificial Analysisは、独立系AIベンチマーク企業のリーディングカンパニーです。AIラボ、エンジニア、企業がAIの能力を理解し、AI戦略に関する重要な意思決定を行えるよう支援しています。AIラボや企業からメディア、投資家、政策立案者まで、AIを理解するための信頼できる情報源として選ばれています。当社のベンチマークはAIの最先端を測るだけでなく、そのフロンティア自体を形づくっています。

当社のベンチマークと分析は数十万人のユーザーから信頼され、OpenAI、Google、Meta、NVIDIA、Anthropicなどの主要AIラボや、The Wall Street Journal、Bloomberg、Financial Times、The Economistなどの主要メディアにとって定番の情報源となっています。

当社は40人を超えるチームで、年末までに3倍の規模へ成長する見込みです。Nat Friedman(Github、Meta)、Daniel Gross(SSI)、Andrew Ng(Google Brain、DeepLearning.ai、Amazon)、Adam D'Angelo(Quora、Poe、OpenAI)、Clem Delangue(Hugging Face)をはじめとする業界リーダーから支援を受けています。

このポジションについて

Artificial Analysisは、業界で最も包括的な言語モデルベンチマークスイートの一つを運営しています。当社のデータを頼りにするAIラボや企業のために、フロンティアモデルの品質、速度、料金を評価しています。

言語モデルベンチマークスタックの日常運用を担い、業界で最も重要なラボに対するArtificial Analysisの技術窓口となるForward Deployed Engineerを募集します。新しいモデルを評価パイプラインに導入し、ベンチマークを実行・デバッグします。また、AIラボの顧客に対する主要な技術窓口として、結果の説明、方法論に関する質問への対応、エンドポイント問題のリアルタイム解決を担います。

真の意味でのデプロイ型の役割です。当社のプラットフォームと最も高度な顧客との接点に立ち、双方が機能することに責任を持ちます。高度なスタックを卓越した水準で一貫して確実に運用し、顧客から名指しで頼られる信頼のエンジニアであることがこの仕事です。

業務内容

  • Pythonベースの言語モデルベンチマークパイプラインをエンドツーエンドで運用・保守する。新しいモデルの導入、評価の設定、ベンチマーク実行、結果の検証を担う
  • APIエンドポイントのタイムアウトやエラーから想定外のベンチマーク出力まで、スタック全体の問題をデバッグし、迅速に解決する
  • AIラボの顧客に対する主要な技術窓口となる。ベンチマーク結果を明確に伝え、方法論を説明し、技術的な質問に答え、Slackやビデオ会議を通じて統合上の問題を解決する
  • ベンチマーク実行の異常を監視し、不一致を調査して、公開結果の正確性と完全性を確保する
  • プロセス、既知の問題、モデル固有の設定に関するドキュメントを維持する
  • エンジニアリングチームと連携してパイプラインの改善点を特定し、プロセス改善に貢献する
  • 新しいモデルのリリース、APIの変更、言語モデルエコシステム全体の動向を常に把握する

求める人物像

必須要件:

  • 顧客対応型の技術職(Solutions Engineering、Support Engineering、技術コンサルティングなど)で3年以上の経験。Stripe、Vercel、Cloudflare、Datadog、Palantir、Accentureまたは同等の企業での経験を想定
  • 高いPythonスキルと、自分が書いたものではない複雑なコードベースを扱う力
  • AI/MLモデルAPI(OpenAI、Anthropic、Google、Metaなど)を実際に扱った経験
  • 優れたデバッグ力。API、データパイプライン、コードをまたいで問題を追跡できること
  • 技術的な概念を技術系ステークホルダーに明確に説明できる、優れた英語の文章・口頭コミュニケーション力
  • 迅速かつ信頼できる対応力。顧客の問題に責任を持ち、最後まで対応できること
  • 運用中心の反復的な業務に抵抗がなく、高い水準で運営することにやりがいを感じること
  • 細部への高い注意力と、プレッシャー下での冷静さ

歓迎要件(必須ではありません):

  • AI評価、ベンチマーク、テスト方法論の経験
  • LLM推論インフラ(トークン化、遅延測定、スループット指標)に関する知識
  • AIラボまたはモデルプロバイダーでの勤務・協働経験
  • B2B SaaSまたは開発者向けツールの経験

Artificial Analysisで働く理由

  • AI開発のあり方を形づくる:主要AIラボは当社のベンチマークを追跡し、開発優先順位の判断に活用しています。あなたの仕事がAIの進む方向に直接影響します。
  • AIの世界的エキスパートになる:主要モデルがリリースされるたびに、主要な能力のすべてを評価します。これほど幅広くフロンティアAIに触れられる仕事はほとんどありません。
  • AI業界の最重要プレイヤーと働く:信頼される独立した立場から、主要AIラボや大手企業のチームとの関係を担います。
  • 決定的な成長期に加わる:当社は40人を超え、年末までに倍増する見込みで、AI業界で強いネットワークを持つ投資家から支援を受けています。今加わるメンバーが、事業拡大に伴うプロダクト、チーム、戦略を形づくります。
  • 株式報酬を含む競争力のある待遇

このポジションに興味がありますか?

応募書類をお送りください。追ってご連絡します。