仕事内容・ミッション
【募集背景】
当社のコア技術である動画認識AIは、世界中の製造現場で日々膨大な作業映像を解析しています。このポジションでは、動画認識モデル(Vision Language Model、VLM)の開発・改善を中心に担っていただきます。
具体的には、以下のような方向でモデルを進化させていきます。
モデルの精度や実行スピードの向上
動画を対象としたRAG(Video RAG)による現場ナレッジの検索・活用
エッジデバイス上での大規模モデルの実行
製造ラインでのリアルタイム推論
研究と実装の両面で取り組むべきテーマが多く、中心メンバーとして関わっていただけるポジションです。
【業務内容】
・製造現場の作業動画を解析するVision Language Modelの研究開発・改善
・行動認識・姿勢推定・物体検出など、Computer Vision領域のモデル設計・学習・評価
・多様な現場環境(照明・カメラ角度・作業内容)に対応するロバスト性の向上
・エッジデバイス上での大規模モデルの最適化・デプロイ
・製造ラインにおけるリアルタイム推論パイプラインの構築
・モデルの量子化・蒸留・プルーニングによる軽量化
【開発環境】
・Webフロントエンド: TypeScript, Vue, Nuxt.js
・バックエンド: Go, GraphQL, Python(FastAPI)
・デザイン: figma
・データベース: MySQL
・コミュニケーションツール: Slack
・ドキュメント管理: Notion
・コード管理: GitHub
・laC: Terraform
・インフラ: AWS
・IDE: vscode
・CI/CD: GitHub Actions
・コーディング支援: Github Copilot
アピールポイント
■少数精鋭のチームで、立ち上がったばかりのサービス開発をするため、一人当たりの裁量や権限が大きい。
■立場や役職に関係なく議論ができるフラットな社風のため、自身の考えや意見を主体的に提案することができる。
■弊社プロダクトは大手企業への導入実績があり、今後のさらなる拡大フェーズを体験でき、同時にスタートアップの組織拡大フェーズのコアメンバーとして活躍できる。
■エンジニアが、プロダクトが導入される工場に訪問する機会があるため、開発しているプロダクトがどのように使われ評価されているのかを自分の目で確かめられ、機能のアップデートや改善に直接繋げられる。
■東大出身のAI技術者が会社のほとんどを占めており、AI技術についてハイレベルに学べる環境がある。
■経験豊かな経営陣、ビジネスメンバーが多数在籍しているため、安定した取り組みが可能。
■日々の業務においては、エンジニアサイド・ビジネスサイド双方から質問/提案/顧客要望などがあればすぐコミュニケーションをとって解決を目指しているため、プロダクトグロースに関心が高いエンジニアにとってスムーズに業務推進ができる環境がある。
■エンジニアチームは平均年齢28歳のメンバーで構成されている。
■本ポジションでは、革新的な技術を駆使し、社会に貢献できるプロダクト開発に携わるチャンスがあります。
■高品質なソフトウェアを開発することで、顧客満足度向上に寄与できるだけでなく、チームとの密なコミュニケーションを通じて、自身の成長を実感できる環境が整っています。