検索結果へ条件を変える

株式会社Ollo

【東大松尾研発AIベンチャー】AI/MLエンジニア(Vision Language Model・動画認識)

月給 58万円〜83万円

東京都 文京区正社員

【募集背景】

求人ID 418242/更新 2026/8/25

仕事内容

【募集背景】 当社のコア技術である動画認識AIは、世界中の製造現場で日々膨大な作業映像を解析しています。このポジションでは、動画認識モデル(Vision Language Model、VLM)の開発・改善を中心に担っていただきます。 具体的には、以下のような方向でモデルを進化させていきます。 モデルの精度や実行スピードの向上 動画を対象としたRAG(Video RAG)による現場ナレッジの検索・活用 エッジデバイス上での大規模モデルの実行 製造ラインでのリアルタイム推論 研究と実装の両面で取り組むべきテーマが多く、中心メンバーとして関わっていただけるポジションです。 【業務内容】 ・製造現場の作業動画を解析するVision Language Modelの研究開発・改善 ・行動認識・姿勢推定・物体検出など、Computer Vision領域のモデル設計・学習・評価 ・多様な現場環境(照明・カメラ角度・作業内容)に対応するロバスト性の向上 ・エッジデバイス上での大規模モデルの最適化・デプロイ ・製造ラインにおけるリアルタイム推論パイプラインの構築 ・モデルの量子化・蒸留・プルーニングによる軽量化 【開発環境】 ・Webフロントエンド: TypeScript, Vue, Nuxt.js ・バックエンド: Go, GraphQL, Python(FastAPI) ・デザイン: figma ・データベース: MySQL ・コミュニケーションツール: Slack ・ドキュメント管理: Notion ・コード管理: GitHub ・laC: Terraform ・インフラ: AWS ・IDE: vscode ・CI/CD: GitHub Actions ・コーディング支援: Github Copilot

応募条件

学歴
大卒以上
経験・資格
以下のいずれか、または複数の実務経験(1年以上)もしくはそれに準ずる研究実績 ・動画・画像認識(物体検出、行動認識、セグメンテーション等) ・VLM / マルチモーダルモデル(Vision-Language系モデルの学習・活用) ・LLM(ファインチューニング、RAG、プロンプトエンジニアリング等) ・Python を用いたソフトウェア開発経験(1年以上) ・Deep Learningフレームワーク(PyTorch 等)の実践的な利用経験 職種未経験NG 業種未経験OK

給与・待遇

給与
月給 58万円〜83万円 ■ストックオプション制度あり ■賞与1ヶ月分(業績に応じて変動) ■ストックオプション制度あり ■賞与1ヶ月分(業績に応じて変動)
待遇・福利厚生
交通費支給,健康診断,社会保険完備 ・交通費支給 ・食事補助 ・社内フード/飲み物提供あり 賞与: 業績賞与 賞与実績: 1ヶ月分 インセンティブ: なし
受動喫煙防止
[禁煙]

勤務時間・休日

勤務時間
10:00〜18:00 夜間勤務: なし ■フレックスタイム制(休憩1時間) ■コアタイム:10:00-17:00 ■標準労働時間8時間 【勤務体制】 エンジニアチームメンバーはフル出社で気軽にコミュニケーションが取れる環境を作っています。少数精鋭の組織であること、プロダクトが比較的新しく、今後もスピーディに開発体制を構築する観点から、リアルコミュニケーションによる生産性の高さを追求しています。
休日・休暇
土日祝休み 年間休日: 123 [夏季休暇, GW休暇, 年末年始休暇, 有給休暇]

勤務地

勤務地
東京都 文京区
住所
東京都文京区本郷2丁目38番16号 いちご本郷三丁目ビル703

会社情報

会社名
株式会社Ollo
本社
東京 文京区本郷2丁目38番16号いちご本郷三丁目ビル(旧JEI本郷ビル)703
事業内容
その他IT・Webサービス [IT×バックオフィス]

会社ホームページを見る

月給 58万円〜83万円

この求人に応募する