- Workplace
- Remote
- Type
- Full-time
- Department
- Marketing
- Closing date
- Today
- Source
- Vincere
Description
株式会社Third Intelligence AI R&D - 04. Research Engineer - Post-training & Alignment / 事後学習
会社について
Third Intelligenceは、日本発のAGIの確立に挑戦する、AI研究・プロダクト開発企業です。Third Intelligenceが独自に提唱する「遍在型AGI(汎用人工知能)」の確立と個人に寄り添ったその成長を通じて、社会の新たな基盤となるサービスの実現を目指します。
私たちは、2つの事業を展開しています。
1つは、日本発の汎用人工知能(AGI)の実現。従来のような巨大なモデルを全利用者に一律に提供するのではなく、利用者に合わせて独自に成長する「遍在型AGI」の実現を目指しています。
もう1つは、遍在型AGIの特性を活かした生活者向けグローバルプロダクトの構築です。2026年1月に国内最大規模の100億円規模の初回資金調達を完了し、博報堂DYグループとの資本業務提携を経て、研究開発並びにプロダクト開発を加速しています。
ポジションについて
ポジションの意義・背景
事前学習を終えた基盤モデルを、実際に人間が使える知能へと仕上げる役割です。具体的には、SFT(教師あり微調整)やRLHF(人間のフィードバックからの強化学習)などの手法を用いて、モデルの応答品質、推論能力、安全性を高めます。プロダクトとしてのAIの価値を直接左右する重要な工程を担っていただきます。
業務内容・期待成果
SFT, RLHF, DPO等の手法を用いた、モデルの応答性能と推論能力の高度化
特定タスク(会話、プログラミング、数学、論理推論等)における思考プロセスの最適化と精度向上
ハルシネーションの抑制や安全性確保のための学習手法、および独自の評価メトリクスの設計
高品質な合成データの生成・選別パイプラインの構築と、データ効率の最大化
必須スキル
大規模言語モデル(LLM)のFine-tuningや、アラインメント手法に関する実務・研究経験
Python, PyTorch, Distributed Training Frameworks (DeepSpeed, FSDPなど) の深い知識
NLP領域の最新論文を自律的にキャッチアップし、その手法を迅速に再現・検証できる能力
歓迎スキル
基盤モデルの事前学習に関する知識や経験
フロンティアモデルの開発・運用実績
英語による技術議論およびグローバルな開発体制における業務経験
国際的な技術コミュニティでの活動や、英語による高度な技術交渉およびドキュメンテーション能力
BigTech水準のHPCインフラストラクチャを、最高のパフォーマンスで利用するための最適化能力
C++/CUDAなどの低レイヤー言語を用いた計算グラフ最適化、またはAIアクセラレータ(ASIC など)に関する専門的な知識
LLMの評価ベンチマークの設計、あるいはデータセットの構築に関する実績