【フルリモ!/最先端技術活用!】LLMを活用した設計図自動生成の研究開発における強化学習エンジニア募集!

AI/IoT、生成AI/RAG/AIエージェント、エッジ/フィジカルAI技術の研究・製品開発における受託開発企業

お気に入り一覧 →

報 酬

月額 65〜85万円

(税別・スキル経験により決定)

フルリモート 業務委託(準委任契約)
稼働
形態 フルリモート
契約 業務委託(準委任契約)
期間

使用ツール・スキル

Flask Python Tensorflow

案件概要

■募集背景
乗り物(船舶・自動車・航空等想定)の設計書・仕様書を対象に、特化型LLMを構築・高度化する取り組みを加速。
モデル構築面(データ整備〜学習〜評価〜強化学習)で実務に即した技術助言と精度向上の牽引が必要となったため、LLM強化学習(RL)に通じた方を募集しております。
■ご担当業務(お任せしたい工程)
・設計書・仕様書コーパスの前処理・分割・匿名化・正規化に関する方針策定
・SFT → RLHF(PPO/DPO等) を含む学習パイプラインの設計・改善
・評価設計(helpfulness / harmlessness / honesty 等)とメトリクス運用
・エラー分析/失敗例の体系化、データ追加・報酬設計・プロンプト/方針更新提案
ABテスト/回帰テストの仕組み化、モデル曲線の読み解きと次アクション提示
・週次レビュー、課題管理、ドキュメント整備(日本語中心/英語文献読解あり)
■プロジェクトの進捗状況
3月より開始予定

■必須スキル
・LLMの強化学習(RL)の実務経験をお持ちの方
・PPO / DPO / RLHF によるモデル最適化の実務
・SFT → RLHF の一連パイプライン構築経験
・データ整備・加工・学習の実務経験(ドメイン文書の前処理・分割・メタ情報設計
・LLM評価(helpfulness / harmlessness / honesty 等)設計・運用の経験
・論文ベース検証/英日での文献読解
・ロジカルな説明力/ステークホルダーとの高頻度コミュニケーション
■歓迎スキル
・設計文書の構造理解
・セキュリティ/コンプライアンスに配慮したデータガバナンス実務

募集要項

職種 データ
報酬 月額 650,000〜850,000円(税別)
※スキル・経験に応じて決定
勤務形態 フルリモート
契約形態 業務委託(準委任契約)
勤務地 フルリモート

SPONSORED

未経験から45日
フリーランスWebデザイナーへ

受講生4,500名以上|フリ転。の求人に応募できるスキルが身につく

無料セミナーに参加する →

日本デザインスクール|デザスク

応募ページへ →

※ 外部サイトに移動します