Friday, 2026/07/31

  • 東京科学大学
  • 情報理工学院
  • 情報工学系
  • Switch Language
    • ja日本語
    • enEnglish (英語)

下坂研究室

MIUBIQ (machine intelligence in UbiComp Research)

  • ホーム
    • メンバー
    • 所在地
  • ニュース
  • プロジェクト
  • 発表論文
  • 受賞
  • アーカイブ
    • コード
    • データセット
Navigation
プロジェクト 多様な状況に適応する逆強化学習による運転行動モデリング

多様な状況に適応する逆強化学習による運転行動モデリング

2020/10/30 | プロジェクト | 2526 views |
生活道路における死傷事故件数の減少傾向は直近20年間横ばい状態が続いています.そうした背景の中で,生活道路における歩行者の安全を守るための先進運転支援システム(ADAS)の開発が注目されています.特に,歩行者の致死率と車両速度に強い相関関係があることが知られているため.生活道路における熟練ドライバの危険予知運転をモデル化することは洗練されたADASの開発には必要不可欠といえます.

生活道路における運転行動モデリングでは,天候や時間帯,道路幅など,運転の状況(以下,コンテクストと総称)が熟練ドライバの危険予知運転行動に与える影響を考慮することが鍵を握ります.そこで本研究では学習データに存在しない運転状況における正確な運転行動予測が可能なモデルを開発しています.

この枠組では,運転時のコンテクストを符号化し,道路の幾何形状に基づく報酬関数と交互作用を考慮したモデルとして定式化されます.このことで複数の状況に応じて報酬場を調整する枠組になり,その結果,運転行動の予測性能の大幅な改善が可能になります.本研究では,複数のコース全長100kmを超える走行データを用いて性能評価実験を実施しております.実験結果からは.データ数が少ないコンテクストや未知のコンテクストに対しても,提案手法の予測結果が熟練ドライバーの走行データに最も類似していることを確認することができました.

交互作用を考慮するとパラメータが増大となり,学習結果が不安定になる問題があるため,エラスティックネットによる正則化による試みも行っています.

また,さらに,近年では大規模言語モデル(LLM)の発展を背景として,自然言語で記述された運転状況を活用した運転行動モデリングにも取り組んでいます.従来の手法では,天候や時間帯などのコンテクストを離散的なカテゴリとして表現していましたが,実環境における運転状況は道路構造や周辺環境などを含め,多様かつ連続的に変化します.そこで本研究では,「天気は晴れであり,時間帯は昼頃.一方通行の狭い道路である.」といった自然言語による運転状況の記述を,大規模言語モデルによって埋め込み表現へと変換し,双線形逆強化学習に統合することで,より柔軟にコンテクストを考慮した運転行動予測を実現しています.実際の生活道路における走行データを用いた評価実験では,従来の離散的なコンテクスト表現を用いる手法と比較して,熟練ドライバの運転軌跡により近い予測性能を達成し,自然言語によるコンテクスト表現の有効性を確認しています.

関連論文

佐藤 潤一, 西 賢太郎, 片岡 裕雄, 下坂 正倫
運転状況により変化する報酬関数からなる多タスク逆強化学習に基づく生活道路の運転行動予測.
自動車技術会2015 年秋季大会学術講演会講演予稿集.

Kentaro Nishi, Masamichi Shimosaka
Fine-Grained Driving Behavior Prediction via Context-Aware Multi-Task Inverse Reinforcement Learning
In proceedings of the 2020 IEEE International Conference on Robotics and Automation, 2020.

平川 優伎, 竹中 一仁, 平野 大輔, 細馬 慎平, 下坂 正倫
スパース双線型逆強化学習による運転状況の多様性を考慮した運転行動モデリング
自動車技術会2020 年秋季大会学術講演会講演予稿集,2020 12.

近藤 ー冴,下坂 正倫
自然言語で記述された運転文脈を活用する逆強化学習ベース運転行動予測
ロボティクス・メカトロニクス講演会 2026 (ROBOMECH 2026),2026 6.

  • tweet

Comments are disabled for this post

Social Networks

  • twitter
  • rss

Recent News

  • 目的地候補周辺のPOI情報を用いた移動先予測の高精度化 2026/07/21
  • ロボティクス・メカトロニクス講演会 2026 (ROBOMECH 2026) にて自然言語で記述された運転文脈を活用する逆強化学習ベース運転行動予測に関する論文を発表します 2026/06/16
  • 情報処理学会UBI研究会第90回研究発表会にて目的地候補周辺のPOIを用いた移動先予測の高精度化に関する論文を発表します 2026/05/26
  • 慣性・超音波センサ融合による手首装着型物体操作認識 2026/04/28
  • 自動運転に向けた安全かつ安定な運転行動学習 〜負例の時間的局所性に基づく逆強化学習〜 2026/03/31
  • PerCom2026のDemoセッションにて,超音波とIMUを用いたウェアラブルセンサによる物体操作認識について発表しました 2026/03/18
  • 情報処理学会第88回UBI研究会で発表した論文がUBIヤングリサーチャー賞を受賞しました 2026/02/25
  • ウェアラブルUWBの時系列CIRを用いた呼吸推定 2026/02/25
  • 単一アンテナWi-Fiデバイスのアレイ化によるAoA推定手法 2026/02/06
  • 情報処理学会第85回UBI研究会で発表した論文が学生奨励賞を受賞しました 2026/02/06

Search

Copyright 2015 · Shimosaka Research Group at TITECH