楠本研究室

業績一覧

ホーム業績一覧

機械学習を用いた類似度に基づく有用なコードクローンの自動特定手法

機械学習を用いた類似度に基づく有用なコードクローンの自動特定手法
情報処理学会論文誌, vol.54, no.2, pp.807-819 (2013)
概要: これまでにソースコード中からコードクローン(互いに類似するコード片)を自動的に検出するツールが多数開発されている.これらの検出ツールはコードクローンを多数検出するが,それらすべてがソフトウェア保守に有用であるとは限らない.さらに,あるコードクローンが有用であるか否かの判別基準は,個々の開発者により,あるいはコードクローン情報の使用目的などにより異なる可能性が高い.そこで本稿では,機械学習を用いた有用なコードクローンの自動特定手法を提案する.提案手法は,ツールによって検出されたコードクローンの一部を利用者に有用であるか否かに分類してもらい,それらを学習データとして残りのコードクローンからその利用者にとって有用なコードクローンを自動的に特定する.また,提案手法を実装し,被験者を用いて評価実験を行った.その結果,有用であるか否かの判断が利用者によって異なることを確認するとともに,提案手法が全体の20%程度のデータを学習させることで,およそ70%以上,最良の場合約90.1%の精度で予測ができることを確認した. タグ: clones, code, identifying, learning, machine, method, similarity, techniques, useful
@article{楊嘉晨2013,
  author = {楊 嘉晨 and 堀田 圭佑 and 肥後 芳樹 and 井垣 宏 and 楠本 真二},
  title = {機械学習を用いた類似度に基づく有用なコードクローンの自動特定手法},
  journal = {情報処理学会論文誌},
  volume = {54},
  number = {2},
  pages = {807--819},
  year = {2013},
  month = {feb}
}