Datta, Ritendra; Dhiraj Joshi; Jia Li ; James Z. Wang (2008). "画像検索: 新時代のアイデア、影響、トレンド" . ACM Computing Surveys . 40 (2): 1– 60. doi : 10.1145/1348246.1348248 . S2CID 7060187 .
Nicolas Hervé; Nozha Boujemaa (2007). 「画像注釈:現実的なデータベースにはどの手法が適しているか?」(PDF) . ACM International Conference on Image and Video Retrieval . 2011年5月20日にオリジナル(PDF)からアーカイブされました。
G Carneiro、AB Chan、P Moreno、N Vasconcelos (2006) 「画像注釈と検索のための意味クラスの教師あり学習」(PDF) IEEE Transactions on Pattern Analysis and Machine Intelligence pp. 394–410。
V Lavrenko、R Manmatha、J Jeon (2003) 「画像の意味論を学習するためのモデル」(PDF) .第16回ニューラル情報処理システム進歩会議議事録 NIPS .
一貫性のある言語モデル
R Jin; JY Chai; L Si (2004). 「一貫性のある言語モデルとアクティブラーニングによる効果的な自動画像アノテーション」(PDF) . MM'04 論文集.
推論ネットワーク
D Metzler & R Manmatha (2004). 「画像検索のための推論ネットワークアプローチ」(PDF) .国際画像・動画検索会議議事録. pp. 42–50 .
多重ベルヌーイ分布
S Feng、R Manmatha、V Lavrenko (2004) 「画像およびビデオ注釈のための複数のベルヌーイ関連性モデル」(PDF) IEEE Conference on Computer Vision and Pattern Recognition pp . 1002–1009。
複数のデザインオプション
JY Pan; HJ Yang; P Duygulu; C Faloutsos (2004). 「自動画像キャプション生成」(PDF) . 2004 IEEE International Conference on Multimedia and Expo (ICME'04) 論文集. 2004年12月9日にオリジナル(PDF)からアーカイブ済み。
画像キャプション
Quan Hoang Lam; Quang Duy Le; Kiet Van Nguyen; Ngan Luu-Thuy Nguyen (2020). "UIT-ViIC: ベトナム語画像キャプションの最初の評価のためのデータセット" . 2020年国際計算集合知会議(ICCCI 2020)議事録. arXiv : 2002.00175 . doi : 10.1007/978-3-030-63007-2_57 .
自然シーンの注釈
J Fan; Y Gao; H Luo; G Xu (2004). 「概念に敏感な顕著なオブジェクトを用いた画像コンテンツ表現による自動画像注釈」 .第27回情報検索研究開発国際会議議事録. pp. 361–368 .
関連する低レベルグローバルフィルタ
A Oliva & A Torralba (2001). "シーンの形状のモデリング:空間エンベロープの全体的表現" (PDF) . International Journal of Computer Vision . pp. 42:145–175.
グローバル画像特徴とノンパラメトリック密度推定
A Yavlinsky、E Schofield、S Rüger (2005)。「グローバル特徴と堅牢なノンパラメトリック密度推定を用いた自動画像注釈」(PDF)。国際画像・動画検索会議(CIVR、シンガポール、2005年7月) 。2005年12月20日にオリジナル(PDF)からアーカイブ。
ビデオの意味論
N Vasconcelos & A Lippman (2001). "コンテンツ分析と特性評価のためのビデオ構造の統計モデル" (PDF) . IEEE Transactions on Image Processing . pp. 1–17 .
Ilaria Bartolini、Marco Patella、Corrado Romani (2010)。「Shiatsu: セグメンテーションによるカットを用いたビデオのセマンティックベースの階層的自動タグ付け」。第3回ACM国際マルチメディアワークショップ「メディア制作における自動情報抽出」(AIEMPro10)。
Changhu Wang; Feng Jing; Lei Zhang & Hong-Jiang Zhang (2007). "コンテンツベースの画像注釈の改良". IEEE Conference on Computer Vision and Pattern Recognition (CVPR 07) . doi : 10.1109/CVPR.2007.383221 .
Ilaria Bartolini & Paolo Ciaccia (2007). "Imagination: Exploiting Link Analysis for Accurate Image Annotation". Springer Adaptive Multimedia Retrieval . doi : 10.1007/978-3-540-79860-6_3 .
Ilaria Bartolini & Paolo Ciaccia (2010). "多次元キーワードベースの画像アノテーションと検索" .第2回ACM構造化データキーワード検索国際ワークショップ(KEYS 2010) .
視覚記述子の集合による自動画像注釈
Emre Akbas & Fatos Y. Vural (2007). "視覚記述子のアンサンブルによる自動画像注釈".国際コンピュータビジョン会議 (CVPR) 2007、マルチメディアにおける意味学習アプリケーションに関するワークショップ. doi : 10.1109/CVPR.2007.383484 . hdl : 11511/16027 .
Venkatesh N. Murthy、Subhransu Maji、R. Manmatha (2015) 「深層学習表現を用いた自動画像注釈」(PDF)国際マルチメディア会議(ICMR)。
顕著な領域と背景画像情報を用いた包括的な画像注釈
Sarin, Supheakmungkol; Fahrmair, Michael; Wagner, Matthias & Kameyama, Wataru (2012). Leveraging Features from Background and Salient Regions for Automatic Image Annotation . Journal of Information Processing. Vol. 20. pp. 250–266 .
ベイズネットワークとアクティブラーニングを用いた医用画像アノテーション
NB Marvasti、E. Yörük、B. Acar (2018) 「コンピュータ支援医療画像アノテーション:CTにおける肝病変の予備的結果」 IEEE Journal of Biomedical and Health Informatics。