ジェラルド・フリードランドは、マルチメディアコンピューティング、機械学習、人工知能を専門とするドイツ系アメリカ人の コンピュータ科学者および著者です。彼は、 Amazon Web Servicesの主席科学者であり、カリフォルニア大学バークレー校の電気工学およびコンピュータサイエンス学部の教授です。彼は、AutoMLと生成AIに焦点を当てています。彼の研究は、大規模なマルチメディア分析、プライバシーを考慮したAI、説明可能な機械学習を進歩させました。[1] [2]
教育
フリードランドはドイツで教育を修了し、1998年にアビトゥア資格を取得しました。 [3] 2002年にベルリン自由大学でコンピュータサイエンスの修士号を取得し、言語学を副専攻としました。 [4]修士論文「汎用クロスプラットフォームメディアエディタに向けて:E-Chalkの編集ツール」は、ドイツコンピュータサイエンス協会によってドイツ語圏で最も優れたコンピュータサイエンス修士論文として認められました。[5]
2006年、フリードランドはベルリン自由大学でコンピュータサイエンスの博士号を取得し、首席で卒業した。彼の博士論文「電子黒板講義のための適応型オーディオおよびビデオ処理」は、大学のエルンスト・ロイター賞にノミネートされた。[6] [7]
キャリア
フリードランドは、2002年から2006年までベルリン自由大学のAIグループの研究員としてラウル・ロハスの下で学界でのキャリアをスタートしました。この間、彼は「シンプルインタラクティブオブジェクト抽出(SIOX)」アルゴリズムを開発しました。 [8]これは現在、 GIMPやBlenderなどのオープンソースツールで広く使用されています。また、講義のウェブキャスト技術の研究も行いました。[9]
2006年から2016年まで、フリードランドはカリフォルニア州バークレーにある国際コンピュータサイエンス研究所(ICSI)でフルタイムで働いていました。博士研究員から主任研究員、オーディオおよびマルチメディアグループのディレクターまで、さまざまな役職を歴任しました。ローレンスリバモア国立研究所の主任データサイエンティスト(2016~2019年)として、フリードランドは説明可能なAIの課題に取り組むチームを率いました。[10]
2014年に、クラウドに依存しない音声認識ハードウェアを開発する会社、Audemeを設立しました。[11] 2019年に、Brainome, Inc.を共同設立し、2022年までCTOとしてフルタイムで参加し、「情報駆動型機械学習:エンジニアリング分野としてのデータサイエンス」で説明されている機械学習の情報理論的見解を活用したノーコード機械学習ソリューションの開発を主導しました。[4] [12]
フリードランドは、 ACM SIGMM (2017~2021年)の会議ディレクター、 ACM Multimedia (2017年)のプログラム共同議長、IEEE Multimedia MagazineおよびACM Transactions on Multimedia Computingの副編集者を務めた。[13] [14]
研究
フリードランドは、マルチメディアデータの処理と分析、機械学習を専門とするコンピュータ科学者です。 [15]彼は主に、広く使用されている「 Simple Interactive Object Extraction」画像およびビデオセグメンテーションアルゴリズムのオリジナルの作者として知られています。 [16] [8] [17 ] [ 18] [19 ] [9] [20] [21]このアルゴリズムは、彼の博士論文の一部として作成されました。[22] [ 23]また、マルチメディアコンピューティングに関する教科書の共著者でもあります。[24]彼はまた、YFCC100Mコーパス(機械学習研究用データセットのリストも参照)の作成と公開のイニシアチブを主導しました。 [25] [26] [27]これは、消費者が制作したビデオと画像の最大の無料研究コーパスです。彼は、画像とビデオの地理位置推定(配置とも呼ばれる)の分野の共同創設者です。[28] [29] [30]フリードランドはマルチメディア出版の実践におけるプライバシーリスクを頻繁に発見し[31] [32] [33] [34] [35] [36] [37] [38] 、 APコンピュータサイエンス原則とCode.orgイニシアチブの一環として米国の高校で使用するための教育資料を提供するteachingprivacy.org [39]ポータルの開発を主導しています。フリードランドは、モノのインターネットデバイス用のクラウドレス音声インターフェース[40]の作成を可能にするオープンソースの音声認識ボードであるMOVIの共同作成者でもあります。
受賞歴
- ユネスコIRCAI 世界トップ100 AI プロジェクト (2021) AIに対する測定ベースのアプローチ
- AI2000 10年間で最も影響力のある学者 (2009~2019年)
- ACM マルチメディア グランド チャレンジ優勝者 (2009)
- IEEE マルチメディアビッグデータ国際会議 (2019) 最優秀論文賞
- メイクマガジンエディターズチョイスアワード(2015)
出版物
フリードランドは、以下の本を含む 6 冊の本を執筆しています。
- 情報駆動型機械学習:エンジニアリング分野としてのデータサイエンス(Springer-Nature、2023年)。
- マルチメディアコンピューティング入門(ケンブリッジ大学出版局、2014年)。
- レトロコンピューティングを使ったプログラミング入門(Apress、2018年)。
彼はまた、機械学習からマルチメディアコンピューティングまで幅広いトピックについて、査読付きのジャーナルや会議の記事を100本以上発表しています。[15]
参考文献
- ^ 「ジェラルド・フリードランド | カリフォルニア大学バークレー校のEECS」
- ^ 「ジェラルド・フリードランド」.
- ^ 「Refubium - 検索」.
- ^ ab 「Brainome、機械学習開発プロセスを最適化する製品をリリース」ZDNet。
- ^ 「エラー」。
- ^ 「エントロピーディスカッショングループ」。バークレーデータサイエンス研究所。2019年8月23日。
- ^ フリードランド、ジェラルド「情報駆動型機械学習:エンジニアリング分野としてのデータサイエンス」、Springer-Nature、2024年1月。
- ^ ab "SIOX"。
- ^ ab 「カラー画像をセグメント化する SIOX プロジェクトに基づく Fiji プラグイン: Fiji/Siox_Segmentation」。GitHub。2019年 6 月。
- ^ 「Gerald Friedland | ICSI」www.icsi.berkeley.edu . 2024年12月19日閲覧。
- ^ 「Audeme の Bertrand 氏と Gerald 氏へのインタビュー | The Amp Hour Electronics Podcast」theamphour.com 2015 年 7 月 16 日2024 年 12 月 19 日閲覧。
- ^ Woodie, Alex (2020-11-04). 「Brainome が ML トレーニング前にデータを適切なサイズに調整」. BigDATAwire . 2024-12-19閲覧。
- ^ 「SIGMMの新リーダーシップが発表されました | ACM SIGMM - マルチメディアに関する特別利益団体」www.sigmm.org 。 2024年12月19日閲覧。
- ^ 「ジェラルド・フリードランド - ホーム」。著者DOシリーズ。 2024年12月19日閲覧。
- ^ ab Google Scholar出版物リスト: https://scholar.google.com/citations?user=iBl-QgEAAAAJ
- ^ 「アルゴリズム - ビデオからセグメンテーション(人間や鳥など)を削除するための標準的な手法は何ですか?」
- ^ 「GIMP の前景選択ツールの使用」。2013 年 8 月 31 日。
- ^ "Paintshopprotutorials.co.uk".
- ^ “Kutout - 画像を切り抜くためのアプリケーション | Hook - Labs”. 2017年7月24日時点のオリジナルよりアーカイブ。2017年7月16日閲覧。
- ^ 「SIOX: シンプルなインタラクティブ オブジェクト抽出」。
- ^ Shoou Jiah Yiu、Gerald Friedland:「画像内のオブジェクトを識別する方法およびシステム」米国特許出願 US20170132469A1
- ^ Gerald Friedland: 「Adaptive Audio- und Videoverarbeitung für elektronische Kreidetafelvorlesungen」、ベルリン自由大学、2006 年 10 月 http://www.diss.fu-berlin.de/diss/receive/FUDISS_thesis_000000002354
- ^ ジェラルド・フリードランド:「電子黒板講義のための適応型オーディオおよびビデオ処理」、Lulu Publishing、ISBN 978-1430303886、2006年12月。2016年再版:ISBN 978-3-659-97771-8、Lambert Publishing、2016年11月。
- ^ フリードランド、ジェラルド、ジェイン、ラメシュ「マルチメディアコンピューティング」、ケンブリッジ大学出版局、2014年10月。
- ^ バート・トーミー、デヴィッド・A・シャンマ、ジェラルド・フリードランド、ベンジャミン・エリザルデ、カール・ニー、ダグラス・ポーランド、ダミアン・ボース、リー・ジア・リー。 「YFCC100M: マルチメディア研究における新しいデータ」。ACM の通信、Vol. 59 No.2、64~73ページ
- ^ YFCC100M: YFCC100M
- ^ マルチメディアコモンズ
- ^ Gerald Friedland、Oriol Vinyals、Trevor Darrell:「マルチモーダル位置推定」、ACM 国際マルチメディア会議 (ACM Multimedia 2010) の議事録、イタリア、フィレンツェ、2010 年 10 月、pp. 1245-1251。
- ^ Choi, Jaeyoung、Friedland, Gerald「ビデオと画像のマルチモーダル位置推定」、Springer Publishing 2014 年 10 月
- ^ Nils Peters、Howard Lei、Gerald Friedland:「録音中の音響特性を用いた部屋の識別」、米国特許 US20140161270A1
- ^ ウェブ写真であなたの住んでいる場所などの秘密が明らかになる(ニューヨークタイムズ、2010年8月11日)
- ^ 携帯電話のジオタグをオフにするヒント (ABC ニュース、2010 年 8 月 20 日)
- ^ 写真に位置情報をジオタグするだけで犯罪の被害者になる可能性はありますか? (Digital Trends、2013 年 7 月 22 日)
- ^ メール追跡を回避する方法(ニューヨークタイムズ、2014年12月25日)
- ^ 犯罪を減らすことを目的とした警察が装着するカメラ「BodyWorn」(Fox News、2015年5月19日)
- ^ パリのISIS攻撃:テクノロジー業界は「反テロ」バックドアが米国の安全を損なうと主張(International Business Times、2015年11月18日)
- ^ なぜ私たちの超賢い AI は、私たちのスピーチの書き起こしがまだ下手なのか (Wired Magazine、2016 年 4 月 8 日)
- ^ 音声の文字起こしは面倒なので、Trint のような機械に任せましょう (Wired Magazine、2017 年 4 月 26 日)
- ^ 「プライバシーを教える」。
- ^ Gerald Friedland Bertrand Irissou: 電子システム用の音声ダイアログインターフェースの構築を容易にする方法、米国特許出願 US15382163。
