それに比べて、 CUDA の単一ソースC++組み込みドメイン固有言語バージョンである「CUDA Runtime API」は、SYCL と多少似ています。実際、Intel は CUDA から SYCL へのコードを自動的に変換する SYCLOMATIC というツールをリリースしました。[43] ただし、OpenCL に似た「CUDA Driver API」と呼ばれる、あまり知られていない単一ソースではない CUDA バージョンがあり、たとえば CUDA Runtime API の実装自体で使用されています。[ 40 ]
SYCL はC++ AMP の機能を拡張し、バッファとアクセサを使用してホストとデバイス間でデータを明示的に転送する必要をプログラマから取り除きます。これは、明示的なデータ転送が必要だった CUDA ( CUDA 6 で統合メモリが導入される前) とは対照的です。SYCL 2020 以降では、バッファベースのインターフェースを置き換えるのではなく、拡張するために統合共有メモリ(USM)を使用することも可能で、[ 44 ] CUDA の統合メモリに似た低レベルのプログラミング モデルを提供します。 [ 45 ]
↑ Ke, Yinan; Agung, Mulya; Takizawa, Hiroyuki (2021). "NeoSYCL: SX-Aurora TSUBASA 用 SYCL 実装" . The International Conference on High Performance Computing in Asia-Pacific Region . pp. 50–57 . doi : 10.1145/3432261.3432268 . ISBN9781450388429. S2CID 231597238 .
↑ Ke, Yinan; Agung, Mulya; Takizawa, Hiroyuki (2021). "NeoSYCL: SX-Aurora TSUBASA 用 SYCL 実装" . The International Conference on High Performance Computing in Asia-Pacific Region . pp. 50–57 . doi : 10.1145/3432261.3432268 . ISBN9781450388429. S2CID 231597238 .
↑クリスシ、ルイージ。サリミ・ベニ、マジッド。コゼンツァ、ビアジオ。シピオーネ、ニコロ。ガディオーリ、ダビデ。ヴィターリ、エマヌエーレ。パレルモ、ジャンルカ;ベッカリ、アンドレア (2022-05-10)。「SYCL 2020 によるポータブル創薬パイプラインに向けて」。OpenCLに関する国際ワークショップ。 IWOCL'22。米国ニューヨーク州ニューヨーク州: コンピューティング機械協会。 pp. 1–2 . doi : 10.1145/3529538.3529688。ISBN978-1-4503-9658-5。
↑ Solis-Vasquez, Leonardo; Mascarenhas, Edward; Koch, Andreas (2023-04-18). "CUDAからSYCLへの移行経験:分子ドッキングのケーススタディ" . International Workshop on OpenCL . IWOCL '23. New York, NY, USA: Association for Computing Machinery. pp. 1– 11. doi : 10.1145/3585341.3585372 . ISBN979-8-4007-0745-2。
↑ "Llama.CPP/Docs/Backend/SYCL.md at master · ggerganov/Llama.CPP" . GitHub .
↑ Rangel, Esteban Miguel; Pennycook, Simon John; Pope, Adrian; Frontiere, Nicholas; Ma, Zhiqiang; Madananth, Varsha (2023-11-12). "エクサスケール向けCRK-HACCの高性能移植可能なSYCL実装" . Proceedings of the SC '23 Workshops of the International Conference on High Performance Computing, Network, Storage, and Analysis . SC-W '23. New York, NY, USA: Association for Computing Machinery. pp. 1114–1125 . arXiv : 2310.16122 . doi : 10.1145 /3624062.3624187 . ISBN979-8-4007-0785-8。
1 2 Breyer, Marcel; Van Craen, Alexander; Pflüger, Dirk (2022-05-10). "マルチベンダーハードウェア上での大規模並列サポートベクターマシン分類のためのSYCL、OpenCL、CUDA、およびOpenMPの比較" . International Workshop on OpenCL . IWOCL '22. New York, NY, USA: Association for Computing Machinery. pp. 1–12 . doi : 10.1145/3529538.3529980 . ISBN978-1-4503-9658-5。
1 2 3 4 "SYCL - C++ シングルソース異種プログラミングによるアクセラレーションオフロード" . The Khronos Group . 2014-01-20 . 2024-07-12に取得.
↑ Chen, Jolly; Dessole, Monica; Varbanescu, Ana Lucia (2024-01-24), Lessons Learned Migrating CUDA to SYCL: A HEP Case Study with ROOT RDataFrame , arXiv : 2401.13310
↑ "HIPIFY/README.md at amd-staging · ROCm/HIPIFY" . GitHub . 2024-07-11に取得.
1 2 Jin, Zheming; Vetter, Jeffrey S. (2022年11月). 「GPU上でのHIPおよびSYCLにおける非均一削減の評価」. 2022 IEEE/ACM 第8回ビッグ科学データのためのデータ分析および削減に関する国際ワークショップ (DRBSD) . IEEE. pp. 37–43 . doi : 10.1109/DRBSD56682.2022.00010 . ISBN978-1-6654-6337-9. OSTI 1996715 .
↑ Reguly, Istvan Z. (2023-11-12). "帯域幅制約のあるアプリケーションにおけるCPUとGPU間でのSYCLのパフォーマンス移植性の評価" . Proceedings of the SC '23 Workshops of the International Conference on High Performance Computing, Network, Storage, and Analysis . SC-W '23. New York, NY, USA: Association for Computing Machinery. pp. 1038–1047 . arXiv : 2309.10075 . doi : 10.1145 /3624062.3624180 . ISBN979-8-4007-0785-8。
1 2 Hammond, Jeff R.; Kinsner, Michael; Brodman, James (2019). "C++アプリケーション向け異種並列プログラミングモデルとしてのKokkosとSYCLの比較分析" .Proceedings of the International Workshop on OpenCL . pp. 1–2 . doi : 10.1145/3318170.3318193 . ISBN9781450362306. S2CID 195777149 .
↑ Trott, Christian R.; Lebrun-Grandié, Damien; Arndt, Daniel; Ciesko, Jan; Dang, Vinh; Ellingwood, Nathan; Gayatri, Rahulkumar; Harvey, Evan; Hollman, Daisy S. (2022), "Kokkos 3: エクサスケール時代のためのプログラミングモデル拡張" , IEEE Transactions on Parallel and Distributed Systems , 33 (4): 805, Bibcode : 2022ITPDS..33..805T , doi : 10.1109/TPDS.2021.3097283 , 2024年7月10日取得
↑ Arndt, Daniel; Lebrun-Grandie, Damien; Trott, Christian (2024-04-08). "KokkosのSYCLバックエンド実装の経験" .第12回OpenCLおよびSYCLに関する国際ワークショップ議事録. IWOCL '24. ニューヨーク州ニューヨーク、米国: Association for Computing Machinery. pp. 1–11 . doi : 10.1145/3648115.3648118 . ISBN979-8-4007-1790-1. OSTI 2336667 .
1 2 Beckingsale, David A.; Scogland, Thomas RW; Burmark, Jason; Hornung, Rich; Jones, Holger; Killian, William; Kunen, Adam J.; Pearce, Olga; Robinson, Peter; Ryujin, Brian S. (2019年11月). "RAJA: 大規模科学アプリケーション向けポータブルパフォーマンス". 2019 IEEE/ACM International Workshop on Performance, Portability and Productivity in HPC (P3HPC) . IEEE. pp. 71–81 . doi : 10.1109/P3HPC49587.2019.00012 . ISBN978-1-7281-6003-0. OSTI 1488819 .
↑ Homerding, Brian; Vargas, Arturo; Scogland, Tom; Chen, Robert; Davis, Mike; Hornung, Rich (2024-04-08). "Enabling RAJA on Intel GPUs with SYCL" . Proceedings of the 12th International Workshop on OpenCL and SYCL . IWOCL '24. New York, NY, USA: Association for Computing Machinery. pp. 1–10 . doi : 10.1145/3648115.3648131 . ISBN979-8-4007-1790-1。
James Reinders、Ben Ashbaugh、James Brodman、Michael Kinsner、John Pennycook、Xinmin Tian: "Data Parallel C++: Mastering DPC++ for Programming of Heterogeneous Systems using C++ and SYCL", Apress (2021)、オープンアクセス。