FC2ブログ
 

連載1 高速なメモリーコピー その1

私はC言語でプログラムを開発していてmemcpy()関数を使うことが多く、この関数は次のようなアセンブラに展開されるようです。

1:     mov     ecx, dword ptr [ebp+10h]
2:     mov     esi, dword ptr [ebp+0Ch]
3:     mov     edi, dword ptr [ebp+8]
4:     mov     eax, ecx
5:     shr     ecx, 2
6:     rep     movs dword ptr [edi], dword ptr [esi]
7:     mov     ecx, eax
8:     and     ecx, 3
9:     rep     movs byte ptr [edi], byte ptr [esi]

これは4Byte (32bit)ずつコピーしていって、4Byte未満の端数が出たら1Byteずつコピーしています。アセンブラのコードを見る限り無駄もなく安心して使える関数ですが処理速度の点ではもう少し向上させることが出来ます。

ポイントは2つ、一つ目は今のCPUならSSE命令を使って16Byte(128bit)ずつコピーできる点、そしてもう一つはメモリーアライメントを考慮することです。

続く...
関連記事


コメントの投稿

 
 
あまラボへようこそ
このブログでは自作ソフトの最新情報やtips、PC動画に関する話題を掲載していきます。各記事へは下にあるカテゴリからアクセスして下さい。

ファイルのダウンロードはホームページの方でお願い致します。

質問・要望・不具合報告はこちら
アマレコTV
アマミキ!
アマレココ
アマレコ・ライト
ファンタジーリモート
AMVコーデック



ホームページ
カテゴリ
最新コメント
カレンダー
03 | 2021/04 | 05
- - - - 1 2 3
4 5 6 7 8 9 10
11 12 13 14 15 16 17
18 19 20 21 22 23 24
25 26 27 28 29 30 -
最新記事
最新トラックバック
ブログ内タグ

アマレコTV ビデオキャプチャ AMVコーデック アマレココ アマレコVR Oculus アマミキ! Quest コーデック gQuest SC500 動画配信 Pico GO 4K ファンタジーリモート アマレコライト プラグイン G2 AMV4 oculus SC512 ライブ機能 Unity デスクトップキャプチャ AVX2 FAQ 質問コーナー リモートソフト HDキャプチャ ニコニコ動画 DirectShow レゴ 組み換え 遅延 可変再生速度 LEGO 解説動画 XL2420T 2 GV-USB2 120Hz アマステ 液晶モニター AMV2MT PS4 倍速液晶 デインターレース ベンチマーク Pro MonsterX3A Intensity ffmpeg 31024 Rift WindowsMR VideoKeeper2 Alternate 31006 designs UtVideo AVX XCAPTURE-1 SD-USB2CAP4 RGBキャプチャ 32ZP2 RDT233WX-Z GV-USB Shadow T2 RYZEN Play キャプチャーツール イベント 倍速駆動 シンクライアント リプレイ機能 SD-USB2CUP4 擬似NTSCキャプチャ プレビュー DirectShowFilter IntensityPro モノステ DC-HD1 Livetube AtomでHDキャプチャ LameACM GV-USB3 キャプチャカード 可逆圧縮 GPU使用率 SKnet SSE 録画 オーバーレイ XCapture-1 Kabelake LAVFilters Preferred MR Windows 90Hz 新アマレコVR VRコントローラー フレーム間圧縮 Filter Tweaker SteamVR VR動画 音ズレ フィギュア MonsterXU3.0R 音遅延 新プレイヤー機能 MP3 ゲームスムーズモード 倍速補完処理 32ZP32 額縁遅延 REGZA ZP3 Haswell 電源オプション MPC ハイパースレッディングテクノロジー HT 31021 インストール OBS HDCP HDMI QSV NVEnc 液晶テレビ 

ブログ内検索
月別アーカイブ
アマレココに関するリンク
お世話になっているソフトのリンク
RSSリンクの表示
管理画面
  • 管理画面