JP2009211368A

Cache memory, vector processor and vector data alignment method

Abstract

Problem to be solved.To reduce a hardware amount and power consumption of a vector processing apparatus by making a cache memory available as a vector load buffer (VLDB). A request control unit 102 in a vector processing unit 100 issues a memory request corresponding to a vector load instruction. The cache control unit 111 determines whether or not the divided data is stored in the data array 112 for each divided data obtained by dividing the vector data requested by the memory request at the cache line boundary of the data array 112. judge. Then, for the divided data that is not stored, the corresponding data is read from the memory unit 120 and stored in the data array 112, and after all the vector data is stored in the data array 112, the data is aligned and transmitted to the vector processing unit 100. .. [Selection diagram] Fig. 1

Term

1.4 yearsto projected expiry

Projected expiry 4 March 2028, counted from filing; an application has no term until it is granted.

  1. Priority and filed
  2. Published
  3. Today
  4. Projected expiry

7 claims: 2 independent, 5 dependent

  1. 1
    主記憶装置に格納されているデータの一部の写しが格納されるキャッシュラインを複数備えたデータアレイと、 ベクトル処理部から要求されたベクトルデータを前記データアレイのキャッシュライン境界で分割することにより得られる分割データ毎に、その分割データが前記データアレイに格納されているか否かを判定し、格納されていない分割データについては前記主記憶装置から該当するデータを読み込んで前記データアレイに格納し、前記ベクトルデータが前記データアレイに全て格納されてから前記ベクトル処理部へ送信するキャッシュ制御部とを備えたことを特徴とするキャッシュメモリ。
  2. 2
    請求項1記載のキャッシュメモリにおいて、 前記キャッシュ制御部は、前記分割データ毎に、その分割データが前記データアレイに格納されている場合には該格納されているキャッシュラインの情報を管理テーブルに記録し、格納されていなければ前記主記憶装置に対してロードリクエストを送出して、該ロードリクエストによって前記主記憶装置から読み出されるデータを格納するキャッシュラインの情報を前記管理テーブルに記録し、前記管理テーブルに記録された全てのキャッシュラインに前記分割データが格納されたか否かを判定することを特徴とするキャッシュメモリ。
  3. 3
    請求項1または2記載のキャッシュメモリにおいて、 前記キャッシュライン毎の予約フラグであって、そのキャッシュラインが前記ベクトルデータの分割データを格納するために使用するキャッシュラインである場合にセットされる予約フラグを備え、且つ、 前記キャッシュ制御部が、スカラ処理部からのスカラ命令によってアクセスされるデータが前記データアレイ上に存在しないことにより、キャッシュラインのデータの置き換えを行う場合は、予約フラグがセットされていないキャッシュラインを対象にしてデータの置き換えを行うことを特徴とするキャッシュメモリ。
  4. 4
    請求項3記載のキャッシュメモリにおいて、 前記キャッシュ制御部が、前記スカラ処理部からのスカラ命令に従って書き替えるデータが予約フラグがセットされているキャッシュラインに格納されている場合は、前記予約フラグがリセットされるまで、前記データの書き替えを抑止することを特徴とするキャッシュメモリ。
  5. 5
    請求項1乃至4の何れか1項に記載のキャッシュメモリと、 前記キャッシュメモリに対してベクトルデータを要求するメモリリクエストを発行するベクトル処理部と、 前記キャッシュメモリに対してスカラ命令を発行するスカラ処理部とを備えたことを特徴とするベクトル処理装置。
  6. 6
    ベクトル処理部が、キャッシュメモリに対してベクトルデータを要求する第1のステップと、 前記キャッシュメモリが、前記ベクトル処理部から要求された前記ベクトルデータの構成要素の内、自メモリ上に存在しない構成要素を主記憶装置から読み込み、前記ベクトルデータが自メモリ上に全て揃ってから整列させて前記ベクトル処理部へ送信する第2のステップとを含むことを特徴とするベクトルデータ整列方法。
  7. 7
    請求項6記載のベクトルデータ整列方法において、 前記第2のステップは、 前記ベクトルデータをデータアレイのキャッシュライン境界で分割することにより得られる分割データ毎にその分割データが前記データアレイに格納されているか否かを判定する第3のステップと、 該第3のステップで前記データアレイに格納されていないと判定された分割データを前記主記憶装置から読み込んで前記データアレイに格納し、前記ベクトルデータが前記データアレイに全て格納されてから整列させて前記ベクトル処理部へ送信する第4のステップとを含むことを特徴とするベクトルデータ整列方法。
Independent claims7