как можно быстрее сравнивать буферы

Мне нужно сравнить два буфера по частям на предмет равенства. Мне не нужна информация о соотношении двух буферов, просто равны ли каждые два куска или нет. Моя машина Intel поддерживает до SSE4.2

Наивный подход:

const size_t CHUNK_SIZE = 16; //128bit for SSE2 integer registers
const int ARRAY_SIZE = 200000000;

char* array_1 = (char*)_aligned_malloc(ARRAY_SIZE, 16);
char* array_2 = (char*)_aligned_malloc(ARRAY_SIZE, 16);

for (size_t i = 0; i < ARRAY_SIZE; )
{
    volatile bool result = memcmp(array_1+i, array_2+i, CHUNK_SIZE);
    i += CHUNK_SIZE;
}

По сравнению с моей первой попыткой использования SSE:

union U
{
    __m128i m;
    volatile int i[4];
} res;

for (size_t i = 0; i < ARRAY_SIZE; )
{
    __m128i* pa1 = (__m128i*)(array_1+i);
    __m128i* pa2 = (__m128i*)(array_2+i);
    res.m = _mm_cmpeq_epi32(*pa1, *pa2);
    volatile bool result =  ( (res.i[0]==0) || (res.i[1]==0) || (res.i[2]==0) || (res.i[3]==0) );
    i += CHUNK_SIZE;
}

Прирост скорости составляет около 33%. Могу я сделать что-нибудь лучше?

6
задан stepancheg 26 May 2011 в 11:19
поделиться