📄 resample_mmx.c
字号:
); return 5*256;}static int a52_resample_MONO_LFE_to_6_MMX(float * _f, int16_t * s16){ int32_t * f = (int32_t *) _f; asm volatile( "movl $-1024, %%esi \n\t" "movq "MANGLE(magicF2W)", %%mm7 \n\t" "pxor %%mm6, %%mm6 \n\t" "1: \n\t" "movq 1024(%1, %%esi), %%mm0 \n\t" "movq 1032(%1, %%esi), %%mm1 \n\t" "movq (%1, %%esi), %%mm2 \n\t" "movq 8(%1, %%esi), %%mm3 \n\t" "psubd %%mm7, %%mm0 \n\t" "psubd %%mm7, %%mm1 \n\t" "psubd %%mm7, %%mm2 \n\t" "psubd %%mm7, %%mm3 \n\t" "packssdw %%mm1, %%mm0 \n\t" "packssdw %%mm3, %%mm2 \n\t" "movq %%mm0, %%mm1 \n\t" "punpcklwd %%mm2, %%mm0 \n\t" "punpckhwd %%mm2, %%mm1 \n\t" "leal (%%esi, %%esi, 2), %%edi \n\t" "movq %%mm6, (%0, %%edi) \n\t" "movd %%mm0, 8(%0, %%edi) \n\t" "punpckhdq %%mm0, %%mm0 \n\t" "movq %%mm6, 12(%0, %%edi) \n\t" "movd %%mm0, 20(%0, %%edi) \n\t" "movq %%mm6, 24(%0, %%edi) \n\t" "movd %%mm1, 32(%0, %%edi) \n\t" "punpckhdq %%mm1, %%mm1 \n\t" "movq %%mm6, 36(%0, %%edi) \n\t" "movd %%mm1, 44(%0, %%edi) \n\t" "addl $16, %%esi \n\t" " jnz 1b \n\t" "emms \n\t" :: "r" (s16+1536), "r" (f+256) :"%esi", "%edi", "memory" ); return 6*256;}static int a52_resample_STEREO_LFE_to_6_MMX(float * _f, int16_t * s16){ int32_t * f = (int32_t *) _f; asm volatile( "movl $-1024, %%esi \n\t" "movq "MANGLE(magicF2W)", %%mm7 \n\t" "pxor %%mm6, %%mm6 \n\t" "1: \n\t" "movq 1024(%1, %%esi), %%mm0 \n\t" "movq 2048(%1, %%esi), %%mm1 \n\t" "movq (%1, %%esi), %%mm5 \n\t" "psubd %%mm7, %%mm0 \n\t" "psubd %%mm7, %%mm1 \n\t" "psubd %%mm7, %%mm5 \n\t" "leal (%%esi, %%esi, 2), %%edi \n\t" "pxor %%mm4, %%mm4 \n\t" "packssdw %%mm5, %%mm0 \n\t" // FfAa "packssdw %%mm4, %%mm1 \n\t" // 00Bb "punpckhwd %%mm0, %%mm4 \n\t" // F0f0 "punpcklwd %%mm1, %%mm0 \n\t" // BAba "movq %%mm0, %%mm1 \n\t" // BAba "punpckldq %%mm4, %%mm3 \n\t" // f0XX "punpckldq %%mm6, %%mm0 \n\t" // 00ba "punpckhdq %%mm1, %%mm3 \n\t" // BAf0 "movq %%mm0, (%0, %%edi) \n\t" // 00ba "punpckhdq %%mm4, %%mm0 \n\t" // F000 "movq %%mm3, 8(%0, %%edi) \n\t" // BAf0 "movq %%mm0, 16(%0, %%edi) \n\t" // F000 "addl $8, %%esi \n\t" " jnz 1b \n\t" "emms \n\t" :: "r" (s16+1536), "r" (f+256) :"%esi", "%edi", "memory" ); return 6*256;}static int a52_resample_3F_LFE_to_6_MMX(float * _f, int16_t * s16){ int32_t * f = (int32_t *) _f; asm volatile( "movl $-1024, %%esi \n\t" "movq "MANGLE(magicF2W)", %%mm7 \n\t" "pxor %%mm6, %%mm6 \n\t" "1: \n\t" "movq 1024(%1, %%esi), %%mm0 \n\t" "movq 3072(%1, %%esi), %%mm1 \n\t" "movq 2048(%1, %%esi), %%mm4 \n\t" "movq (%1, %%esi), %%mm5 \n\t" "psubd %%mm7, %%mm0 \n\t" "psubd %%mm7, %%mm1 \n\t" "psubd %%mm7, %%mm4 \n\t" "psubd %%mm7, %%mm5 \n\t" "leal (%%esi, %%esi, 2), %%edi \n\t" "packssdw %%mm4, %%mm0 \n\t" // EeAa "packssdw %%mm5, %%mm1 \n\t" // FfBb "movq %%mm0, %%mm2 \n\t" // EeAa "punpcklwd %%mm1, %%mm0 \n\t" // BAba "punpckhwd %%mm1, %%mm2 \n\t" // FEfe "movq %%mm0, %%mm1 \n\t" // BAba "punpckldq %%mm6, %%mm0 \n\t" // 00ba "punpckhdq %%mm1, %%mm1 \n\t" // BABA "movq %%mm0, (%0, %%edi) \n\t" "punpckhdq %%mm2, %%mm0 \n\t" // FE00 "punpckldq %%mm1, %%mm2 \n\t" // BAfe "movq %%mm2, 8(%0, %%edi) \n\t" "movq %%mm0, 16(%0, %%edi) \n\t" "addl $8, %%esi \n\t" " jnz 1b \n\t" "emms \n\t" :: "r" (s16+1536), "r" (f+256) :"%esi", "%edi", "memory" ); return 6*256;}static int a52_resample_2F_2R_LFE_to_6_MMX(float * _f, int16_t * s16){ int32_t * f = (int32_t *) _f; asm volatile( "movl $-1024, %%esi \n\t" "movq "MANGLE(magicF2W)", %%mm7 \n\t"// "pxor %%mm6, %%mm6 \n\t" "1: \n\t" "movq 1024(%1, %%esi), %%mm0 \n\t" "movq 2048(%1, %%esi), %%mm1 \n\t" "movq 3072(%1, %%esi), %%mm2 \n\t" "movq 4096(%1, %%esi), %%mm3 \n\t" "movq (%1, %%esi), %%mm5 \n\t" "psubd %%mm7, %%mm0 \n\t" "psubd %%mm7, %%mm1 \n\t" "psubd %%mm7, %%mm2 \n\t" "psubd %%mm7, %%mm3 \n\t" "psubd %%mm7, %%mm5 \n\t" "leal (%%esi, %%esi, 2), %%edi \n\t" "packssdw %%mm2, %%mm0 \n\t" // CcAa "packssdw %%mm3, %%mm1 \n\t" // DdBb "packssdw %%mm5, %%mm5 \n\t" // FfFf "movq %%mm0, %%mm2 \n\t" // CcAa "punpcklwd %%mm1, %%mm0 \n\t" // BAba "punpckhwd %%mm1, %%mm2 \n\t" // DCdc "pxor %%mm4, %%mm4 \n\t" // 0000 "punpcklwd %%mm5, %%mm4 \n\t" // F0f0 "movq %%mm0, %%mm1 \n\t" // BAba "movq %%mm4, %%mm3 \n\t" // F0f0 "punpckldq %%mm2, %%mm0 \n\t" // dcba "punpckhdq %%mm1, %%mm1 \n\t" // BABA "punpckldq %%mm1, %%mm4 \n\t" // BAf0 "punpckhdq %%mm3, %%mm2 \n\t" // F0DC "movq %%mm0, (%0, %%edi) \n\t" "movq %%mm4, 8(%0, %%edi) \n\t" "movq %%mm2, 16(%0, %%edi) \n\t" "addl $8, %%esi \n\t" " jnz 1b \n\t" "emms \n\t" :: "r" (s16+1536), "r" (f+256) :"%esi", "%edi", "memory" ); return 6*256;}static int a52_resample_3F_2R_LFE_to_6_MMX(float * _f, int16_t * s16){ int32_t * f = (int32_t *) _f; asm volatile( "movl $-1024, %%esi \n\t" "movq "MANGLE(magicF2W)", %%mm7 \n\t"// "pxor %%mm6, %%mm6 \n\t" "1: \n\t" "movq 1024(%1, %%esi), %%mm0 \n\t" "movq 3072(%1, %%esi), %%mm1 \n\t" "movq 4096(%1, %%esi), %%mm2 \n\t" "movq 5120(%1, %%esi), %%mm3 \n\t" "movq 2048(%1, %%esi), %%mm4 \n\t" "movq (%1, %%esi), %%mm5 \n\t" "psubd %%mm7, %%mm0 \n\t" "psubd %%mm7, %%mm1 \n\t" "psubd %%mm7, %%mm2 \n\t" "psubd %%mm7, %%mm3 \n\t" "psubd %%mm7, %%mm4 \n\t" "psubd %%mm7, %%mm5 \n\t" "leal (%%esi, %%esi, 2), %%edi \n\t" "packssdw %%mm2, %%mm0 \n\t" // CcAa "packssdw %%mm3, %%mm1 \n\t" // DdBb "packssdw %%mm4, %%mm4 \n\t" // EeEe "packssdw %%mm5, %%mm5 \n\t" // FfFf "movq %%mm0, %%mm2 \n\t" // CcAa "punpcklwd %%mm1, %%mm0 \n\t" // BAba "punpckhwd %%mm1, %%mm2 \n\t" // DCdc "punpcklwd %%mm5, %%mm4 \n\t" // FEfe "movq %%mm0, %%mm1 \n\t" // BAba "movq %%mm4, %%mm3 \n\t" // FEfe "punpckldq %%mm2, %%mm0 \n\t" // dcba "punpckhdq %%mm1, %%mm1 \n\t" // BABA "punpckldq %%mm1, %%mm4 \n\t" // BAfe "punpckhdq %%mm3, %%mm2 \n\t" // FEDC "movq %%mm0, (%0, %%edi) \n\t" "movq %%mm4, 8(%0, %%edi) \n\t" "movq %%mm2, 16(%0, %%edi) \n\t" "addl $8, %%esi \n\t" " jnz 1b \n\t" "emms \n\t" :: "r" (s16+1536), "r" (f+256) :"%esi", "%edi", "memory" ); return 6*256;}static void* a52_resample_MMX(int flags, int ch){ switch (flags) { case A52_MONO: if(ch==5) return a52_resample_MONO_to_5_MMX; break; case A52_CHANNEL: case A52_STEREO: case A52_DOLBY: if(ch==2) return a52_resample_STEREO_to_2_MMX; break; case A52_3F: if(ch==5) return a52_resample_3F_to_5_MMX; break; case A52_2F2R: if(ch==4) return a52_resample_2F_2R_to_4_MMX; break; case A52_3F2R: if(ch==5) return a52_resample_3F_2R_to_5_MMX; break; case A52_MONO | A52_LFE: if(ch==6) return a52_resample_MONO_LFE_to_6_MMX; break; case A52_CHANNEL | A52_LFE: case A52_STEREO | A52_LFE: case A52_DOLBY | A52_LFE: if(ch==6) return a52_resample_STEREO_LFE_to_6_MMX; break; case A52_3F | A52_LFE: if(ch==6) return a52_resample_3F_LFE_to_6_MMX; break; case A52_2F2R | A52_LFE: if(ch==6) return a52_resample_2F_2R_LFE_to_6_MMX; break; case A52_3F2R | A52_LFE: if(ch==6) return a52_resample_3F_2R_LFE_to_6_MMX; break; } return NULL;}
⌨️ 快捷键说明
复制代码
Ctrl + C
搜索代码
Ctrl + F
全屏模式
F11
切换主题
Ctrl + Shift + D
显示快捷键
?
增大字号
Ctrl + =
减小字号
Ctrl + -