ffmpeg

mirror of https://git.ffmpeg.org/ffmpeg.git synced 2025-02-28 01:31:00 +00:00

History

Lauri Kasanen 8522d219ce libswscale/ppc: VSX-optimize 9-16 bit yuv2planeX ./ffmpeg_g -f rawvideo -pix_fmt rgb24 -s hd1080 -i /dev/zero -pix_fmt yuv420p16be \ -s 1920x1728 -f null -vframes 100 -v error -nostats - 9-14 bit funcs get about 6x speedup, 16-bit gets about 15x. Fate passes, each format tested with an image to video conversion. Only POWER8 includes 32-bit vector multiplies, so POWER7 is locked out of the 16-bit function. This includes the vec_mulo/mule functions too, not just vmuluwm. With TIMER_REPORT skips disabled: yuv420p9le 12412 UNITS in planarX, 131072 runs, 0 skips 73136 UNITS in planarX, 131072 runs, 0 skips yuv420p9be 12481 UNITS in planarX, 131072 runs, 0 skips 73410 UNITS in planarX, 131072 runs, 0 skips yuv420p10le 12322 UNITS in planarX, 131072 runs, 0 skips 72546 UNITS in planarX, 131072 runs, 0 skips yuv420p10be 12291 UNITS in planarX, 131072 runs, 0 skips 72935 UNITS in planarX, 131072 runs, 0 skips yuv420p12le 12316 UNITS in planarX, 131072 runs, 0 skips 72708 UNITS in planarX, 131072 runs, 0 skips yuv420p12be 12319 UNITS in planarX, 131072 runs, 0 skips 72577 UNITS in planarX, 131072 runs, 0 skips yuv420p14le 12259 UNITS in planarX, 131072 runs, 0 skips 72516 UNITS in planarX, 131072 runs, 0 skips yuv420p14be 12440 UNITS in planarX, 131072 runs, 0 skips 72962 UNITS in planarX, 131072 runs, 0 skips yuv420p16le 10548 UNITS in planarX, 131072 runs, 0 skips 73429 UNITS in planarX, 131072 runs, 0 skips yuv420p16be 10634 UNITS in planarX, 131072 runs, 0 skips 150959 UNITS in planarX, 131072 runs, 0 skips Signed-off-by: Lauri Kasanen <cand@gmx.com>		2019-02-05 09:34:53 +02:00
..
aarch64
arm
ppc	libswscale/ppc: VSX-optimize 9-16 bit yuv2planeX	2019-02-05 09:34:53 +02:00
tests
x86	swscale/x86/rgb2rgb.asm : add Ivo Van Poorten name to the top of the file	2018-10-18 21:43:19 +02:00
alphablend.c
bayer_template.c
gamma.c
hscale_fast_bilinear.c
hscale.c
input.c	swscale : add support for YUVA444P12 and YUVA422P12	2018-11-24 16:24:47 +01:00
libswscale.v
log2_tab.c
Makefile
options.c
output.c	swscale : add YA16 LE/BE output	2018-10-18 21:43:24 +02:00
rgb2rgb_template.c
rgb2rgb.c
rgb2rgb.h
slice.c
swscale_internal.h	swscale/ppc: Move VSX-using code to its own file	2018-12-04 02:59:07 +01:00
swscale_unscaled.c	swscale/swscale_unscaled : rename packed_16bpc_bswap	2018-10-24 21:21:20 +02:00
swscale.c
swscale.h
swscaleres.rc
utils.c	swscale : add support for YUVA444P12 and YUVA422P12	2018-11-24 16:24:47 +01:00
version.h	Bump minor version for master after 4.1 branchpoint	2018-11-02 00:53:07 +01:00
vscale.c
yuv2rgb.c	swscale/yuv2rgb: Return a more specific error code from ff_yuv2rgb_c_init_tables()	2019-01-01 21:11:47 +01:00