	.version 1.4
	.target sm_11, map_f64_to_f32
	// compiled with ../../../External/3rdParty/NVIDIA/CUDA/win/64/bin64/../open64/lib//be.exe
	// nvopencc 2.3 built on 2009-07-14

	//-----------------------------------------------------------
	// Compiling C:\Users\dvaeng\AppData\Local\Temp/tmpxft_0001d984_00000000-9_Sharpen.cpp3.i (C:/Users/dvaeng/AppData/Local/Temp/ccBI#.a21084)
	//-----------------------------------------------------------

	//-----------------------------------------------------------
	// Options:
	//-----------------------------------------------------------
	//  Target:ptx, ISA:sm_11, Endian:little, Pointer Size:64
	//  -O3	(Optimization level)
	//  -g0	(Debug level)
	//  -m2	(Report advisories)
	//-----------------------------------------------------------

	.file	1	"C:\Users\dvaeng\AppData\Local\Temp/tmpxft_0001d984_00000000-8_Sharpen.cudafe2.gpu"
	.file	2	"C:\Program Files (x86)\Microsoft Visual Studio 9.0\VC\include\crtdefs.h"
	.file	3	"c:\scully64\shared\adobe\MediaCore\External\3rdParty\NVIDIA\CUDA\win\64\include\crt/device_runtime.h"
	.file	4	"c:\scully64\shared\adobe\MediaCore\External\3rdParty\NVIDIA\CUDA\win\64\include\host_defines.h"
	.file	5	"c:\scully64\shared\adobe\MediaCore\External\3rdParty\NVIDIA\CUDA\win\64\include\builtin_types.h"
	.file	6	"c:\scully64\shared\adobe\mediacore\external\3rdparty\nvidia\cuda\win\64\include\device_types.h"
	.file	7	"c:\scully64\shared\adobe\mediacore\external\3rdparty\nvidia\cuda\win\64\include\driver_types.h"
	.file	8	"c:\scully64\shared\adobe\mediacore\external\3rdparty\nvidia\cuda\win\64\include\texture_types.h"
	.file	9	"c:\scully64\shared\adobe\mediacore\external\3rdparty\nvidia\cuda\win\64\include\vector_types.h"
	.file	10	"c:\scully64\shared\adobe\mediacore\external\3rdparty\nvidia\cuda\win\64\include\host_defines.h"
	.file	11	"c:\scully64\shared\adobe\MediaCore\External\3rdParty\NVIDIA\CUDA\win\64\include\device_launch_parameters.h"
	.file	12	"c:\scully64\shared\adobe\mediacore\external\3rdparty\nvidia\cuda\win\64\include\crt\storage_class.h"
	.file	13	"C:\Program Files (x86)\Microsoft Visual Studio 9.0\VC\include\time.h"
	.file	14	"c:\scully64\shared\adobe\MediaCore\GPUFoundation\API\Inc\GPUFoundation/KernelSupport/Utils.h"
	.file	15	"c:\scully64\shared\adobe\MediaCore\GPUFoundation\API\Inc\GPUFoundation/KernelSupport/VectorUtils.h"
	.file	16	"c:\scully64\shared\adobe\MediaCore\GPUFoundation\API\Inc\GPUFoundation/KernelSupport/PixelRGB.h"
	.file	17	"c:/scully64/shared/adobe/MediaCore/Display/Src/CUDA/Effects/Sharpen.cu"
	.file	18	"c:\scully64\shared\adobe\MediaCore\External\3rdParty\NVIDIA\CUDA\win\64\include\common_functions.h"
	.file	19	"c:\scully64\shared\adobe\mediacore\external\3rdparty\nvidia\cuda\win\64\include\crt/func_macro.h"
	.file	20	"c:\scully64\shared\adobe\mediacore\external\3rdparty\nvidia\cuda\win\64\include\math_functions.h"
	.file	21	"c:\scully64\shared\adobe\mediacore\external\3rdparty\nvidia\cuda\win\64\include\device_functions.h"
	.file	22	"c:\scully64\shared\adobe\mediacore\external\3rdparty\nvidia\cuda\win\64\include\math_constants.h"
	.file	23	"c:\scully64\shared\adobe\mediacore\external\3rdparty\nvidia\cuda\win\64\include\sm_11_atomic_functions.h"
	.file	24	"c:\scully64\shared\adobe\mediacore\external\3rdparty\nvidia\cuda\win\64\include\sm_12_atomic_functions.h"
	.file	25	"c:\scully64\shared\adobe\mediacore\external\3rdparty\nvidia\cuda\win\64\include\sm_13_double_functions.h"
	.file	26	"c:\scully64\shared\adobe\mediacore\external\3rdparty\nvidia\cuda\win\64\include\common_types.h"
	.file	27	"c:\scully64\shared\adobe\mediacore\external\3rdparty\nvidia\cuda\win\64\include\texture_fetch_functions.h"
	.file	28	"c:\scully64\shared\adobe\mediacore\external\3rdparty\nvidia\cuda\win\64\include\math_functions_dbl_ptx1.h"

	.tex .u64 sTexture;

	.entry SharpenKernel (
		.param .u64 __cudaparm_SharpenKernel_inImage,
		.param .s32 __cudaparm_SharpenKernel_inPitch,
		.param .s32 __cudaparm_SharpenKernel_inWidth,
		.param .s32 __cudaparm_SharpenKernel_inHeight,
		.param .f32 __cudaparm_SharpenKernel_inCenterCoeff,
		.param .f32 __cudaparm_SharpenKernel_inSurroundCoeff)
	{
	.reg .u32 %r<23>;
	.reg .u64 %rd<6>;
	.reg .f32 %f<101>;
	.reg .pred %p<3>;
	.loc	17	38	0
$LBB1_SharpenKernel:
	.loc	17	41	0
	cvt.s32.u16 	%r1, %ctaid.x;
	cvt.s32.u16 	%r2, %ntid.x;
	mul24.lo.s32 	%r3, %r1, %r2;
	cvt.s32.u16 	%r4, %ctaid.y;
	cvt.s32.u16 	%r5, %ntid.y;
	mul24.lo.s32 	%r6, %r4, %r5;
	cvt.u32.u16 	%r7, %tid.x;
	add.u32 	%r8, %r3, %r7;
	cvt.u32.u16 	%r9, %tid.y;
	add.u32 	%r10, %r6, %r9;
	ld.param.s32 	%r11, [__cudaparm_SharpenKernel_inWidth];
	set.gt.u32.s32 	%r12, %r11, %r8;
	neg.s32 	%r13, %r12;
	ld.param.s32 	%r14, [__cudaparm_SharpenKernel_inHeight];
	set.gt.u32.s32 	%r15, %r14, %r10;
	neg.s32 	%r16, %r15;
	and.b32 	%r17, %r13, %r16;
	mov.u32 	%r18, 0;
	setp.eq.s32 	%p1, %r17, %r18;
	@%p1 bra 	$Lt_0_1282;
	cvt.rn.f32.s32 	%f1, %r8;
	cvt.rn.f32.s32 	%f2, %r10;
	mov.f32 	%f3, 0f3f000000;     	// 0.5
	add.f32 	%f4, %f1, %f3;
	mov.f32 	%f5, %f4;
	mov.f32 	%f6, 0fbf000000;     	// -0.5
	add.f32 	%f7, %f2, %f6;
	mov.f32 	%f8, 0f00000000;     	// 0
	mov.f32 	%f9, 0f00000000;     	// 0
	tex.2d.v4.f32.f32 {%f10,%f11,%f12,%f13},[sTexture,{%f5,%f7,%f8,%f9}];
	.loc	17	44	0
	mov.f32 	%f14, %f10;
	mov.f32 	%f15, %f11;
	mov.f32 	%f16, %f12;
	mov.f32 	%f17, %f13;
	mov.f32 	%f18, 0f3f000000;    	// 0.5
	add.f32 	%f19, %f2, %f18;
	mov.f32 	%f20, 0fbf000000;    	// -0.5
	add.f32 	%f21, %f1, %f20;
	mov.f32 	%f22, %f19;
	mov.f32 	%f23, 0f00000000;    	// 0
	mov.f32 	%f24, 0f00000000;    	// 0
	tex.2d.v4.f32.f32 {%f25,%f26,%f27,%f28},[sTexture,{%f21,%f22,%f23,%f24}];
	.loc	17	45	0
	mov.f32 	%f29, %f25;
	mov.f32 	%f30, %f26;
	mov.f32 	%f31, %f27;
	mov.f32 	%f32, %f28;
	mov.f32 	%f33, %f4;
	mov.f32 	%f34, %f19;
	mov.f32 	%f35, 0f00000000;    	// 0
	mov.f32 	%f36, 0f00000000;    	// 0
	tex.2d.v4.f32.f32 {%f37,%f38,%f39,%f40},[sTexture,{%f33,%f34,%f35,%f36}];
	.loc	17	46	0
	mov.f32 	%f41, %f37;
	mov.f32 	%f42, %f38;
	mov.f32 	%f43, %f39;
	mov.f32 	%f44, %f40;
	mov.f32 	%f45, 0f3fc00000;    	// 1.5
	add.f32 	%f46, %f1, %f45;
	mov.f32 	%f47, %f19;
	mov.f32 	%f48, 0f00000000;    	// 0
	mov.f32 	%f49, 0f00000000;    	// 0
	tex.2d.v4.f32.f32 {%f50,%f51,%f52,%f53},[sTexture,{%f46,%f47,%f48,%f49}];
	.loc	17	47	0
	mov.f32 	%f54, %f50;
	mov.f32 	%f55, %f51;
	mov.f32 	%f56, %f52;
	mov.f32 	%f57, %f53;
	mov.f32 	%f58, %f4;
	mov.f32 	%f59, 0f3fc00000;    	// 1.5
	add.f32 	%f60, %f2, %f59;
	mov.f32 	%f61, 0f00000000;    	// 0
	mov.f32 	%f62, 0f00000000;    	// 0
	tex.2d.v4.f32.f32 {%f63,%f64,%f65,%f66},[sTexture,{%f58,%f60,%f61,%f62}];
	.loc	17	48	0
	mov.f32 	%f67, %f63;
	mov.f32 	%f68, %f64;
	mov.f32 	%f69, %f65;
	mov.f32 	%f70, %f66;
	.loc	14	100	0
	ld.param.f32 	%f71, [__cudaparm_SharpenKernel_inSurroundCoeff];
	ld.param.f32 	%f72, [__cudaparm_SharpenKernel_inCenterCoeff];
	mov.f32 	%f73, 0f40800000;    	// 4
	mad.f32 	%f74, %f73, %f71, %f72;
	rcp.approx.f32 	%f75, %f74;
	ld.param.s32 	%r19, [__cudaparm_SharpenKernel_inPitch];
	mul24.lo.s32 	%r20, %r10, %r19;
	ld.param.u64 	%rd1, [__cudaparm_SharpenKernel_inImage];
	add.s32 	%r21, %r20, %r8;
	cvt.s64.s32 	%rd2, %r21;
	mul.lo.u64 	%rd3, %rd2, 16;
	add.u64 	%rd4, %rd1, %rd3;
	add.f32 	%f76, %f14, %f29;
	add.f32 	%f77, %f54, %f76;
	add.f32 	%f78, %f67, %f77;
	mul.f32 	%f79, %f71, %f78;
	mad.f32 	%f80, %f41, %f72, %f79;
	mul.f32 	%f81, %f75, %f80;
	add.f32 	%f82, %f15, %f30;
	add.f32 	%f83, %f55, %f82;
	add.f32 	%f84, %f68, %f83;
	mul.f32 	%f85, %f71, %f84;
	mad.f32 	%f86, %f42, %f72, %f85;
	mul.f32 	%f87, %f75, %f86;
	add.f32 	%f88, %f16, %f31;
	add.f32 	%f89, %f56, %f88;
	add.f32 	%f90, %f69, %f89;
	mul.f32 	%f91, %f71, %f90;
	mad.f32 	%f92, %f43, %f72, %f91;
	mul.f32 	%f93, %f75, %f92;
	add.f32 	%f94, %f17, %f32;
	add.f32 	%f95, %f57, %f94;
	add.f32 	%f96, %f70, %f95;
	mul.f32 	%f97, %f71, %f96;
	mad.f32 	%f98, %f44, %f72, %f97;
	mul.f32 	%f99, %f75, %f98;
	st.global.v4.f32 	[%rd4+0], {%f81,%f87,%f93,%f99};
$Lt_0_1282:
	.loc	17	56	0
	exit;
$LDWend_SharpenKernel:
	} // SharpenKernel

