更新:int4
私のカーネルのが間違っていました。
pyopenclを使用していますが、構造体のアライメントを正しく機能させることができません。カーネルを2回呼び出す以下のコードでは、b
値は正しく(1として)返されますが、c
値には「ランダムな」値があります。
言い換えると、構造体の2つのメンバーを読み取ろうとしています。最初は読めますが、2番目は読めません。なんで?
numpy構造体配列を使用する場合でも、structを使用してパックする場合でも、同じ問題が発生します。また、_-attribute__
コメントの設定も役に立ちません。
コードの他の場所で愚かなことをしているのではないかと思いますが、それを見ることができません。助けていただければ幸いです。
import struct as s
import pyopencl as cl
import numpy as n
ctx = cl.create_some_context()
queue = cl.CommandQueue(ctx)
for use_struct in (True, False):
if use_struct:
a = s.pack('=ii',1,2)
print(a, len(a))
a_dev = cl.Buffer(ctx, cl.mem_flags.WRITE_ONLY, len(a))
else:
# a = n.array([(1,2)], dtype=n.dtype('2i4', align=True))
a = n.array([(1,2)], dtype=n.dtype('2i4'))
print(a, a.itemsize, a.nbytes)
a_dev = cl.Buffer(ctx, cl.mem_flags.WRITE_ONLY, a.nbytes)
b = n.array([0], dtype='i4')
print(b, b.itemsize, b.nbytes)
b_dev = cl.Buffer(ctx, cl.mem_flags.READ_ONLY, b.nbytes)
c = n.array([0], dtype='i4')
print(c, c.itemsize, c.nbytes)
c_dev = cl.Buffer(ctx, cl.mem_flags.READ_ONLY, c.nbytes)
prg = cl.Program(ctx, """
typedef struct s {
int4 f0;
int4 f1 __attribute__ ((packed));
// int4 f1 __attribute__ ((aligned (4)));
// int4 f1;
} s;
__kernel void test(__global const s *a, __global int4 *b, __global int4 *c) {
*b = a->f0;
*c = a->f1;
}
""").build()
cl.enqueue_copy(queue, a_dev, a)
event = prg.test(queue, (1,), None, a_dev, b_dev, c_dev)
event.wait()
cl.enqueue_copy(queue, b, b_dev)
print(b)
cl.enqueue_copy(queue, c, c_dev)
print(c)
出力(切り取り+貼り付け中に再フォーマットする必要があったため、改行が少し混乱した可能性があります。さまざまな印刷値を示すコメントも追加しました):
# first using struct
/home/andrew/projects/personal/kultrung/env/bin/python3.2 /home/andrew/projects/personal/kultrung/src/kultrung/test6.py
b'\x01\x00\x00\x00\x02\x00\x00\x00' 8 # the struct packed values
[0] 4 4 # output buffer 1
[0] 4 4 # output buffer 2
/home/andrew/projects/personal/kultrung/env/lib/python3.2/site-packages/pyopencl/cache.py:343: UserWarning: Build succeeded, but resulted in non-empty logs: Build on <pyopencl.Device 'Intel(R) Core(TM)2 CPU T5600 @ 1.83GHz' at 0x1385a20> succeeded, but said:
Build started Kernel <test> was successfully vectorized Done. warn("Build succeeded, but resulted in non-empty logs:\n"+message)
[1] # the first value (correct)
[240] # the second value (wrong)
# next using numpy
[[1 2]] 4 8 # the numpy struct
[0] 4 4 # output buffer
[0] 4 4 # output buffer
/home/andrew/projects/personal/kultrung/env/lib/python3.2/site-packages/pyopencl/__init__.py:174: UserWarning: Build succeeded, but resulted in non-empty logs: Build on <pyopencl.Device 'Intel(R) Core(TM)2 CPU T5600 @ 1.83GHz' at 0x1385a20> succeeded, but said:
Build started Kernel <test> was successfully vectorized Done. warn("Build succeeded, but resulted in non-empty logs:\n"+message)
[1] # first value (ok)
[67447488] # second value (wrong)
Process finished with exit code 0