<div dir="ltr"><div>Thank you very much, Nate.</div><div><br></div><div>It&#39;s works.</div><div><br></div><div>I setup the &quot;max_sectors&quot; parameter to &quot;4096&quot;:</div><div><br></div><div><div># cat /etc/modprobe.d/mpt2sas.conf </div><div>options mpt2sas max_sectors=4096</div></div><div><br></div><div>And the bonnie++ tests were sucessfully executed.</div><div><br></div><div>Regards,</div><div>Angelo</div><div class="gmail_extra">
<br><div class="gmail_quote">2016-03-28 19:55 GMT-03:00 Nate Pearlstein <span dir="ltr">&lt;<a href="mailto:darknater@darknater.org" target="_blank">darknater@darknater.org</a>&gt;</span>:<br><blockquote class="gmail_quote" style="margin:0px 0px 0px 0.8ex;border-left-width:1px;border-left-style:solid;border-left-color:rgb(204,204,204);padding-left:1ex">I thought I responded to the entire list but only sent to Angelo,<br>
<span><br>
Very likely, lustre on the oss nodes is setting the max_sectors_kb all the way up to max_hw_sectors_kb and this value ends up being too large for the sas hca.  You should set max_sectors for you mpt2sas to something smaller like 4096, rebuild the initrd and this will put a better limit on max_hw_sectors_kb for the is5600 luns\u2026<br>
<br>
<br>
</span>&gt; On Mar 28, 2016, at 6:51 PM, Dilger, Andreas &lt;<a href="mailto:andreas.dilger@intel.com" target="_blank">andreas.dilger@intel.com</a>&gt; wrote:<br>
<span>&gt;<br>
&gt; On 2016/03/28, 08:01, &quot;lustre-discuss on behalf of Angelo Cavalcanti&quot; &lt;<a href="mailto:lustre-discuss-bounces@lists.lustre.org" target="_blank">lustre-discuss-bounces@lists.lustre.org</a>&lt;mailto:<a href="mailto:lustre-discuss-bounces@lists.lustre.org" target="_blank">lustre-discuss-bounces@lists.lustre.org</a>&gt; on behalf of <a href="mailto:acrribeiro@gmail.com" target="_blank">acrribeiro@gmail.com</a>&lt;mailto:<a href="mailto:acrribeiro@gmail.com" target="_blank">acrribeiro@gmail.com</a>&gt;&gt; wrote:<br>
&gt;<br>
&gt;<br>
&gt; Dear all,<br>
&gt;<br>
&gt; We&#39;re having trouble with a lustre 2.5.3 implementation. This is our setup:<br>
&gt;<br>
&gt;<br>
</span>&gt;  *   One server for MGS/MDS/MDT. MDT is served from a raid-6 backed partition of 2TB (que tipo de hd?)<br>
<span>&gt;<br>
&gt; Note that using RAID-6 for the MDT storage will significantly hurt your metadata<br>
&gt; performance, since this will incur a lot of read-modify-write overhead when doing<br>
&gt; 4KB metadata block updates.<br>
&gt;<br>
&gt; Cheers, Andreas<br>
&gt; --<br>
&gt; Andreas Dilger<br>
&gt; Lustre Principal Architect<br>
&gt; Intel High Performance Data Division<br>
&gt;<br>
&gt;<br>
</span>&gt;  *   Two OSS/OST in a active/active HA with pacemaker. Both are connected to a storage via SAS.<br>
&gt;<br>
&gt;<br>
&gt;  *   One SGI Infinite Storage IS5600 with two raid-6 backed volume groups. Each group has two volumes, each volume has 15TB capacity.<br>
<div><div>&gt;<br>
&gt;<br>
&gt; Volumes are recognized by OSSs as multipath devices, each voulme has 4 paths. Volumes were created with a GPT partition table and a single partition.<br>
&gt;<br>
&gt;<br>
&gt; Volume partitions were then formatted as OSTs with the following command:<br>
&gt;<br>
&gt;<br>
&gt; # mkfs.lustre --replace --reformat --ost --mkfsoptions=&quot; -E stride=128,stripe_width=1024&quot; --mountfsoptions=&quot;errors=remount-ro,extents,mballoc&quot; --fsname=lustre1 --mgsnode=10.149.0.153@o2ib1 --index=0 --servicenode=10.149.0.151@o2ib1 --servicenode=10.149.0.152@o2ib1 /dev/mapper/360080e500029eaec0000012656951fcap1<br>
&gt;<br>
&gt;<br>
&gt; Testing with bonnie++ in a client with the below command:<br>
&gt;<br>
&gt; $ ./bonnie++-1.03e/bonnie++ -m lustre1 -d /mnt/lustre -s 128G:1024k -n 0 -f -b -u vhpc<br>
&gt;<br>
&gt;<br>
&gt; No problem creating files inside the lustre mount point, but *rewriting* the same files results in the errors below:<br>
&gt;<br>
&gt;<br>
&gt; Mar 18 17:46:13 oss01 multipathd: 8:128: mark as failed<br>
&gt;<br>
&gt; Mar 18 17:46:13 oss01 multipathd: 360080e500029eaec0000012656951fca: remaining active paths: 3<br>
&gt;<br>
&gt; Mar 18 17:46:13 oss01 kernel: sd 1:0:0:0: [sdi] Unhandled error code<br>
&gt;<br>
&gt; Mar 18 17:46:13 oss01 kernel: sd 1:0:0:0: [sdi] Result: hostbyte=DID_SOFT_ERROR driverbyte=DRIVER_OK<br>
&gt;<br>
&gt; Mar 18 17:46:13 oss01 kernel: sd 1:0:0:0: [sdi] CDB: Read(10): 28 00 00 06 d8 22 00 20 00 00<br>
&gt;<br>
&gt; Mar 18 17:46:13 oss01 kernel: __ratelimit: 109 callbacks suppressed<br>
&gt;<br>
&gt; Mar 18 17:46:13 oss01 kernel: device-mapper: multipath: Failing path 8:128.<br>
&gt;<br>
&gt; Mar 18 17:46:13 oss01 kernel: sd 1:0:1:0: [sdm] Unhandled error code<br>
&gt;<br>
&gt; Mar 18 17:46:13 oss01 kernel: sd 1:0:1:0: [sdm] Result: hostbyte=DID_SOFT_ERROR driverbyte=DRIVER_OK<br>
&gt;<br>
&gt; Mar 18 17:46:13 oss01 kernel: sd 1:0:1:0: [sdm] CDB: Read(10): 28 00 00 07 18 22 00 18 00 00<br>
&gt;<br>
&gt; Mar 18 17:46:13 oss01 kernel: device-mapper: multipath: Failing path 8:192.<br>
&gt;<br>
&gt; Mar 18 17:46:13 oss01 kernel: sd 1:0:1:0: [sdm] Unhandled error code<br>
&gt;<br>
&gt; Mar 18 17:46:13 oss01 kernel: sd 1:0:1:0: [sdm] Result: hostbyte=DID_SOFT_ERROR driverbyte=DRIVER_OK<br>
&gt;<br>
&gt; Mar 18 17:46:13 oss01 kernel: sd 1:0:1:0: [sdm] CDB: Read(10): 28 00 00 06 d8 22 00 20 00 00<br>
&gt;<br>
&gt; Mar 18 17:46:13 oss01 kernel: sd 0:0:1:0: [sde] Unhandled error code<br>
&gt;<br>
&gt; Mar 18 17:46:13 oss01 kernel: sd 0:0:1:0: [sde] Result: hostbyte=DID_SOFT_ERROR driverbyte=DRIVER_OK<br>
&gt;<br>
&gt; Mar 18 17:46:13 oss01 kernel: sd 0:0:1:0: [sde] CDB: Read(10): 28 00 00 07 18 22 00 18 00 00<br>
&gt;<br>
&gt; Mar 18 17:46:13 oss01 kernel: device-mapper: multipath: Failing path 8:64.<br>
&gt;<br>
&gt; Mar 18 17:46:13 oss01 kernel: sd 0:0:0:0: [sda] Unhandled error code<br>
&gt;<br>
&gt; Mar 18 17:46:13 oss01 kernel: sd 0:0:0:0: [sda] Result: hostbyte=DID_SOFT_ERROR driverbyte=DRIVER_OK<br>
&gt;<br>
&gt; Mar 18 17:46:13 oss01 kernel: sd 0:0:0:0: [sda] CDB: Read(10): 28 00 00 07 18 22 00 18 00 00<br>
&gt;<br>
&gt; Mar 18 17:46:13 oss01 kernel: device-mapper: multipath: Failing path 8:0.<br>
&gt;<br>
&gt; Mar 18 17:46:13 oss01 kernel: sd 0:0:0:0: [sda] Unhandled error code<br>
&gt;<br>
&gt; Mar 18 17:46:13 oss01 kernel: sd 0:0:0:0: [sda] Result: hostbyte=DID_SOFT_ERROR driverbyte=DRIVER_OK<br>
&gt;<br>
&gt; Mar 18 17:46:13 oss01 kernel: sd 0:0:0:0: [sda] CDB: Read(10): 28 00 00 06 d8 22 00 20 00 00<br>
&gt;<br>
&gt; Mar 18 17:46:14 oss01 multipathd: 360080e500029eaec0000012656951fca: sdi - rdac checker reports path is up<br>
&gt;<br>
&gt; Mar 18 17:46:14 oss01 multipathd: 8:128: reinstated<br>
&gt;<br>
&gt; Mar 18 17:46:14 oss01 multipathd: 360080e500029eaec0000012656951fca: remaining active paths: 4<br>
&gt;<br>
&gt; Mar 18 17:46:14 oss01 kernel: sd 1:0:0:0: [sdi] Unhandled error code<br>
&gt;<br>
&gt; Mar 18 17:46:14 oss01 kernel: sd 1:0:0:0: [sdi] Result: hostbyte=DID_SOFT_ERROR driverbyte=DRIVER_OK<br>
&gt;<br>
&gt; Mar 18 17:46:14 oss01 kernel: sd 1:0:0:0: [sdi] CDB: Read(10): 28 00 00 07 18 22 00 18 00 00<br>
&gt;<br>
&gt; Mar 18 17:46:14 oss01 kernel: device-mapper: multipath: Failing path 8:128.<br>
&gt;<br>
&gt; Mar 18 17:46:14 oss01 kernel: sd 1:0:0:0: [sdi] Unhandled error code<br>
&gt;<br>
&gt; Mar 18 17:46:14 oss01 kernel: sd 1:0:0:0: [sdi] Result: hostbyte=DID_SOFT_ERROR driverbyte=DRIVER_OK<br>
&gt;<br>
&gt; Mar 18 17:46:14 oss01 kernel: sd 1:0:0:0: [sdi] CDB: Read(10): 28 00 00 06 d8 22 00 20 00 00<br>
&gt;<br>
&gt; Mar 18 17:46:14 oss01 multipathd: 8:128: mark as failed<br>
&gt;<br>
&gt; Mar 18 17:46:14 oss01 multipathd: 360080e500029eaec0000012656951fca: remaining active paths: 3<br>
&gt;<br>
&gt; Mar 18 17:46:14 oss01 multipathd: 8:192: mark as failed<br>
&gt;<br>
&gt; Mar 18 17:46:14 oss01 multipathd: 360080e500029eaec0000012656951fca: remaining active paths: 2<br>
&gt;<br>
&gt; Mar 18 17:46:14 oss01 multipathd: 8:0: mark as failed<br>
&gt;<br>
&gt; Mar 18 17:46:14 oss01 multipathd: 360080e500029eaec0000012656951fca: remaining active paths: 1<br>
&gt;<br>
&gt; Mar 18 17:46:14 oss01 multipathd: 8:64: mark as failed<br>
&gt;<br>
&gt; Mar 18 17:46:14 oss01 multipathd: 360080e500029eaec0000012656951fca: Entering recovery mode: max_retries=30<br>
&gt;<br>
&gt; Mar 18 17:46:14 oss01 multipathd: 360080e500029eaec0000012656951fca: remaining active paths: 0<br>
&gt;<br>
&gt; Mar 18 17:46:14 oss01 multipathd: 360080e500029eaec0000012656951fca: Entering recovery mode: max_retries=30<br>
&gt;<br>
&gt; Mar 18 17:46:19 oss01 multipathd: 360080e500029eaec0000012656951fca: sdi - rdac checker reports path is up<br>
&gt;<br>
&gt;<br>
&gt; Multipath configuration ( /etc/multipath.conf ) is below, and is correct according to the vendor (SGI).<br>
&gt;<br>
&gt;<br>
&gt; defaults {<br>
&gt;<br>
&gt;       user_friendly_names no<br>
&gt;<br>
&gt; }<br>
&gt;<br>
&gt;<br>
&gt; blacklist {<br>
&gt;<br>
&gt;       wwid &quot;*&quot;<br>
&gt;<br>
&gt; }<br>
&gt;<br>
&gt;<br>
&gt; blacklist_exceptions {<br>
&gt;<br>
&gt;       wwid &quot;360080e500029eaec0000012656951fca&quot;<br>
&gt;<br>
&gt;       wwid &quot;360080e500029eaec0000012956951fcb&quot;<br>
&gt;<br>
&gt;       wwid &quot;360080e500029eaec0000012c56951fcb&quot;<br>
&gt;<br>
&gt;       wwid &quot;360080e500029eaec0000012f56951fcb&quot;<br>
&gt;<br>
&gt; }<br>
&gt;<br>
&gt;<br>
&gt; devices {<br>
&gt;<br>
&gt;      device {<br>
&gt;<br>
&gt;        vendor                       &quot;SGI&quot;<br>
&gt;<br>
&gt;        product                      &quot;IS.*&quot;<br>
&gt;<br>
&gt;        product_blacklist            &quot;Universal Xport&quot;<br>
&gt;<br>
&gt;        getuid_callout               &quot;/lib/udev/scsi_id --whitelisted --device=/dev/%n&quot;<br>
&gt;<br>
&gt;        prio                         &quot;rdac&quot;<br>
&gt;<br>
&gt;        features                     &quot;2 pg_init_retries 50&quot;<br>
&gt;<br>
&gt;        hardware_handler             &quot;1 rdac&quot;<br>
&gt;<br>
&gt;        path_grouping_policy         &quot;group_by_prio&quot;<br>
&gt;<br>
&gt;        failback                     &quot;immediate&quot;<br>
&gt;<br>
&gt;        rr_weight                    &quot;uniform&quot;<br>
&gt;<br>
&gt;        no_path_retry                30<br>
&gt;<br>
&gt;        retain_attached_hw_handler   &quot;yes&quot;<br>
&gt;<br>
&gt;        detect_prio                  &quot;yes&quot;<br>
&gt;<br>
&gt;        #rr_min_io                   1000<br>
&gt;<br>
&gt;        path_checker                 &quot;rdac&quot;<br>
&gt;<br>
&gt;        #selector                    &quot;round-robin 0&quot;<br>
&gt;<br>
&gt;        #polling_interval            10<br>
&gt;<br>
&gt;      }<br>
&gt;<br>
&gt; }<br>
&gt;<br>
&gt;<br>
&gt;<br>
&gt; multipaths {<br>
&gt;<br>
&gt;       multipath {<br>
&gt;<br>
&gt;               wwid &quot;360080e500029eaec0000012656951fca&quot;<br>
&gt;<br>
&gt;       }<br>
&gt;<br>
&gt;       multipath {<br>
&gt;<br>
&gt;               wwid &quot;360080e500029eaec0000012956951fcb&quot;<br>
&gt;<br>
&gt;       }<br>
&gt;<br>
&gt;       multipath {<br>
&gt;<br>
&gt;               wwid &quot;360080e500029eaec0000012c56951fcb&quot;<br>
&gt;<br>
&gt;       }<br>
&gt;<br>
&gt;       multipath {<br>
&gt;<br>
&gt;               wwid &quot;360080e500029eaec0000012f56951fcb&quot;<br>
&gt;<br>
&gt;       }<br>
&gt;<br>
&gt; }<br>
&gt;<br>
&gt;<br>
&gt; Many many combinations of OST formating options were tried, internal and external journaling \u2026 But the same errors persist.<br>
&gt;<br>
&gt;<br>
&gt; The same bonnie++ tests were repeated on all volumes of the storage using only ext4, all successful.<br>
&gt;<br>
&gt;<br>
&gt; Regards,<br>
&gt;<br>
&gt; Angelo<br>
</div></div><div><div>&gt; _______________________________________________<br>
&gt; lustre-discuss mailing list<br>
&gt; <a href="mailto:lustre-discuss@lists.lustre.org" target="_blank">lustre-discuss@lists.lustre.org</a><br>
&gt; <a href="http://lists.lustre.org/listinfo.cgi/lustre-discuss-lustre.org" rel="noreferrer" target="_blank">http://lists.lustre.org/listinfo.cgi/lustre-discuss-lustre.org</a><br>
<br>
</div></div></blockquote></div><br></div></div>