using H=bool;using P=void;using Q=unsigned char;using ae=long double;using ai=unsigned;using aj=char;using as=long long;using at=__uint128_t;using ax=unsigned long long;using ay=__int128_t; #if defined(__GNUC__) && !defined(__clang__) #pragma GCC optimize("O3") #pragma GCC optimize("unroll-loops") #endif #define dump(...) #define CPP_DUMP_SET_OPTION(...) #define CPP_DUMP_DEFINE_EXPORT_OBJECT(...) #define CPP_DUMP_DEFINE_EXPORT_ENUM(...) #define CPP_DUMP_DEFINE_DANGEROUS_EXPORT_OBJECT(...) #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include #include templateusing F=std::vector; #include #include #include namespace aJ{namespace eL{namespace internal{templatestruct gZ:std::false_type{};templatestruct gZ())),decltype(std::end(std::declval()))>>:std::true_type{};templateinline constexpr H dR=gZ::value;templateusing ih=decltype(*std::begin(std::declval()));templateusing ir=std::remove_cv_t>>;templatestruct gu{using type=ir;};templatestruct gu>::value_type>>{using type=typename std::remove_cv_t>::value_type;};templateusing gq=typename gu::type;templatestruct gI:std::false_type{};templatestruct gI:std::bool_constant,aj>>{};templatestruct im:std::bool_constant,std::string>||std::is_same_v,const aj*>||std::is_same_v,aj*>||gI>::value>{};templateinline constexpr H eB=im::value;templatestruct gB:std::false_type{};templatestruct gB().val())>>:std::true_type{};templateinline constexpr H gx=gB::value;templatestruct gt:std::false_type{};templatestruct gt()))>>:std::true_type{};templateinline constexpr H hZ=gt::value;templateinline constexpr H eE=std::is_integral_v||std::is_same_v,ay>||std::is_same_v,at>;templateinline constexpr H fp=std::is_signed_v||std::is_same_v,ay>;templatestruct fk{using type=std::make_unsigned_t;};template<>struct fk{using type=at;};template<>struct fk{using type=at;};templateusing ij=typename fk>::type;}struct cQ{static constexpr int cb=1<<20;private:std::FILE*dv;aj aE[cb];int ac;int bi;int eA;H fq;H hl(){ac=0;if(fq){ssize_t cW;do{cW=::read(eA,aE,cb);}while(cW<0&&errno==EINTR);if(cW<=0){bi=0;return false;}bi=int(cW);}else{bi=int(std::fread(aE,1,cb,dv));}return bi!=0;}templateH hX(T&w){if(!eG())return false;int c=bo();H bA=false;if(c=='-'){bA=true;c=bo();}if constexpr(internal::fp){T C=0;while('0'<=c&&c<='9'){C=bA?C*10-(c-'0'):C*10+(c-'0');c=bo();}w=C;}else{T C=0;while('0'<=c&&c<='9'){C=C*10+T(c-'0');c=bo();}w=bA?T(0)-C:C;}return true;}H io(){if(bi-ac>=64)return true;const int ce=bi-ac;if(ce>0)std::memmove(aE,aE+ac,ce);const int iN=int(std::fread(aE+ce,1,cb-ce,dv));ac=0;bi=ce+iN;if(bi=0&&::fstat(eA,&hn)==0&&!S_ISREG(hn.st_mode);}()){}cQ(const cQ&)=delete;cQ&operator=(const cQ&)=delete;int bo(){if(ac==bi&&!hl())return EOF;return aE[ac++];}H eG(){int c=bo();while(c!=EOF&&c<=' ')c=bo();if(c==EOF)return false;--ac;return true;}H read(aj&w){if(!eG())return false;w=aj(bo());return true;}H read(std::string&w){if(!eG())return false;w.clear();while(true){const int begin=ac;while(ac(aE[ac])>' '){++ac;}w.append(aE+begin,ac-begin);if(acstd::enable_if_t&&!std::is_same_v,H>&&!std::is_same_v,aj>,H>read(T&w){if(fq)return hX(w);if(!io())return false;int c=static_cast(aE[ac++]);while(c<=' ')c=static_cast(aE[ac++]);H bA=false;if(c=='-'){bA=true;c=static_cast(aE[ac++]);}if constexpr(internal::fp){T C=0;while('0'<=c&&c<='9'){const int ag=c-'0';const int ak=static_cast(aE[ac])-'0';if(0<=ak&&ak<=9){C=bA?C*100-(ag*10+ak):C*100+(ag*10+ak);++ac;}else{C=bA?C*10-ag:C*10+ag;}c=static_cast(aE[ac++]);}w=C;}else{T C=0;while('0'<=c&&c<='9'){const ai ag=ai(c-'0');const int ak=static_cast(aE[ac])-'0';if(0<=ak&&ak<=9){C=C*100+T(ag*10+ai(ak));++ac;}else{C=C*10+T(ag);}c=static_cast(aE[ac++]);}w=bA?T(0)-C:C;}if(ac>bi)ac=bi;return true;}templatestd::enable_if_t,H>read(T&w){if(!eG())return false;int c=bo();H bA=false;if(c=='-'||c=='+'){bA=c=='-';c=bo();}ae C=0;while('0'<=c&&c<='9'){C=C*10+(c-'0');c=bo();}if(c=='.'){ae hq=0.1L;c=bo();while('0'<=c&&c<='9'){C+=(c-'0')*hq;hq*=0.1L;c=bo();}}if(c=='e'||c=='E'){c=bo();H gv=false;if(c=='-'||c=='+'){gv=c=='-';c=bo();}int au=0;while('0'<=c&&c<='9'){au=au*10+(c-'0');c=bo();}ae fN=1;ae bV=10;while(au>0){if(au&1)fN*=bV;bV*=bV;au>>=1;}C=gv?C/fN:C*fN;}w=static_cast(bA?-C:C);return true;}templatestd::enable_if_t&&!internal::eE&&!internal::dR,H>read(T&w){as x;if(!read(x))return false;if constexpr(internal::hZ){if(x>=0&&uint64_t(x)H read(std::pair&w){if(!read(w.first))return false;return read(w.second);}templatestd::enable_if_t&&!internal::eB,H>read(cF&fM){using dp=internal::gq;constexpr H eP=internal::dR&&!internal::eB;for(auto&&w:fM){if constexpr(std::is_same_v&&!eP){H x;if(!read(x))return false;w=x;}else{if(!read(w))return false;}}return true;}templateH read(dy&ag,ep&ak,fO&...rest){if(!read(ag))return false;return read(ak,rest...);}templatecQ&operator>>(T&w){if(!read(w))std::abort();return*this;}};struct cy{static constexpr int cb=1<<20;private:inline static const auto gQ=[]{std::arrayC{};for(int i=0;i<10000;i++){int w=i;for(int j=3;j>=0;j--){C[4*i+j]=aj('0'+w%10);w/=10;}}return C;}();std::FILE*dv;aj aE[cb];int ac;int ej;std::chars_format eD;aj fh;public:explicit cy(std::FILE*eR=stdout):dv(eR),ac(0),ej(6),eD(std::chars_format::general),fh(' '){}cy(const cy&)=delete;cy&operator=(const cy&)=delete;~cy(){eS();}P eS(){if(ac!=0){std::fwrite(aE,1,ac,dv);ac=0;}std::fflush(dv);}P cd(aj c){if(ac==cb)eS();aE[ac++]=c;}P bl(const aj*s){while(*s!='\0')cd(*s++);}P bl(const std::string&s){std::size_t cf=0;while(cf(cb-ac,s.size()-cf);std::memcpy(aE+ac,s.data()+cf,fD);ac+=int(fD);cf+=fD;}}P bl(aj c){cd(c);}P bl(H w){cd(w?'1':'0');}templatestd::enable_if_t>bl(T w){aj dU[128];auto[end,iP]=std::to_chars(dU,dU+sizeof(dU),w,eD,ej);if(iP!=std::errc())std::abort();for(const aj*fC=dU;fC!=end;fC++){cd(*fC);}}templatestd::enable_if_t&&!std::is_same_v,H>&&!std::is_same_v,aj> >bl(T w){using hv=std::remove_cv_t;using em=internal::ij;em bK;if constexpr(internal::fp){if(w<0){cd('-');bK=em(0)-em(w);}else{bK=em(w);}}else{bK=w;}if(bK==0){cd('0');return;}ai hi[16];int aV=0;while(bK>=10000){const em en=bK/10000;hi[aV++]=ai(bK-en*10000);bK=en;}if(ac>cb-64)eS();const ai eN=ai(bK);const aj*ag=gQ.data()+4*eN;int fV=eN<10?3:eN<100?2:eN<1000?1:0;for(;fV<4;fV++)aE[ac++]=ag[fV];while(aV--){const aj*dU=gQ.data()+4*hi[aV];std::memcpy(aE+ac,dU,4);ac+=4;}}templatestd::enable_if_t&&!internal::eE&&!internal::dR >bl(const T&w){bl(w.val());}templateP bl(const std::pair&w){bl(w.first);cd(' ');bl(w.second);}templatestd::enable_if_t&&!internal::eB >bl(const cF&fM){using dp=internal::gq;constexpr H eP=internal::dR&&!internal::eB;H ag=true;for(const auto&w:fM){if(!ag)cd(eP?'\n':fh);ag=false;if constexpr(std::is_same_v&&!eP){bl(static_cast(w));}else{bl(w);}}}templateP fK(const dy&ag,const fO&...rest){bl(ag);((cd(' '),bl(rest)),...);}P println(){cd('\n');}P jm(int el){ej=el;}P jp(int el=6){eD=std::chars_format::fixed;ej=el;}P jn(int el=6){eD=std::chars_format::general;ej=el;}P jk(aj iG){fh=iG;}templateP println(const Args&...args){fK(args...);cd('\n');}templatecy&operator<<(const T&w){bl(w);return*this;}};}}using namespace std;namespace aJ{namespace cp{inline eL::cQ&hp(){static eL::cQ fw;return fw;}inline eL::cy&cX(){static eL::cy fw;return fw;}}}using ll=as;using K=unsigned int;using bW=ax;using fR=__int128;using jI=unsigned __int128; #ifdef __SIZEOF_FLOAT128__ using jH=__float128; #endif templateconstexpr T bk=0;template<>constexpr int bk =1'000'000'000;template<>constexpr ll bk =ll(bk)*bk*2;template<>constexpr K bk =bk;template<>constexpr bW bk =bk;template<>constexpr fR bk =fR(bk)*bk;template<>constexpr double bk =bk;template<>constexpr ae bk =bk;using pi=pair;using pl=pair;using vi=vector;using vl=vector;templateusing vc=vector;templateusing gd=vector>;using jP=gd;using jQ=gd;templateusing iT=vector>;templateusing iS=vector>;templateusing jA=vector>;templateusing jO=std::priority_queue,greater>;templateusing jJ=unordered_map; #define vv(type, name, h, ...) vector> name(h, vector(__VA_ARGS__)) #define vvv(type, name, h, w, ...) vector>> name(h, vector>(w, vector(__VA_ARGS__))) #define vvvv(type, name, a, b, c, ...) vector>>> name( a, vector>>(b, vector>(c, vector(__VA_ARGS__)))) #define overload4(a, b, c, d, e, ...) e #define overload3(a, b, c, d, ...) d #define FOR1(a) for (ll _ = 0; _ < (ll)a; ++_) #define FOR2(i, a) for (ll i = 0; i < (ll)a; ++i) #define FOR3(i, a, b) for (ll i = a; i < (ll)b; ++i) #define FOR4(i, a, b, c) for (ll i = a; i < (ll)b; i += (c)) #define FOR1_R(a) for (ll i = (a) - 1; i >= 0; --i) #define FOR2_R(i, a) for (ll i = (a) - 1; i >= 0; --i) #define FOR3_R(i, a, b) for (ll i = (b) - 1; i >= (ll)a; --i) #define FOR(...) overload4(__VA_ARGS__, FOR4, FOR3, FOR2, FOR1)(__VA_ARGS__) #define FOR_R(...) overload3(__VA_ARGS__, FOR3_R, FOR2_R, FOR1_R)(__VA_ARGS__) #define FORI1(a) for (int _ = 0; _ < (int)a; ++_) #define FORI2(i, a) for (int i = 0; i < (int)a; ++i) #define FORI3(i, a, b) for (int i = a; i < (int)b; ++i) #define FORI4(i, a, b, c) for (int i = a; i < (int)b; i += (c)) #define FORI1_R(a) for (int i = (a) - 1; i >= 0; --i) #define FORI2_R(i, a) for (int i = (a) - 1; i >= 0; --i) #define FORI3_R(i, a, b) for (int i = (b) - 1; i >= (int)a; --i) #define FORI(...) overload4(__VA_ARGS__, FORI4, FORI3, FORI2, FORI1)(__VA_ARGS__) #define FORI_R(...) overload3(__VA_ARGS__, FORI3_R, FORI2_R, FORI1_R)(__VA_ARGS__) #define FOR_subset(t, s) for (int t = (s); t >= 0; t = (t == 0 ? -1 : (t - 1) & (s))) #define all(x) x.begin(), x.end() #define rall(x) x.rbegin(), x.rend() int fG(int x){return __builtin_popcount(x);}int fG(K x){return __builtin_popcount(x);}int fG(ll x){return __builtin_popcountll(x);}int fG(bW x){return __builtin_popcountll(x);}int fn(int x){return __builtin_parity(x);}int fn(K x){return __builtin_parity(x);}int fn(ll x){return __builtin_parityll(x);}int fn(bW x){return __builtin_parityll(x);}int fH(int x){return(x==0?-1:31-__builtin_clz(x));}int fH(K x){return(x==0?-1:31-__builtin_clz(x));}int fH(ll x){return(x==0?-1:63-__builtin_clzll(x));}int fH(bW x){return(x==0?-1:63-__builtin_clzll(x));}int fF(int x){return(x==0?-1:__builtin_ctz(x));}int fF(K x){return(x==0?-1:__builtin_ctz(x));}int fF(ll x){return(x==0?-1:__builtin_ctzll(x));}int fF(bW x){return(x==0?-1:__builtin_ctzll(x));}templateT fJ(T a,T b){return a/b-(a%b&&(a^b)<0);}templateT jF(T x,T y){return fJ(x+y-1,y);}templateT jE(T x,T y){return x-y*fJ(x,y);}templatepairjx(T x,T y){T q=fJ(x,y);return{q,x-q*y};}templateT jK(U x_,int n){T x=x_;T hE=1;while(n>0){if(n&1)hE*=x;x*=x;n>>=1;}return hE;}templateT jL(const vector&A){T sm=0;for(auto&&a:A)sm+=a;return sm;} #define LB(c, x) distance((c).begin(), lower_bound(all(c), (x))) #define UB(c, x) distance((c).begin(), upper_bound(all(c), (x))) #define UNIQUE(x) sort(all(x)), x.erase(unique(all(x)), x.end()), x.shrink_to_fit() templateinline H jD(T&a,const S&b){return(ainline H iO(T&a,const S&b){return(a>b?a=b,1:0);}vcju(const string&S,aj iA){vcA(S.size());FOR(i,S.size()){A[i]=(S[i]!='?'?S[i]-iA:-1);}return A;}templatevectorjw(vector&A,int iY=1){int N=A.size();vectorB(N+1);FOR(i,N){B[i+1]=B[i]+A[i];}if(iY==0)B.erase(B.begin());return B;}templatevectorjr(const vector&A){vectorfX(A.size());iota(all(fX),0);sort(all(fX),[&](int i,int j){return(A[i]==A[j]?ivcjo(const vc&A,const vc&I){vcB(I.size());FOR(i,I.size())B[i]=A[I[i]];return B;}templateconstexpr auto iW(T...a){return iW(initializer_list>{a...});}templateconstexpr auto iV(T...a){return iV(initializer_list>{a...});}templateH fU(Ts&...aC){return aJ::cp::hp().read(aC...);}templateP fK(const Ts&...aC){aJ::cp::cX().println(aC...);}P jB(H b){aJ::cp::cX().println(b?"YES":"NO");}P jC(H b){aJ::cp::cX().println(b?"Yes":"No");}P jM(){aJ::cp::cX().println("YES");}P NO(){aJ::cp::cX().println("NO");}P jN(){aJ::cp::cX().println("Yes");}P No(){aJ::cp::cX().println("No");}auto&jy=aJ::cp::hp();auto&js=aJ::cp::cX();namespace aJ{namespace ck{templatestruct R{static_assert(0,int> =0>constexpr R(du v)noexcept{if constexpr(std::is_signed_v){int64_t x=static_cast(v)%static_cast(bh);if(x<0)x+=bh;J=static_cast(x);}else{J=static_cast(static_cast(v)%bh);}}constexpr uint32_t val()const noexcept{return J;}constexpr R&operator++()noexcept{J++;if(J==bh)J=0;return*this;}constexpr R&operator--()noexcept{if(J==0)J=bh;J--;return*this;}constexpr R operator++(int)noexcept{R eb=*this;++*this;return eb;}constexpr R operator--(int)noexcept{R eb=*this;--*this;return eb;}constexpr R&operator+=(const R&O)noexcept{J+=O.J;if(J>=bh)J-=bh;return*this;}constexpr R&operator-=(const R&O)noexcept{J-=O.J;if(J>=bh)J+=bh;return*this;}constexpr R&operator*=(const R&O)noexcept{uint64_t z=J;z*=O.J;J=static_cast(z%bh);return*this;}constexpr R&operator/=(const R&O)noexcept{return*this*=O.inv();}constexpr R operator+(const R&O)const noexcept{return R(*this)+=O;}constexpr R operator-(const R&O)const noexcept{return R(*this)-=O;}constexpr R operator*(const R&O)const noexcept{return R(*this)*=O;}constexpr R operator/(const R&O)const noexcept{return R(*this)/=O;}constexpr H operator==(const R&O)const noexcept{return J==O.J;}constexpr H operator!=(const R&O)const noexcept{return J!=O.J;}constexpr R pow(as n)const noexcept{R eb=cu(1%bh);R x=n<0?inv():*this;uint64_t au=n<0?uint64_t(-(n+1))+1:uint64_t(n);while(au>0){if(au&1)eb*=x;x*=x;au>>=1;}return eb;}constexpr R inv()const noexcept{int64_t a=J,b=bh,u=1,v=0;while(b){int64_t t=a/b;a-=t*b;std::swap(a,b);u-=t*v;std::swap(u,v);}assert(a==1);u%=bh;if(u<0)u+=bh;return cu(static_cast(u));}friend std::ostream&operator<<(std::ostream&os,const R&O){return os<>(std::istream&is,R&O){as v;is>>v;O=R(v);return is;}};using ik=R<998244353>;using jl=R<1000000007>;templatestruct ah{private:uint32_t J;inline static uint32_t ba=1;public:static uint32_t o()noexcept{return ba;}static P jv(uint32_t cD)noexcept{assert(cD>0);assert(cD<=uint32_t(1)<<31);ba=cD;}static ah cu(uint32_t v)noexcept{assert(v,int> =0>ah(du v)noexcept{if constexpr(std::is_signed_v){int64_t x=static_cast(v)%static_cast(ba);if(x<0)x+=ba;J=static_cast(x);}else{J=static_cast(static_cast(v)%ba);}}uint32_t val()const noexcept{return J;}ah&operator++()noexcept{J++;if(J==ba)J=0;return*this;}ah&operator--()noexcept{if(J==0)J=ba;J--;return*this;}ah operator++(int)noexcept{ah C=*this;++*this;return C;}ah operator--(int)noexcept{ah C=*this;--*this;return C;}ah&operator+=(const ah&O)noexcept{J+=O.J;if(J>=ba)J-=ba;return*this;}ah&operator-=(const ah&O)noexcept{J-=O.J;if(J>=ba)J+=ba;return*this;}ah&operator*=(const ah&O)noexcept{J=static_cast(uint64_t(J)*O.J%ba);return*this;}ah&operator/=(const ah&O)noexcept{return*this*=O.inv();}ah operator+(const ah&O)const noexcept{return ah(*this)+=O;}ah operator-(const ah&O)const noexcept{return ah(*this)-=O;}ah operator*(const ah&O)const noexcept{return ah(*this)*=O;}ah operator/(const ah&O)const noexcept{return ah(*this)/=O;}H operator==(const ah&O)const noexcept{return J==O.J;}H operator!=(const ah&O)const noexcept{return J!=O.J;}ah pow(as au)const noexcept{ah C=cu(1%ba);ah aW=au<0?inv():*this;uint64_t bK=au<0?uint64_t(-(au+1))+1:uint64_t(au);while(bK>0){if(bK&1)C*=aW;aW*=aW;bK>>=1;}return C;}ah inv()const noexcept{int64_t a=J,b=ba,u=1,v=0;while(b){int64_t en=a/b;a-=en*b;std::swap(a,b);u-=en*v;std::swap(u,v);}assert(a==1);u%=ba;if(u<0)u+=ba;return cu(static_cast(u));}friend std::ostream&operator<<(std::ostream&os,const ah&O){return os<>(std::istream&is,ah&O){as w;is>>w;O=ah(w);return is;}};}} #if defined(__GNUC__) && !defined(__clang__) && (defined(__x86_64__) || defined(__i386__)) #include #define M1UNE_FPS_HAS_X86_SIMD 1 #pragma GCC push_options #pragma GCC target("avx2,bmi") #endif #ifdef M1UNE_FPS_HAS_X86_SIMD #include #include #include #include namespace aJ{namespace dD{namespace internal{namespace cz{using K=ai;using bW=ax;using aq=std::size_t;using D=__m256i;inline P af(P*p,D x){_mm256_store_si256((D*)p,x);}inline D W(const P*p){return _mm256_load_si256((const D*)p);}constexpr K dY(K x,K M){return std::min(x,x-M);}constexpr K jG(K x,K M){return std::min(x,x+M);}constexpr K dV(bW x,K E,K M){return(x+bW(K(x)*E)*M)>>32;}constexpr K bO(K x,K y,K E,K M){return dV(bW(x)*y,E,M);}constexpr K aK(K x,K y,K E,K M){return dY(dV(bW(x)*y,E,M),M);}constexpr K gb(K a,K b,K E,K M,K r){for(;b;b>>=1,a=bO(a,a,E,M)){if(b&1){r=bO(r,a,E,M);}}return r;}constexpr K hs(K a,K b,K E,K M,K r){return dY(gb(a,b,E,M,r),M);}inline D aO(D x,D M){return _mm256_min_epu32(x,_mm256_sub_epi32(x,M));}inline D iL(D x,D M){return _mm256_min_epu32(x,_mm256_add_epi32(x,M));}inline D cg(D x,D y,D){return _mm256_add_epi32(x,y);}inline D bj(D x,D y,D M){return _mm256_add_epi32(_mm256_sub_epi32(x,y),M);}inline D aI(D x,D y,D M){return aO(_mm256_add_epi32(x,y),M);}inline D bC(D x,D y,D M){return iL(_mm256_sub_epi32(x,y),M);}templateinline D jt(D x,D M){return _mm256_blend_epi32(x,_mm256_sub_epi32(M,x),iX);}inline D dV(D a,D b,D E,D M){D c=_mm256_mul_epu32(a,E),d=_mm256_mul_epu32(b,E);c=_mm256_mul_epu32(c,M),d=_mm256_mul_epu32(d,M);return _mm256_blend_epi32(_mm256_srli_epi64(_mm256_add_epi64(a,c),32),_mm256_add_epi64(b,d),0xaa);}inline D bO(D a,D b,D E,D M){return dV(_mm256_mul_epu32(a,b),_mm256_mul_epu32(_mm256_srli_epi64(a,32),_mm256_srli_epi64(b,32)),E,M);}inline D aK(D a,D b,D E,D M){return aO(bO(a,b,E,M),M);}inline D cU(D a,D b,D E,D M){return dV(_mm256_mul_epu32(a,b),_mm256_mul_epu32(_mm256_srli_epi64(a,32),b),E,M);}inline D bJ(D a,D b,D eq,D M){D cc=_mm256_mul_epu32(a,eq),dd=_mm256_mul_epu32(_mm256_srli_epi64(a,32),eq);D c=_mm256_mul_epu32(a,b),d=_mm256_mul_epu32(_mm256_srli_epi64(a,32),b);cc=_mm256_mul_epu32(cc,M),dd=_mm256_mul_epu32(dd,M);return _mm256_blend_epi32(_mm256_srli_epi64(_mm256_add_epi64(c,cc),32),_mm256_add_epi64(d,dd),0xaa);}inline D jq(D a,D b,D eq,D M){D cc=_mm256_mul_epu32(a,eq),dd=_mm256_mul_epu32(_mm256_srli_epi64(a,32),_mm256_srli_epi64(eq,32));D c=_mm256_mul_epu32(a,b),d=_mm256_mul_epu32(_mm256_srli_epi64(a,32),_mm256_srli_epi64(b,32));cc=_mm256_mul_epu32(cc,M),dd=_mm256_mul_epu32(dd,M);return _mm256_blend_epi32(_mm256_srli_epi64(_mm256_add_epi64(c,cc),32),_mm256_add_epi64(d,dd),0xaa);}inline D eI(D a,D bu,D M){D cc=_mm256_mul_epu32(a,bu),c=_mm256_mul_epu32(a,_mm256_srli_epi64(bu,32));cc=_mm256_mul_epu32(cc,M);return aO(_mm256_srli_epi64(_mm256_add_epi64(c,cc),32),M);}constexpr auto bU=26,dr=6;constexpr auto cY=aq(1)<eV[bU-2],eU[bU-2],fQ,fW,fP,eu[bU-3],hm[bU-3],es[bU-3],he[bU-3],fZ,ga,hj,hk,fS,hc,fT,hd;constexpr dn(const K m):o(m),cr(m*2),E([&]{K n=2+m;for(int i=0;i<4;++i){n*=2+m*n;}return n;}()),an((-m)%m),r2((-bW(m))%m),r3(aK(r2,r2,E,m)),ct{},eO{},dC{},eV{},eU{},fQ{},fW{},fP{},eu{},hm{},es{},he{},fZ{},ga{},hj{},hk{},fS{},hc{},fT{},hd{}{const int k=__builtin_ctz(m-1);K _g=bO(3,r2,E,o);for(;;++_g){if(hs(_g,o>>1,E,o,an)!=an){break;}}_g=gb(_g,o>>k,E,o,an);K bv[bU-1],bm[bU-1];bv[k-2]=_g,bm[k-2]=gb(_g,o-2,E,o,an);for(int i=k-2;i>0;--i){bv[i-1]=bO(bv[i],bv[i],E,o);bm[i-1]=bO(bm[i],bm[i],E,o);}dC[k-1]=hs(_g,3,E,o,an);for(int i=k-1;i>0;--i){dC[i-1]=aK(dC[i],dC[i],E,o);}ct=bv[0],eO=ct*E;fQ={an,0,an,0,an};fW={bv[1],0,bv[0],0,o-aK(bv[0],bv[1],E,o)};fP={bm[1],0,bm[0],0,aK(bm[0],bm[1],E,o)};K pr=an,dE=an;for(int i=0;ibt[bU>>1];const D ad=_mm256_set1_epi32(am->o),G=_mm256_set1_epi32(am->cr),bc=_mm256_set1_epi32(am->E);const D de=_mm256_set1_epi32(am->ct),cV=_mm256_set1_epi32(am->eO),id=_mm256_setr_epi32(0,2,0,4,0,2,0,4);const int dZ=__builtin_ctzll(n);std::fill(bt,bt+(dZ>>1),am->fW);const aq nn=n>>(dZ&1),m=std::min(n,cY),mm=std::min(nn,cY);if(nn!=n){for(aq i=0;i>2;L>0;L>>=2){for(aq i=0;i>1;for(aq L=(aq(1)<>2;L>=cY;L>>=2,t-=2,--p){auto rt=W(bt+p);const auto r1=_mm256_permutevar8x32_epi32(rt,id);const auto dz=_mm256_permutevar8x32_epi32(_mm256_mul_epu32(rt,bc),id);rt=eI(rt,W(am->eV+__builtin_ctzll(~j>>t)),ad);const auto r2=_mm256_shuffle_epi32(r1,_MM_PERM_BBBB),fY=_mm256_shuffle_epi32(r1,_MM_PERM_DDDD);const auto fL=_mm256_shuffle_epi32(dz,_MM_PERM_BBBB),iM=_mm256_shuffle_epi32(dz,_MM_PERM_DDDD);af(bt+p,rt);for(aq i=0;i>2;L;l=L,L>>=2,t-=2,--p){auto rt=W(bt+p);for(aq i=(j==0?l:0),k=(j+i)>>t;ieV+__builtin_ctzll(~k)),ad);}af(bt+p,rt);}}}templateinline P gU(D*const f,aq n,const dn*const am){alignas(32)std::arraybt[bU>>1];const D ad=_mm256_set1_epi32(am->o),G=_mm256_set1_epi32(am->cr),bc=_mm256_set1_epi32(am->E);const D de=_mm256_set1_epi32(am->ct),cV=_mm256_set1_epi32(am->eO),id=_mm256_setr_epi32(0,2,0,4,0,2,0,4);const int dZ=__builtin_ctzll(n);std::fill(bt,bt+(dr>>1),am->fQ);std::fill(bt+(dr>>1),bt+(bU>>1),am->fP);const aq nn=n>>(dZ&1),mm=std::min(nn,cY);for(aq j=0;j>t;ieU+__builtin_ctzll(~k)),ad);}af(bt+p,rt);}int tt=std::min(__builtin_ctzll(~(j>>dr))+dr,dZ);for(aq L=cY,l=L<<2;t<=tt;L=l,l<<=2,t+=2,++p){if((j+cY)==l){if(dY&&l==n){for(aq i=0;ieU+__builtin_ctzll(~j>>t)),ad);const auto r2=_mm256_shuffle_epi32(r1,_MM_PERM_BBBB),r3=_mm256_shuffle_epi32(r1,_MM_PERM_DDDD);const auto fL=_mm256_shuffle_epi32(dz,_MM_PERM_BBBB),iQ=_mm256_shuffle_epi32(dz,_MM_PERM_DDDD);af(bt+p,rt);for(aq i=0;ian;const auto o=am->o,E=am->E;const auto Fx=_mm256_set1_epi32(aK((o-((o-1)>>(__builtin_ctzll(lm)))),am->r3,E,o));const auto bc=_mm256_set1_epi32(E),ad=_mm256_set1_epi32(o),G=_mm256_set1_epi32(am->cr);for(aq i=0;idC[__builtin_ctzll(~i)],E,o);}}inline P hT(D*const C,const D*const f,const D*const g,aq lm,const dn*const am){K RR=am->an;const auto o=am->o,E=am->E;const auto Fx=_mm256_set1_epi32(aK((o-((o-1)>>(__builtin_ctzll(lm)))),am->r3,E,o));const auto bc=_mm256_set1_epi32(E),ad=_mm256_set1_epi32(o),G=_mm256_set1_epi32(am->cr);for(aq i=0;idC[__builtin_ctzll(~i)],E,o);}}}}}} #endif #ifdef M1UNE_FPS_HAS_X86_SIMD #pragma GCC pop_options #endif namespace aJ{namespace dD{namespace internal{templatestruct fg:std::false_type{};templatestruct fg{})>>:std::true_type{};constexpr uint32_t hW(uint32_t o){if(o==2)return 1;if(o==167772161)return 3;if(o==469762049)return 3;if(o==754974721)return 11;if(o==998244353)return 3;if(o==1224736769)return 3;uint32_t eM[32]={};int aV=0;uint32_t x=o-1;for(uint32_t p=2;uint64_t(p)*p<=x;p++){if(x%p!=0)continue;eM[aV++]=p;while(x%p==0)x/=p;}if(x>1)eM[aV++]=x;for(uint32_t g=2;;g++){H ok=true;for(int i=0;i0){if(au&1)w=w*aW%o;aW=aW*aW%o;au>>=1;}if(w==1){ok=false;break;}}if(ok)return g;}}constexpr int gD(uint32_t x){int C=0;while((x&1)==0){x>>=1;C++;}return C;}templatestruct fv{static constexpr int cB=gD(e::o()-1);std::arraycs;std::arraycN;std::arrayhu;std::arraygK;std::arraygT;std::arraygr;fv(){constexpr uint32_t fj=hW(e::o());for(int bB=1;bB<=cB;bB++){cs[bB]=e(fj).pow((e::o()-1)>>bB);cN[bB]=cs[bB].inv();}e bq=1;e ef=1;for(int i=0;i+1const fv&iF(){static const fvdc;return dc;}templateP dh(F&a,H iK,H iE=true){const int n=int(a.size());assert(n>0&&(n&(n-1))==0);assert((e::o()-1)%uint32_t(n)==0);const auto&dc=iF();const int ch=gD(uint32_t(n));if(!iK){int av=0;while(av0){if(av==1){const int aD=1<<(ch-av);e aZ=1;for(int V=0;V<(1<<(av-1));V++){const int ab=V<<(ch-av+1);for(int i=0;i__attribute__((target("avx2,bmi"),hot))FhU(const F&a,const F&b){const int bf=int(a.size()+b.size()-1);int n=1;while(n(::operator new[](sizeof(uint32_t)*n,std::align_val_t(32)));auto*co=cT?bI:static_cast(::operator new[](sizeof(uint32_t)*n,std::align_val_t(32)));if constexpr(std::is_same_v>){static_assert(sizeof(e)==sizeof(uint32_t)&&std::is_trivially_copyable_v);std::memcpy(bI,a.data(),sizeof(uint32_t)*a.size());if(!cT)std::memcpy(co,b.data(),sizeof(uint32_t)*b.size());}else{for(int i=0;i>3;cz::fu(reinterpret_cast<__m256i*>(bI),cO,&cR);if(!cT)cz::fu(reinterpret_cast<__m256i*>(co),cO,&cR);cz::hV(reinterpret_cast<__m256i*>(bI),reinterpret_cast(co),cO,&cR);cz::gU(reinterpret_cast<__m256i*>(bI),cO,&cR);FC(bf);for(int j=0;jFic(const F&a,const F&b){if(a.empty()||b.empty())return{};FC(a.size()+b.size()-1);if(a.size()Fgy(const F&a,const F&b){const int bf=int(a.size()+b.size()-1);int n=1;while(n=64&&__builtin_cpu_supports("avx2"))return internal::hU(a,b);} #endif const H cT=&a==&b;Ffa(n);std::copy(a.begin(),a.end(),fa.begin());internal::dh(fa,false);const e eK=e(n).inv();if(cT){for(int i=0;ifb(n);std::copy(b.begin(),b.end(),fb.begin());internal::dh(fb,false);for(int i=0;iFhQ(const F&a,const F&b,int ao){assert(e::o()==998244353);assert(ao>=2&&(ao&(ao-1))==0);assert((e::o()-1)%uint32_t(ao)==0);const int bp=ao/2;const int ds=int((a.size()+bp-1)/bp);const int dt=int((b.size()+bp-1)/bp);auto ee=[&](const F&aC,int ei){F>dx;dx.reserve(ei);for(int V=0;Vcx(ao);std::copy_n(aC.begin()+begin,aV,cx.begin());dh(cx,false);dx.emplace_back(std::move(cx));}return dx;};F>bI=ee(a,ds);F>co=ee(b,dt);const int bf=int(a.size()+b.size()-1);FC(bf);Fbz(ao);for(int bL=0;bL(::operator new[](sizeof(uint32_t)*cl,std::align_val_t(32)))){}bn(const bn&)=delete;bn&operator=(const bn&)=delete;bn(bn&&dX)noexcept:cj(dX.cj){dX.cj=nullptr;}bn&operator=(bn&&dX)noexcept{if(this==&dX)return*this;::operator delete[](cj,std::align_val_t(32));cj=dX.cj;dX.cj=nullptr;return*this;}~bn(){::operator delete[](cj,std::align_val_t(32));}uint32_t*data(){return cj;}const uint32_t*data()const{return cj;}};template__attribute__((target("avx2,bmi"),hot))FhR(const F&a,const F&b,int ao){assert(e::o()==998244353);assert(ao>=64&&(ao&(ao-1))==0);assert((e::o()-1)%uint32_t(ao)==0);const int bp=ao/2;const int ds=int((a.size()+bp-1)/bp);const int dt=int((b.size()+bp-1)/bp);static constexpr cz::dn cR(998244353);const std::size_t cO=std::size_t(ao)/8;auto ee=[&](const F&aC,int ei){Fdx;dx.reserve(ei);for(int V=0;V>){static_assert(sizeof(e)==sizeof(uint32_t)&&std::is_trivially_copyable_v);std::memcpy(cx.data(),aC.data()+begin,sizeof(uint32_t)*aV);}else{for(int i=0;i(cx.data()),cO,&cR);dx.emplace_back(std::move(cx));}return dx;};FbI=ee(a,ds);Fco=ee(b,dt);const int bf=int(a.size()+b.size()-1);FC(bf);bn bz(ao);for(int bL=0;bL(bz.data()),reinterpret_cast(bI[cC].data()),reinterpret_cast(co[fA].data()),cO,&cR);}cz::gU(reinterpret_cast<__m256i*>(bz.data()),cO,&cR);const int dQ=bL*bp;const int fm=std::min(ao,bf-dQ);for(int i=0;i=e::o())w-=e::o();C[dQ+i]=e::cu(w);}}return C;} #endif templateFhS(const F&a,const F&b,int ao=1<<23){ #ifdef M1UNE_FPS_HAS_X86_SIMD if(ao>=64&&__builtin_cpu_supports("avx2"))return hR(a,b,ao); #endif return hQ(a,b,ao);}}templateFgP(const F&a,const F&b){if(a.empty()||b.empty())return{};if(std::min(a.size(),b.size())<=32)return ic(a,b);const int bf=int(a.size()+b.size()-1);int n=1;while(n::value){if constexpr(e::o()==998244353){if(n>(1<<23))return internal::hS(a,b);}if((e::o()-1)%uint32_t(n)==0)return gy(a,b);}using dW=ck::R<167772161>;using cq=ck::R<469762049>;using bM=ck::R<754974721>;assert(n<=(1<<24));[[maybe_unused]]const unsigned __int128 ib=static_cast(std::min(a.size(),b.size()))*(e::o()-1)*(e::o()-1);[[maybe_unused]]const unsigned __int128 ix=static_cast(dW::o())*cq::o()*bM::o();assert(ib(){FgN(a.size());FgO(b.size());for(int i=0;ic1=eZ.template operator()();Fc2=eZ.template operator()();Fc3=eZ.template operator()();static const uint64_t ig=cq(dW::o()).inv().val();static const uint64_t gX=dW::o()%bM::o();static const uint64_t in=gX*(cq::o()%bM::o())%bM::o();static const uint64_t hY=bM(uint32_t(in)).inv().val();const uint64_t cP=e::o();const uint64_t gR=dW::o()%cP;const uint64_t ii=gR*(cq::o()%cP)%cP;FC(bf);for(int i=0;i(static_cast(a)*b%o);}inline uint64_t gY(uint64_t aW,uint64_t au,uint64_t o){uint64_t C=1;while(au>0){if(au&1)C=eh(C,aW,o);aW=eh(aW,aW,o);au>>=1;}return C;}inline uint64_t gC(){static uint64_t ht=0x123456789abcdef0ULL;ht+=0x9e3779b97f4a7c15ULL;uint64_t w=ht;w=(w^(w>>30))*0xbf58476d1ce4e5b9ULL;w=(w^(w>>27))*0x94d049bb133111ebULL;return w^(w>>31);}}inline H iI(uint64_t w){if(w<2)return false;for(uint64_t db:{2ULL,3ULL,5ULL,7ULL,11ULL,13ULL,17ULL,19ULL,23ULL,29ULL,31ULL,37ULL}){if(w%db==0)return w==db;}uint64_t cS=w-1;int gL=0;while((cS&1)==0){cS>>=1;gL++;}for(uint64_t aW:{2ULL,325ULL,9375ULL,28178ULL,450775ULL,9780504ULL,1795265022ULL}){if(aW%w==0)continue;uint64_t x=internal::gY(aW%w,cS,w);if(x==1||x==w-1)continue;H gV=true;for(int i=1;i((static_cast(eh(ha,ha,w))+iH)%w);};while(dg==1){x=y;for(uint64_t i=0;i(128,eC-ab);for(uint64_t i=0;iy?x-y:y-x;bq=eh(bq,fs,w);}dg=std::gcd(bq,w);}eC<<=1;}if(dg==w){do{dT=fz(dT);const uint64_t fs=x>dT?x-dT:dT-x;dg=std::gcd(fs,w);}while(dg==1);}if(dg!=w)return dg;}}inline P ff(uint64_t w,F&dw){if(w==1)return;if(iI(w)){dw.push_back(w);return;}const uint64_t hb=iz(w);ff(hb,dw);ff(w/hb,dw);}}inline Fiq(uint64_t w){assert(w>=1);FC;internal::ff(w,C);std::sort(C.begin(),C.end());return C;}inline F>eg(uint64_t w){Fdw=iq(w);F>C;for(uint64_t db:dw){if(C.empty()||C.back().first!=db){C.emplace_back(db,1);}else{C.back().second++;}}return C;}inline FeM(uint64_t w){FC={1};for(const auto&cE:eg(w)){const int it=int(C.size());uint64_t bV=1;for(int au=1;au<=cE.second;au++){bV*=cE.first;for(int i=0;i=1);uint64_t C=w;for(const auto&cE:eg(w)){C=C/cE.first*(cE.first-1);}return C;}inline int jz(uint64_t w){assert(w>=1);int C=1;for(const auto&cE:eg(w)){if(cE.second>=2)return 0;C=-C;}return C;}}}namespace aJ{namespace ck{inline H ia(uint64_t o){if(o==2||o==4)return true;if(o<2)return false;uint64_t cS=o;if((cS&1)==0){cS>>=1;if((cS&1)==0)return false;}return eg(cS).size()==1;}inline uint64_t fj(uint64_t o){assert(o>=2);if(o==2)return 1;if(!ia(o))return 0;const uint64_t hC=iC(o);const F>dw=eg(hC);for(uint64_t ek=2;ekstruct by{using dq=T;static constexpr int cZ=0;};templatestruct by>{using dq=typename by::dq;static constexpr int cZ=by::cZ+1;};templateP fe(const al&aC,F&aQ){if constexpr(by::cZ>0){assert(!aC.empty());assert(aC.size()<=std::size_t(std::numeric_limits::max()));aQ.push_back(int(aC.size()));fe(aC.front(),aQ);}}templateP fc(const al&aC,const F&aQ,int bB,F&cA){if constexpr(by::cZ==0){cA.push_back(aC);}else{assert(bBP gp(al&aC,const F&aQ,int bB,const F&cA,int&cf){if constexpr(by::cZ==0){assert(cfFgn(const al&ag,const al&ak,F::dq>&dm,F::dq>&dl){FaQ;fe(ag,aQ);assert(int(aQ.size())==by::cZ);FgM;fe(ak,gM);assert(gM==aQ);fc(ag,aQ,0,dm);fc(ak,aQ,0,dl);std::reverse(aQ.begin(),aQ.end());return aQ;}templateal go(Fap,const F::dq>&cA){std::reverse(ap.begin(),ap.end());al C;int cf=0;gp(C,ap,0,cA,cf);assert(cf==int(cA.size()));return C;}inline int ed(const F&ap){int64_t aV=1;for(int aB:ap){assert(aB>0);aV*=aB;assert(aV<=std::numeric_limits::max());}return int(aV);}inline Fgs(const F&ap){const int aF=int(ap.size());const int ar=ed(ap);Fci(ar);if(aF==0)return ci;for(int bN=0;bNFfd(const F&ft,e ratio){const int cl=int(ft.size());if(cl<=64){FC(cl);e hr=1;for(int i=0;iC(cW);if(cW==0)return C;C[0]=1;e bV=1;for(int i=0;i+1iJ=gw(ratio,2*cl-1);FbA=gw(ratio.inv(),cl);FeQ(ft);for(int i=0;ibq=dD::gP(eQ,iJ);FC(cl);for(int i=0;iFhP(const F&ap,const F&ag,const F&ak){const int aF=int(ap.size());const int ar=ed(ap);assert(int(ag.size())==ar);assert(int(ak.size())==ar);if(aF==0)return{ag[0]*ak[0]};const Fci=gs(ap);F>gG(aF,F(ar));F>gA(aF,F(ar));for(int i=0;i>gz(aF,F(ar));for(int bs=0;bsbq=dD::gP(gG[bs],gA[br]);F&fo=gz[(bs+br)%aF];for(int i=0;iC(ar);for(int i=0;iFgm(const F&ap,const F&ag,const F&ak){static_assert(dD::internal::fg::value,"truncated multivariate convolution requires a static-modulus type");const int aF=int(ap.size());const int ar=internal::ed(ap);assert(int(ag.size())==ar);assert(int(ak.size())==ar);if(aF==0)return{ag[0]*ak[0]};int64_t ez=1;while(ez<2LL*ar-1)ez<<=1;assert(ez<=std::numeric_limits::max());const int ao=int(ez);assert((e::o()-1)%uint32_t(ao)==0);const Fci=internal::gs(ap);F>ca(aF,F(ao));F>dk(aF,F(ao));for(int i=0;i>bz(aF,F(ao));for(int bs=0;bs&fo=bz[(bs+br)%aF];const F&iy=ca[bs];const F&iv=dk[br];for(int i=0;iC(ar);for(int i=0;i::cZ>0),int> =0>al gm(const al&ag,const al&ak){using e=typename internal::by::dq;Fdm,dl;Fap=internal::gn(ag,ak,dm,dl);Ffi=gm(ap,dm,dl);return internal::go(std::move(ap),fi);}templateFey(const F&ap,const F&ag,const F&ak){const int ar=internal::ed(ap);assert(int(ag.size())==ar);assert(int(ak.size())==ar);if(ap.empty())return{ag[0]*ak[0]};const uint32_t cD=e::o();H gH=true;for(int aB:ap){if((cD-1)%uint32_t(aB)!=0)gH=false;}if(!gH){FbZ;for(int aB:ap){if(aB!=1)bZ.push_back(aB);}if(bZ.empty())return{ag[0]*ak[0]};FdP(bZ.size());for(int i=0;i::max());dP[i]=int(hf);}const int fl=internal::ed(dP);FgJ(fl);FgE(fl);for(int bN=0;bNil=internal::hP(dP,gJ,gE);FC(ar);for(int cM=0;cMca(ag);Fdk(ak);int aP=1;for(int aB:ap){assert((cD-1)%uint32_t(aB)==0);const e cs=e(dS).pow((cD-1)/aB);for(int V=0;VeH(aB);FeF(aB);for(int i=0;ieT(aB);for(int i=0;i::cZ>0),int> =0>al ey(const al&ag,const al&ak){using e=typename internal::by::dq;Fdm,dl;Fap=internal::gn(ag,ak,dm,dl);Ffi=ey(ap,dm,dl);return internal::go(std::move(ap),fi);}}}using er=aJ::ck::ik;P iR(){ll X,Y,Z;fU(X,Y,Z);vv(string,A,Z,Y);vv(string,B,Z,Y);FOR(z,Z)FOR(y,Y){fU(A[z][y]);}FOR(z,Z)FOR(y,Y){fU(B[z][y]);}vvv(er,A_black,Z,Y,X,0);vvv(er,A_white,Z,Y,X,0);vvv(er,inv_B_black,Z,Y,X,0);vvv(er,inv_B_white,Z,Y,X,0);FOR(z,Z)FOR(y,Y)FOR(x,X){if(A[z][y][x]=='B'){A_black[z][y][x]=1;}if(A[z][y][x]=='W'){A_white[z][y][x]=1;}}FOR(z,Z)FOR(y,Y)FOR(x,X){if(B[z][y][x]=='B'){inv_B_black[Z-z-1][Y-y-1][X-x-1]=1;}if(B[z][y][x]=='W'){inv_B_white[Z-z-1][Y-y-1][X-x-1]=1;}}auto C1=aJ::ck::ey(A_black,inv_B_white);auto C2=aJ::ck::ey(A_white,inv_B_black);ll hw=bk;FOR(z,Z)FOR(y,Y)FOR(x,X){er c=C1[z][y][x]+C2[z][y][x];iO(hw,c.val());}fK(hw);}int main(){CPP_DUMP_SET_OPTION(max_line_width,80);CPP_DUMP_SET_OPTION(log_label_func,cpp_dump::log_label::filename());CPP_DUMP_SET_OPTION(enable_asterisk,true);int T=1;while(T--)iR();return 0;}