Bitget App
Mag-trade nang mas matalino
Buy cryptoMarketsTradeFuturesStocksEarnInstitusyonAI & More
Nebius(NBIS.US) bumili ng Israeli na startup na Inferize upang palakasin ang AI inference business, maaaring umabot sa $150 milyon ang halaga ng transaksiyon

Nebius(NBIS.US) bumili ng Israeli na startup na Inferize upang palakasin ang AI inference business, maaaring umabot sa $150 milyon ang halaga ng transaksiyon

智通财经智通财经2026/10/01 15:11
Ipakita ang orihinal
By:智通财经

Inanunsyo ng AI cloud infrastructure service provider na Nebius ang pagkuha sa Israeli AI startup na Inferize, upang higit pang palakasin ang kanilang kakayahan sa AI inference infrastructure.

Napag-alaman mula sa APP ng Pinansyal na Balita na si Zhihui, na ang AI cloud infrastructure service provider na Nebius (NBIS.US) ay inanunsyo ang pag-aakuisisyon sa Israeli AI startup na Inferize, upang higit pang palakasin ang kakayahan nito sa AI inference infrastructure. Nakatuon ang Inferize sa pagbabawas ng idle time ng graphics processing unit (GPU) at pagpapabilis ng deployment ng malalaking AI model. Ayon sa ulat ng Israeli technology media na Calcalist, tinatayang nasa pagitan ng $100 milyon hanggang $150 milyon ang halaga ng transaksiyon, ngunit hindi ibinunyag ng Nebius ang tiyak na detalye ng pananalapi.

Ang sentro ng pag-aakuisisyong ito ay ang pagpapataas ng efficiency ng paggamit ng GPU resources, lalo na sa mabilis na pagbabago ng demand para sa AI inference, upang matulungan ang Nebius na mas mabilis magdala ng compute resources at mabawasan ang idle time ng mamahaling computing equipment.

Nakatutok sa Bottleneck ng AI Inference Efficiency Pababa ng Idle Time ng GPU

Ang pangunahing teknolohiya ng Inferize ay sumosolusyon sa "cold start" problem na nararanasan sa proseso ng deployment ng AI model. Ang cold start ay tumutukoy sa proseso kung saan kailangang i-load ang modelo at i-initialize ang kaugnay na resources bago magsimulang tumanggap ng requests mula sa users ang AI model. Kapag may bagong inference instance na sinimulan, maaaring kailangang maghintay ang GPU hanggang sa matapos ma-load ang model bago magsimulang mag-compute, at lumilitaw dito ang panandaliang pagka-idle ng resources.

Lalo itong nagiging kapansin-pansin kapag biglang tumaas ang demand para sa AI inference. Habang dumarami ang user requests, kailangang mabilis na maglunsad ng karagdagang inference instance ang mga cloud provider. Ngunit kung matagal ang model loading, hindi agarang magagamit ang bagong GPU resources, na makaaapekto sa bilis ng serbisyo at overall compute efficiency.

Nilalayon ng teknolohiya ng Inferize na paikliin itong waiting period upang agad magamit ang bagong inference resources at gawing akma sa real-time demand change ang expansion ng computing power.

Para sa Nebius, nangangahulugan ito na may pag-asang mas magiging flexible ang pagtugon ng kumpanya sa pangangailangan ng customers nang hindi kinakailangang magpanatili ng maraming idling GPU bilang backup, kaya mas mataas ang utilization efficiency ng kasalukuyang infrastructure.

Ayon kay Danila Shtan, Chief Technology Officer ng Nebius, upang maging efficient ang pagtakbo ng AI inference services, hindi lamang kailangan ng mas mabilis na GPU at mga optimized na model, kundi maging ang buong sistema ay dapat marunong tumugon agad sa pagbabago ng demand, kabilang ang mabilis na pagdagdag ng computation capacity kapag dumarami ang customer requests. Binanggit niya na bukod sa teknolohiyang magpapabilis sa prosesong ito, may karanasan din ang Inferize engineering team sa GPU systems.

Plano ng Nebius na isama ang mga engineer ng Inferize sa sarili nitong inference business team at i-integrate ang kaugnay na teknolohiya sa mismong AI inference platform nitong Token Factory, upang mapalakas pa ang abilidad ng platform na tumugon sa customer demand at mapataas ang kakayahan ng infrastructure sa mas maraming tunay na computing workload.

Idinagdag ni Shtan na ang kontribusyon ng Inferize team ay hindi limitado lamang sa panimulang integration ng teknolohiya na ito.

Pababa ng Gastos ng Backup Compute Power Pataas ng Operasyonal na Efficiency ng AI Infrastructure

Ayon kay Guy Bortnikov, Co-founder at CEO ng Inferize, upang laging makapagtugon sa customer demand, karaniwan nang kailangang magpanatili ang cloud provider ng isang tiyak na bilang ng backup GPU resources, at ang mga naka-standby na ito ay nagreresulta rin sa dagdag na gastos. Sinabi niyang ang layunin ng pagtatatag ng Inferize ay upang bawasan ang cost na ito, at sa pagpasok sa Nebius ay agad na maipapatupad ang nasabing teknolohiya sa aktwal na pagpapatakbo ng AI cloud platform.

Sa AI inference business, ang efficiency ng pag-schedule ng compute resources ay tuwirang nakaaapekto sa operation costs ng infrastructure. Dahil mahal ang GPU devices, kung kinakailangang magpanatili ng malaking volume ng idle computing resources para lang masiguradong handa sa demand peaks, maaaring bumaba ang overall returns on investment.

Sa pamamagitan ng pagpapabilis ng model boot time at mas mabilis na pagpasok ng compute power sa operasyon, may potensiyal ang Nebius na mas mapalawak ang serbisyo nang hindi na umaasa nang husto sa backup GPU capacity.

Karapat-dapat ding banggitin na si Bortnikov ay nag-cofound din ng computation infrastructure optimization software company na Granulate. Pangunahing layunin ng kumpanyang ito ang mag-develop ng mga teknolohiya na nagpapataas ng resource running efficiency at na-acquire ng Intel (INTC.US) noong 2022. Ipinapakita ng background na ito na may sapat na karanasan ang team ng Inferize sa larangan ng computation infrastructure optimization.

Sunod-sunod na Pagbili ng AI Technology Companies Patuloy na Pinapalakas ng Nebius ang Inference Platform

Ang acquisition ng Inferize ay isa lamang sa sunod-sunod na serye ng mga acquisition ni Nebius na nakatuon sa AI inference at model optimization. Nauna rito, natapos na ng Nebius ang pagbili ng Eigen AI sa halagang $643 milyon. Kamakailan din ay nakuha ng kumpanya ang AI tech company na Clarifai, ngunit hindi isiniwalat ang detalye ng transaksiyon.

Ipinatutukoy ng mga acquisition na ito na layunin ng Nebius ang higit pang pagpapalakas ng AI inference at model optimization capabilities at pag-perpekto ng AI infrastructure services nito.

Kaiba sa mga infrastructure investment na nakatuon lamang sa compute power para sa AI model training, higit na binibigyang halaga ng AI inference ang efficiency ng aktwal na pagpapatakbo ng model, kabilang ang bilis ng request processing, compute resource scheduling, model deployment, at cost per unit ng compute power.

Habang patuloy na ini-integrate ng Nebius ang mga kaugnay na teknolohiya, lumalawak ang focus ng negosyo nito mula sa simpleng pagbibigay ng GPU compute resources tungo sa pagpapaunlad ng teknolohiya at serbisyo para sa pagpapahusay ng aktwal na running efficiency ng AI models.

Ang pag-aakuisisyong ito ng Inferize ay higit pang magpapalakas sa kakayahan ng Nebius sa dynamic compute scheduling at mabilis na model deployment. Gayunpaman, ang lawak ng magiging epekto ng integrasyon ng teknolohiyang ito sa pagtitipid ng cost at pagtaas ng efficiency ay mananatili pa ring obserbahan batay sa magiging performance ng operasyon sa hinaharap.

0
0

Disclaimer: Ang nilalaman ng artikulong ito ay sumasalamin lamang sa opinyon ng author at hindi kumakatawan sa platform sa anumang kapasidad. Ang artikulong ito ay hindi nilayon na magsilbi bilang isang sanggunian para sa paggawa ng mga desisyon sa investment.

PoolX: Naka-lock para sa mga bagong token.
Hanggang 12%. Palaging naka-on, laging may airdrop.
Mag Locked na ngayon!

Baka magustuhan mo rin

Ang bilang ng mga kumpanya sa Estados Unidos na nagbawas ng empleyado noong Setyembre ay bumaba sa pinakamababang antas sa apat na taon, ngunit ang kagustuhan sa pagre-recruit ay bumaba sa pinakamababang antas sa labinlimang taon.

Ayon sa ulat ng Challenger, Gray & Christmas, ang bilang ng inihayag na tanggalan ng empleyado ng mga kompanya sa Estados Unidos noong Setyembre ay bumaba ng halos 20% kumpara sa nakaraang taon, ngunit ang bilang ng mga tinanggal na empleyado sa sektor ng teknolohiya ay tumaas ng 77% buwan-sa-buwan. Ang bilang ng mga planong i-hire ng mga kompanya noong Setyembre ay bumaba ng 23% kumpara sa nakaraang taon. Sa parehong araw, ang bilang ng unang aplikasyon para sa benepisyo ng unemployment sa Estados Unidos noong nakaraang linggo ay bumaba sa 197,000, halos umabot sa pinakamababang antas mula pa noong 1969.

华尔街见闻•2026/10/01 16:22
Ang bilang ng mga kumpanya sa Estados Unidos na nagbawas ng empleyado noong Setyembre ay bumaba sa pinakamababang antas sa apat na taon, ngunit ang kagustuhan sa pagre-recruit ay bumaba sa pinakamababang antas sa labinlimang taon.

Maaaring magpatuloy hanggang 2028 ang kakulangan ng suplay ng NAND! Optimistic ang Citi tungkol sa AI demand na magtutulak ng pagtaas ng presyo ng storage chip at muling pinagdiinan ang "buy" rating para sa SanDisk (SNDK.US)

Ayon sa pananaliksik ng Citigroup, ang pinakabagong ulat ng ika-apat na quarter ng Micron Technology ay muling nagpapatunay na patuloy pa ring masikip ang suplay sa merkado ng NAND flash memory. Inaasahang magpapatuloy ang kakulangan sa pagitan ng suplay at demand sa industriya hanggang 2028, na magsisilbing suporta sa presyo ng mga memory chip.

智通财经•2026/10/01 15:41
Maaaring magpatuloy hanggang 2028 ang kakulangan ng suplay ng NAND! Optimistic ang Citi tungkol sa AI demand na magtutulak ng pagtaas ng presyo ng storage chip at muling pinagdiinan ang "buy" rating para sa SanDisk (SNDK.US)

The financial report ng Micron Technology ay napakaganda, ngunit ang presyo ng stock ay "hindi nagbago"! Pinapaboran pa rin ito ng Wall Street, itinaas pa ang pinakamataas na target na presyo sa $1625

Maganda ang performance at gabay ng Micron, ngunit kalmado ang reaksyon sa pre-market dahil tumaas na ang presyo ng stock ng 237% ngayong taon. Patuloy pa ring positibo ang pananaw ng mga higante ng Wall Street gaya ng Deutsche Bank, Bank of America, Goldman Sachs, at JPMorgan—may 26 na pangmatagalang kasunduang estratehikong kliente na nagtitiyak ng kakayahang kumita, habang itinakda ng UBS ang pinakamataas na target price na $1625, na nagpapakita ng kumpiyansa sa kakayahan ng kompanya na kumita sa iba't ibang siklo at matatag na potensyal na paglago.

华尔街见闻•2026/10/01 12:41