Bitget App
Mag-trade nang mas matalino
Buy cryptoMarketsTradeFuturesEarnAISquareMore
Naglabas ang Google ng dalawang bagong TPU nang sabay, unang pagkakataon na pinaghiwalay ang training at inference chips, at malawakang inilunsad ang mga enterprise AI agent

Naglabas ang Google ng dalawang bagong TPU nang sabay, unang pagkakataon na pinaghiwalay ang training at inference chips, at malawakang inilunsad ang mga enterprise AI agent

华尔街见闻华尔街见闻2026/04/22 13:03
Ipakita ang orihinal
By:华尔街见闻

Sa taunang developer conference, sunod-sunod ang inilabas ng Google Cloud na pagmamay-ari ng Alphabet, kasabay na nagpakilala ng bagong henerasyon ng sariling chip at enterprise-level na AI agent tools, sabay na hinahamon ang Nvidia, OpenAI, at Anthropic sa hardware at software na mga larangan.

Noong Miyerkules ng lokal na oras, sa Google Cloud Next 2026 conference na ginanap sa Las Vegas, inilunsad ng Google Cloud ang dalawang bagong modelo ng ikawalong henerasyon ng Tensor Processing Unit (TPU): Ang TPU 8T na espesyal na dinisenyo para sa AI model training, at ang TPU 8i na in-optimize naman para sa inference phase, na inaasahang ilalabas ngayong taon. Ito ang unang beses na hinati ng Google ang training at inference na mga gawain sa hiwalay na chips, na nagmamarka ng malaki at bagong direksyon sa kanilang AI hardware strategy.

Naglabas ang Google ng dalawang bagong TPU nang sabay, unang pagkakataon na pinaghiwalay ang training at inference chips, at malawakang inilunsad ang mga enterprise AI agent image 0

Kasabay nito, inilunsad din ng Google ang Gemini Enterprise Agent Platform at iba pang AI agent development tools, na tuwirang tumutok sa merkado ng enterprise automation.

Ang paglulunsad ng bagong chips ay tumapat sa mabilis na paglaki ng demand para sa AI inference. Ayon kay Mark Lohmeyer, Bise Presidente ng Google Cloud Computing at AI Infrastructure: "Ang pangunahing laban ay kung paano makakamit ang pinakamababang latency sa bawat transaksyon sa pinakamababang gastos. Malaki ang pagtaas ng dami ng transaksyon, pero dapat ring bumaba ng husto ang gastos sa bawat isa para maging scalable." Inaasahang opisyal na ilalabas ang dalawang bagong chip ngayong taon.

Paghiwalay ng training at inference, malaking pag-angat ng performance ng chip

Ang paghati ng Google sa ikawalong henerasyon ng TPU sa dalawang independent na produkto ay direktang pagtugon sa patuloy na pagkakaiba-iba ng AI workload.

Sinabi ni Amin Vahdat, Senior Vice President at CTO for AI and Infrastructure ng Google, sa blog post: "Sa pag-usbong ng AI agents, nakikita naming makikinabang ang industriya sa mga chip na espesyal na optimized para sa training at inference na may kanya-kanya ring pangangailangan."

Ang TPU 8t ay optimized para sa training ng AI models, at sinasabing kayang "pababain ang development cycle ng state-of-the-art models mula ilang buwan hanggang ilang linggo lamang".

Sa aspeto ng performance, ang TPU 8t ay may 124% na pagtaas sa performance per watt kumpara sa nakaraang henerasyon, habang 117% ang pataas ng TPU 8i. Kung ikukumpara sa ikapitong henerasyon na Ironwood TPU na inilabas noong Nobyembre, ang TPU 8t ay 2.8 beses na mas mabilis sa parehong presyo, habang ang TPU 8i ay 80% na mas mataas ang performance.

Ang training chip na TPU 8t ay kayang pagsamahin ang hanggang 9600 na chips sa isang sistema. Ayon sa Google, sa pag-deploy ng napakalaking sistema, ang kuryente ay naging pangunahing limitasyon ng data centers kaya napakaimportanteng mataas ang energy efficiency nito.

Ang TPU 8i ay pangunahing para sa inference scenarios, akma sa pagpatakbo ng mga AI models at pagproseso ng AI agent tasks. Ang disenyo ng architecture nito ay nakatutok sa malaking on-chip storage. Bawat chip ay may kasamang 384MB na Static Random Access Memory (SRAM), tatlong beses na mas marami kaysa sa nakaraang henerasyon na Ironwood.

Ang dalawang chips na ito ay planong gawing available sa merkado pagsapit ng huling bahagi ng 2026.

Sinabi ni Alphabet CEO Sundar Pichai sa blog post na ang architecture na ito ay naglalayong "maghatid ng malaking throughput at mababang latency na kailangan para sabay-sabay na magpatakbo ng milyun-milyong agents sa cost-effective na paraan." Ang pagdagdag ng on-chip storage ay nangangahulugang hindi kailangang madalas kumuha ng data mula sa labas ng chip, na susi para sa AI tasks na nangangailangan ng multi-step reasoning.

All-around rollout ng AI agent platform, direkta laban sa OpenAI at Anthropic

Sa software side ng mga produkto, naglabas din ang Google ng isang kumpletong enterprise AI agent tool chain, direktang tumutunggali sa enterprise market strategies ng OpenAI at Anthropic.

Ayon sa ulat ng Bloomberg, ilang founders ng startup ang nagsabi na ang mga engineers sa Silicon Valley ay madalas na nagpapalit-palit ng Anthropic Claude Code at OpenAI Codex bilang AI programming tools, at madalang isama ang Google sa pagpipilian—isang kalagayan na ikina-aalala ng mga ehekutibo ng Google.

Sinabi ni Thomas Kurian, CEO ng Google Cloud, sa blog post: "Hindi lang ito magkasamang inaalok na nagkakabit-kabit na mga serbisyo, kundi isang kumpleto at inobatibong foundational framework."

Ang bagong Gemini Enterprise Agent Platform ay may dagdag na Memory Bank at Memory Profile features, upang matulungan ang mga agent na maalala ang kasaysayan ng interaksyon sa user, tinutugunan ang kahinaan sa memory ng early-stage AI tools; Ang Agent Simulation feature naman ay nagpapahintulot sa developers na mas maiging masubukan ang mga tool bago ito ilunsad.

Naglabas din ang Google ng collaboration platform na tinatawag na Projects, na binubuo ng impormasyon mula sa Workspace, Microsoft OneDrive, at mga internal na chat tools ng kompanya, para bigyan ang agents ng tamang konteksto. Bukod dito, inilunsad din ng Google ang Gemini Enterprise app para sa mga ordinaryong empleyado, na tinutukoy bilang "AI receptionist ng bawat empleyado," kung saan hindi na kailangang mag-code ang user para gumawa ng sariling agent.

Accelerated deployment ng TPU, parallel na pagpapaigting ng partnership sa Nvidia

Kahit tuloy-tuloy ang investment ng Google sa sariling chip, hindi pa rin natitigil ang ugnayan nila sa Nvidia.

Ayon kay Mark Lohmeyer, balak ng Google na maging isa sa mga unang magpatupad ng bagong chip designs ng Nvidia sa ikalawang bahagi ng taon, habang patuloy na suportahan ang mga kliyenteng nais gumamit ng Nvidia systems.

Kasabay nito, bumibilis ang commercial adoption ng Google TPU.

Ang hedge fund na Citadel Securities ay nakagawa na ng quantitative research software gamit ang Google TPU. Gamit din ng lahat ng 17 national laboratories na nasa ilalim ng US Department of Energy ang AI collaborative scientist software na naka-base sa TPU. Nakapirma rin ang Meta at Google sa pangmatagalan at bilyong-dolyar na TPU usage agreement, habang ang Anthropic ay nangakong gagamit ng multi-gigawatt level ng Google TPU compute power.

Ayon sa pagsusuri ng DA Davidson noong Setyembre ng nakaraang taon, ang TPU business at Google DeepMind AI ay kombinadong tinataya sa halagang $900 bilyon.

Kapansin-pansin na hindi direktang inihalintulad ng Google ang performance ng bagong chip sa produkto ng Nvidia. Sa panig ng Nvidia, paparating na ang bagong linya ng produkto na gumagamit ng teknolohiyang nakuha mula sa $20 bilyong acquisition ng Groq, partikular para sa ultra-low latency inference scenarios.

Sinabi noon ni Nvidia CEO Jensen Huang na higit 20% ng AI workloads ay maaaring pinakaangkop sa ganitong klase ng chips. Itinatag ang Groq noong 2016 ng ilang dating Google engineers.

Upang palawakin pa ang availability ng TPU, isinasagawa rin ng Google ang testing para ma-deploy ang TPU sa data centers na pagmamay-ari ng customers, at nagtataguyod ng compatibility sa third-party na software tools. Gayunpaman, bottleneck sa chip supply at mismatch sa mabilis na iteration ng AI models kontra sa matagalang chip development cycle, ay nananatiling pangunahing uncertainty na kailangang lampasan ng Google sa pagpapalawak ng saklaw nito.

0
0

Disclaimer: Ang nilalaman ng artikulong ito ay sumasalamin lamang sa opinyon ng author at hindi kumakatawan sa platform sa anumang kapasidad. Ang artikulong ito ay hindi nilayon na magsilbi bilang isang sanggunian para sa paggawa ng mga desisyon sa investment.

PoolX: Naka-lock para sa mga bagong token.
Hanggang 12%. Palaging naka-on, laging may airdrop.
Mag Locked na ngayon!

Baka magustuhan mo rin

Pinuno ng Hedge Fund ng Goldman Sachs: "Zero-date options" ay nagpapababa ng volatility ng US stock market, teknolohiya at enerhiya pa rin ang pinakamahusay na pagpipilian

Ang S&P 500 ay nagtala ng sunod-sunod na 27 trading days na may intraday volatility na mas mababa sa 1%, na siyang pinakamahabang rekord ng mababang volatility mula noong pandemya. Nagbabala ang Goldman Sachs na ang katahimikan na ito ay bunga ng mga zero-day option strategy na pilit na kinukulong ang galaw ng merkado, at kapag lumitaw ang isang katalista, ang naipong enerhiya ng volatility ay maaaring sabay-sabay na sumabog. Samantala, tumataas ang inaasahan ng rate hike sa Setyembre, bumagsak ang market sentiment sa pinakamababang antas ngayong taon, at may panganib pa rin sa fiscal sustainability—hanggang kailan ba magpapainit ang kalderong ito bago tuluyang kumulo?

华尔街见闻2026/09/15 03:56

Isang bagong yugto ng pagbebenta ang paparating? Matinding kalaban ng AI bull market lumitaw — "Angkla ng global asset pricing" pumapalo sa higit 5% super threshold

Matapos muling lumampas sa kritikal na antas na 5% ang 10-year na kita ng US Treasury, mas posible ang isang panahon ng mataas na volatility at mabilis na pagdedepensa ng mga asset, lalo na bago humupa ang epekto ng energy shock at ang patuloy na malakihang pagtaas ng fiscal deficit ng US. Sa ngayon, hindi pa sapat ang mga kondisyon para mabilis na maulit ang malaking pagbaba ng kita noong katapusan ng 2023.

智通财经2026/09/15 03:26
Isang bagong yugto ng pagbebenta ang paparating? Matinding kalaban ng AI bull market lumitaw — "Angkla ng global asset pricing" pumapalo sa higit 5% super threshold

Muling naglabas ng artikulo ang Anthropic: Ano ang magiging hitsura ng ekonomiya sa panahon ng AI?

Inilabas ng koponan ng ekonomiya ng Anthropic ang AI economic scenario model, na nakatuon sa tatlong mga senaryo: banayad na unti-unting paglago, malaking pagbabago kung saan doble ang GDP, at isang ekstremong kaso na may 15% taunang paglago ngunit maraming nawawalan ng trabaho sa mga knowledge workers. Tinuturing ng modelo ang trabaho bilang “pakete ng mga gawain,” sinusuri ang epekto ng AI sa pagpapahusay at pagpapalit ng iba’t ibang klaseng gawain. Binibigyang-diin ng Anthropic na hindi pa tiyak ang kalagayan ng ekonomiya sa 2030, at mahalaga kung paano tiyakin na ang mga benepisyo ng AI ay malawakang mapapakinabangan.

华尔街见闻2026/09/15 03:26

"Bagong Federal Reserve News Agency": Walang ibang daan si Waller kundi ang magtaas ng interest, Ang "tiwala" kay Trump ay nahaharap sa pagsubok

Naniniwala si Nick Timiraos na ang posibilidad ng pagtaas ng interest rate ng Federal Reserve ngayong linggo ay tumaas nang malaki matapos ang mas mataas sa inaasahang CPI noong Agosto. Ang matatag na pahayag ni Waller tungkol sa inflation ay nagdulot na halos wala siyang “pag-urong.” Ang pagtaas ng rate pitong linggo bago maghalalan, at kung itutuloy ni Waller ang pagtaas, direktang susubok kung gaano katagal mapapanatili ni Trump ang “tiwala” sa kanya. Dati, ginamit ni Waller ang taktika ng “mas kaunting salita, iwas-pag-udyok” upang panatilihin ang balanse sa pagitan ng White House at Federal Reserve. Pagkatapos ng meeting na ito, hindi na magiging kalasag ang pananahimik.

华尔街见闻2026/09/15 03:26