AI Tak Perlu Berfikir Setiap Masa – Kurangkan Beban Compute, Tenaga dan Air✎ Edit

👁 294 views
AI Tak Perlu Berfikir Setiap Masa – Kurangkan Beban Compute, Tenaga dan Air

Infrastruktur AI berkembang pesat, tapi ada satu lagi aspek yang perlu kita bincang dalam operasi harian: penggunaan elektrik, penyejukan dan air.

Penyelidikan terkini menunjukkan bahawa setelah model AI digunakan, inferens boleh mengambil kira 80–90% daripada penggunaan tenaga keseluruhan. Setiap panggilan LLM yang tidak perlu bermakna lebih banyak compute GPU, lebih banyak elektrik, lebih banyak haba, dan akhirnya lebih banyak permintaan penyejukan.

Ini antara sebab kami membangunkan NeuralOps berdasarkan prinsip yang berbeza:

Bukan setiap tugas memerlukan LLM.

Dengan Smart Routing, sesuatu tugas boleh dikendalikan dahulu oleh peraturan, parser, pangkalan data, API atau model yang lebih kecil. Penaakulan LLM yang berat hanya digunakan apabila benar-benar diperlukan. Setelah aliran kerja menjadi stabil, ia boleh ditukar menjadi sistem deterministik yang terpisah yang dilaksanakan berulang kali tanpa memanggil LLM.

Untuk aliran kerja berulang yang sesuai, seni bina ini berpotensi mengurangkan permintaan inferens AI sebanyak sehingga 90%.

Kesan ini bukan sahaja pada penjimatan token.

Kurang inferens → Kurang compute GPU → Kurang elektrik → Kurang haba → Kurang penyejukan → Kurang permintaan air.

Ada lagi satu faedah: kebolehpercayaan.

Apabila aliran kerja terpisah tidak lagi bergantung pada LLM semasa pelaksanaan, terdapat sifar token LLM dan sifar halusinasi LLM sepanjang laluan pelaksanaan tersebut. Kepintaran digunakan di mana penaakulan diperlukan, manakala sistem deterministik mengendalikan operasi berulang.

Saya percaya AI yang mampan bukan sahaja datang daripada membina pusat data yang lebih cekap.

Ia juga datang daripada mencegah inferens AI yang tidak perlu daripada sampai ke pusat data sejak awal.

Itulah hala tuju yang kami terokai dengan NeuralOps:
gunakan AI apabila kepintaran diperlukan, dan gunakan sistem deterministik apabila tidak.

#ArtificialIntelligence #AgenticAI #NeuralOps #SovereignAI #GreenAI #SustainableAI #DataCentre #AIInfrastructure #SmartRouting #Automation #SME

Ruang pembaca

Apa pendapat anda?

Komen baharu dihantar untuk semakan terlebih dahulu. Nama dan email diperlukan, tetapi email tidak dipaparkan kepada pembaca.

💬 16 komen pembaca
Siti 🇲🇾 Malaysia · 210.186.*.67

ia boleh ditukar menjadi sistem - sums the whole thing up.

Hafiz 🇲🇾 Malaysia · 27.125.*.31

The part on penaakulan LLM yang berat hanya is the bit I keep re-reading.

Wei 🇨🇳 China · 36.112.*.44

The numbers around mengambil kira 80–90 90% make more sense than most posts I read. Still thinking this one through.

Mei 🇨🇳 China · 58.20.*.26

第一次看到有人把80讲得这么坦白。

Kavitha 🇮🇳 India · 103.82.*.27

सेव कर लिया, ख़ासकर 80 की वजह से।

Arjun 🇮🇳 India · 49.36.*.55

This is where sebanyak sehingga 9 90% finally makes sense.

Julin 🇲🇾 Kadazan, Malaysia · 175.136.*.63

Not convinced on dan akhirnya lebih banyak permintaan yet, but fair argument. Worth reading twice.

Ginsang 🇲🇾 Kadazan, Malaysia · 60.54.*.11

Still thinking about seni bina ini berpotensi mengurangkan.

Dimas 🇮🇩 Indonesia · 36.72.*.15

I would push back slightly on kebolehpercayaan.Apabila aliran kerja terpisah, but the direction is right.

Ayu 🇮🇩 Indonesia · 114.79.*.48

I have watched sesuatu tugas boleh dikendalikan dahulu go wrong in practice. Good to see it written down. Still thinking this one through.

Narin 🇹🇭 Thailand · 49.228.*.38

Good write-up. Setelah aliran kerja menjadi stabil alone was worth the read.

Suda 🇹🇭 Thailand · 110.164.*.72

Whoever wrote this actually did the work on parser, pangkalan data, API atau.

Miguel 🇵🇭 Philippines · 112.198.*.52

Not sure I agree with boleh mengambil kira 80, but the rest holds up.

Liza 🇵🇭 Philippines · 49.146.*.24

Honestly, setiap panggilan LLM yang tidak surprised me. Worth a closer look.

Omar 🇦🇪 United Arab Emirates · 5.32.*.29

I read this twice. inferens boleh mengambil kira 80–90% is the part that stuck.

Layla 🇯🇴 Jordan · 176.28.*.47

80 هو الجزء الذي سأرسله لمديري.

Artificial Intelligence

Article image
BioResearch Microbiology & cancer disease research intelligence 6 inputs → traceable research priorities Explore →
SmartCity AI-powered smart city infrastructure & operations 24 domains → one intelligent operating layer Explore →
Robotics Governed robotics at the industrial edge Perception → safety gateway → controller Explore →
SME AI Build AI capability inside your own SME 6 build tracks → in-house capability Explore →
AINNA Ecosystem

Keep exploring after this article.

Every article page should end with a clear path into the wider AINNA, Agent, and NeuralOps ecosystem.

Current topic Artificial Intelligence Author profile Firdaus AINNA Main ecosystem hub Agent Private autonomous agent hub NeuralOps AI automation and business systems Lead form Start a pilot discussion
AINNA Agent AI

Deploy Our AINNA AI Agent

Linux is the core path, Windows is supported, and Android / Termux works as the companion layer.

9 downloads
Linux / macOS curl -fsSL https://ainna.bond/install | bash
Verify ainna --version
AINNA
CLICK ME
Rotating Earth

Site Sections

No section data available yet.

Sites with documented sections will appear here.