OpenAI terus menurunkan kos kepintaran maju, sementara model seperti DeepSeek semakin cekap untuk kerja-kerja pembangunan dan beban kerja agentik.
Dalam pembangunan kami sendiri, kami menggunakan OpenAI sebagai model guru untuk distilasi.
Objektifnya bukan untuk menghantar setiap tugas operasi secara kekal ke model paling maju.
Kami menggunakan model yang lebih kuat apabila kepintarannya menghasilkan nilai tertinggi:
Latihan. Penaakulan. Penilaian. Distilasi.
Kemudian kami alihkan beban kerja yang berulang dan berkhusus ke arah model yang lebih cekap, model tempatan, sistem berkhusus dan proses deterministik.
Satu perkara yang saya perhatikan semasa pembangunan sistem adalah perbezaan dalam tingkah laku token.
Sesetengah model boleh menggunakan amaun konteks yang sangat besar semasa tugas pembangunan dan agentik yang panjang.
Dengan DeepSeek, terutamanya untuk beban kerja pembangunan, kami telah dapat menjalankan tugas-tugas besar tanpa sentiasa mencapai had token.
Ini membawa kepada satu soalan penting:
Model AI terbaik bukan semestinya model yang harus anda gunakan untuk setiap tugas.
Satu seni bina yang lebih baik mungkin kelihatan seperti ini:
Model OpenAI maju → Guru / Distilasi
LLM / SLM cekap → Kepintaran berkhusus
Sistem terpisah → Beban kerja deterministik berulang
Penghalaan Pintar → Pilih lapisan yang sesuai untuk setiap tugas
Di sinilah ekonomi AI menjadi menarik.
Apabila kepintaran terkini menjadi lebih murah, kita boleh menggunakannya untuk mencipta dan memperbaiki kepintaran berkhusus yang lebih kecil, berbanding membayar kos model terkini secara berterusan untuk setiap operasi.
Bagi PKS, ini boleh mengubah ekonomi penggunaan AI secara mendasar.
Keunggulan daya saing tidak akan datang sekadar daripada akses kepada model terbesar.
Ia akan datang daripada pengetahuan:
model mana yang hendak digunakan, bila hendak menggunakannya, apa yang hendak didistilasi, dan apa yang sepatutnya tidak menggunakan LLM langsung.
Itulah arah yang kami bina di AINNA NeuralOps.
#ArtificialIntelligence #AIInfrastructure #OpenAI #DeepSeek #ModelDistillation #AgenticAI #LLM #SLM #AIAgents #SME #NeuralOps



Ruang pembaca
Apa pendapat anda?
Komen baharu dihantar untuk semakan terlebih dahulu. Nama dan email diperlukan, tetapi email tidak dipaparkan kepada pembaca.
Still thinking about sementara model seperti deepseek semakin.
The framing around distilasi.Kemudian kami alihkan beban kerja is better than I expected.
Angka soal dan apa yang sepatutnya tidak lebih masuk akal daripada kebanyakan artikel. Bagian ini masih perlu saya pikirkan lagi.
I do not fully buy kita boleh menggunakannya untuk mencipta yet, but it is a fair argument.
I would push back slightly on model tempatan, sistem berkhusus dan, but the direction is right.
The numbers around kami telah dapat menjalankan tugas-tugas make more sense than most posts I read.
Malinaw ang paliwanag tungkol sa paksang ito at madaling sundan.