
Anthropic MHS: Satu Spec untuk Agen AI Kendalikan Perkakasan Sebenar
Anthropic MHS: Satu Spec untuk Agen AI Kendalikan Perkakasan Sebenar
Pada 27 Ogos 2026, Anthropic membuka research preview untuk Model Hardware Standard (MHS) — satu spec perkongsian yang membolehkan AI agents menemui dan mengendalikan peranti fizikal dengan selamat. Ia bermula sebagai kerjasama antara Anthropic dan HHMI Janelia Research Campus. Konsepnya hampir sama dengan apa yang Model Context Protocol (MCP) lakukan untuk software tools, cuma kali ini ia merentas ke dunia fizikal.
Tawaran di sini sebenarnya besar, walaupun bunyinya sederhana. Daripada menulis integrasi khas untuk setiap mikroskop, liquid handler, kamera dan robotic arm di atas meja makmal, MHS memberi instrumen-instrumen itu satu lapisan driver yang sama — dan mana-mana agent boleh bercakap dengannya. Setup yang biasa mengambil masa berminggu-minggu atau berbulan-bulan kini boleh siap dalam beberapa jam atau minit sahaja. Anthropic berkongsi versi awal standard ini dengan kohort pertama makmal sains dan pengilang termaju, dan bercadang untuk membukanya sebagai open-source kemudian.
Cukai Integrasi yang MHS selesaikan
Berjalan masuk mana-mana makmal sebenar, anda akan nampak masalahnya dengan segera. Meja kerja dipasang daripada vendor yang tidak pernah berniat untuk saling beroperasi. Setiap instrumen ada antara muka pengaturcaraan sendiri — ada yang guna protokol serial proprietary, ada yang ada REST endpoint yang pelik, ada yang minta SDK Windows sahaja. Untuk sambungkan dua daripadanya, pakar kena tulis translator khas dengan tangan. Untuk lima berfungsi serentak, anda makan masa berminggu.
Walaupun selepas pendawaian siap, tiada cara umum untuk peranti menyerahkan state kepada agent, atau membolehkan agent mengendalikannya dengan selamat. Itulah yang MHS serang. Ia menyeragamkan driver — lapisan software antara komputer dan peranti — dan mendedahkan satu set primitif yang kecil: read untuk dapatkan state seperti suhu semasa, write untuk setkannya, plus discovery supaya peranti dan agent boleh mencari satu sama lain merentas rangkaian tanpa translator di tengah-tengah.
Apa Sebenarnya yang MHS Spec
MHS berfungsi dengan mana-mana peranti yang ada antara muka boleh atur cara. Ia sengaja model-agnostic — mana-mana agent harness boleh capai peranti MHS melalui protokol standard seperti Model Context Protocol, selain CLI dan code files.
Tiga idea yang menjadi tunjang reka bentuk ini:
- Driver yang diseragamkan menterjemah antara host dengan instrumen, menggantikan translator sehelai-sehelai.
- Fail pengetahuan menangkap apa yang code sahaja tidak dapat encode — misalnya berat fizikal lengan robot, atau parameter apa yang diukur oleh sesuatu peranti. Driver tags membolehkan pengguna menulis pengetahuan itu dalam bahasa semula jadi, atau membiarkan agent menemu bual mereka tentang setup itu, dan driver menyusunnya menjadi fail rujukan yang menyenaraikan apa yang diukur peranti, apa yang boleh dilaraskan, dan had keselamatan yang dikuatkuasakan.
- Had keselamatan hidup dalam driver, bukan dalam prompt. Daripada berharap agent "berkelakuan baik", driver peranti sendiri yang menguatkuasakan apa yang ia dibenarkan lakukan.
Yang terakhir inilah yang paling patut diberi perhatian. Safety aras prompt untuk peralatan fizikal tidak boleh dipercayai — anda tidak mahu model berfikir sendiri untuk melepasi laser interlock. MHS menolak kekangan itu turun ke lapisan hardware, tempat ia bersifat struktur dan tidak boleh dirunding.
Beginilah rupa kasar primitif yang didedahkan oleh driver:
// Permukaan driver MHS secara konsep (bukan API sebenar)
const device = await mhs.connect("liquid-handler-02", { transport: "mcp" });
const temp = await device.read("heater.temperature"); // dapatkan state
await device.write("heater.set_temperature", 37.0); // set state
await device.discover(); // cari rakan lain di rangkaian
Angka-angka daripada Preview
Rakan kongsi Anthropic melaporkan keputusan konkrit sepanjang preview ini:
- Carnegie Mellon menyiapkan dose-response curve dalam lapan jam, berbanding biasa yang mengambil masa berminggu.
- QuEra menggunakan agent pada hardware pengkomputeran kuantum dan meningkatkan kadar kejayaan laser relock daripada 58% pada ~150 saat kepada 99.3% dalam 700 percubaan — dihasilkan sebagai script deterministik.
- University of Washington — seorang pelajar PhD di makmal Baker dan Pinglay menyambung enam instrumen dalam masa kurang seminggu, termasuk menulis driver.
- Tetsuwan Scientific menggandingkan MHS dengan platform ResearchOS untuk profil pencemaran qPCR.
- Di Janelia, satu rig mikroskopi bertukar daripada tujuh program yang dilancarkan dalam urutan tetap kepada satu klik pada dashboard.
Vendor hardware juga sedang membina sokongan MHS: AWS menyokongnya melalui Strands Robots, Automata melalui platform automasi makmal LINQ, Tecan untuk liquid handlers Fluent, dan Universal Robots untuk platform robotiknya.
Caveat yang Jujur
MHS ini research preview, bukan produk siap. Hanya kohort berasaskan permohonan yang ada akses, dan spec penuh belum open-source — tarikh, repo dan lesen belum diumumkan. Demonstrasi banyak bergantung pada Claude, jadi tuntutan model-agnostic itu lebih kepada niat reka bentuk daripada fakta yang diukur. Dan Anthropic sendiri jelas bahawa penaakulan spatial dan fizikal Claude ada had yang sebenar. Penyelidik Genentech, misalnya, terpaksa mengajar Claude bahawa ralat yang disebabkan oleh buih dalam sampel protein adalah kegagalan fizikal, bukan bug software.
MHS juga tidak dapat membantu untuk hardware yang langsung tiada antara muka boleh atur cara. Peranti sebegini perlu ada driver yang dibina oleh pengilang terlebih dahulu. Dan persoalan tadbir urus — siapa yang bertanggungjawab bila mesin yang dikendalikan agent rosakkan sesuatu — masih sedang ditulis oleh mahkamah dan regulator, bukan sekadar oleh engineer.
Mengapa Perkara Ini Penting
Sejak beberapa ketika, rangka kerja agent telah membuka kunci software tools melalui protokol yang dikongsi. MHS ialah idea yang sama merentas ke dunia fizikal: jadikan instrumen sebagai sistem yang boleh ditemui, difikirkan, dan dikendalikan oleh agent tanpa integrasi khas untuk setiap mesin. Ia tidak akan menggantikan engineer yang memahami meja kerja itu — had penaakulan fizikal Claude sendiri menjamin pengawasan pakar kekal dalam gelung. Tapi ia mengubah ekonomi. Kalau standard ini matang dan dibuka, bottleneck antara "AI agent" dan "AI agent yang betul-betul buat sains" menjadi jauh lebih kecil.
Berkaitan
- Komputasi Saintifik dalam Era Agentic AI — Cara coding agents memodenkan software penyelidikan.
- DeepSeek Harness: Kerangka Agen yang Semuanya Plugin — Trend sebelah software yang membalut teras beku dengan keupayaan berbentuk plugin.
Pengumuman penuh ada di research preview Model Hardware Standard Anthropic, dan anda boleh memohon akses melalui modelhardwarestandard.com.
// penulis
Chief Operator
Gaara is the human operator behind hejes.my. He runs the briefing pipeline, curates the AI drafts, and presses the publish button.
sektor berkaitan //

EnvHarness: Jadikan Benchmark Agen Statik sebagai Dunia Adaptif
EnvHarness Google membalut benchmark agen beku dengan komponen plugin supaya ia sesuai dengan policy dilatih — naik sehingga 9 mata pada tugasan held-out.

Karnival Robot Shanghai: AI Berbadan China Masuk Ruang Awam
Di sebuah karnival awam di pinggir Shanghai, robot humanoid bermain seni mempertahankan diri dan membuat kopi sementara China secara senyap menguasai 90% pengeluaran humanoid global.

Lab Frontier Masih Tiada Pelan Containment Model AI Liar
Audit baharu Guidelight: lima lab frontier belum ada pelan penuh untuk mengekang model AI liar — dan Anthropic sendiri dapat sifar.
// sertai suapan
satu ilmu seminggu. tiada spam.