人形機器人看起來什麼都會,能走、能抓、能聽指令,但其實它一直有個你可能不知道的尷尬弱點—「大近視」。物體離太遠,往往得先靠近才能看清楚。2026台灣機器人與智慧自動化展中,所羅門(Solomon)這家必看重點,就直接替人形機器人升級「超級眼力」,現場讓它站在5公尺外讀視力表、抄工業儀表,甚至數咖啡膠囊還能分辨顏色。

人形機器人結果是「大近視」?沒想到吧!而這也是所羅門今年在2026台灣機器人與智慧自動化展(TAIROS)想解決的痛點之一。TAIROS於8月19日至22日在台北南港展覽館登場,所羅門從AI實體智慧、主動感知到3D視覺技術,都搬進現場實際秀給觀眾看。

目前不少人形機器人的視覺辨識,在距離拉遠後就會碰到細節辨識不足的問題,有些任務必須靠近目標約1至2公尺,才能比較清楚地確認物件。對一般人來說,「幫我拿桌上的杯子」看一眼就知道杯子在哪;但換成人形機器人,如果每接到一個任務,都得先一路走近、確認目標,再決定下一步,不但拖慢效率,頻繁移動也會增加耗電。

所以今年所羅門乾脆先替機器人「升級視力」。展覽現場第一關不囉唆馬上

來一個視力檢查。人形機器人Solomon站在距離視力檢查表超過5公尺的位置,接到「讀出最下面一排第一個字元」的指令後,便自行尋找目標並放大畫面,約莫10秒後辨識出答案「E」。

所羅門運用AI視覺技術辨識藥品種類與數量,協助降低配藥錯誤、提升藥品作業效率,相關技術已在中山大學附設醫院實證。圖/陳宏銘攝
所羅門運用AI視覺技術辨識藥品種類與數量,協助降低配藥錯誤、提升藥品作業效率,相關技術已在中山大學附設醫院實證。圖/陳宏銘攝

這背後的關鍵技術之一,就是所羅門展示的主動感知(Active Perception)能力。機器人不再只是對著固定畫面傻傻看,而是會先在較大範圍搜尋目標,再依照取得的視覺線索,主動調整觀察方式,把真正需要看的地方「看清楚」。現場甚至展示了影像可放大10倍的能力。

所羅門這套實體AI代理人平台,進一步把主動感知結合VLA(Vision-Language-Action,視覺-語言-行動)能力。也就是說,機器人不只負責「看到」,還要聽得懂人類下的指令、理解任務,再決定自己下一步該怎麼做,從理解、搜尋、辨識一路串到真正執行。

光會讀視力表還不夠,第二關,主持人要求Solomon機器人讀取遠方工業儀表板的數值。它同樣站在原地,沒有先湊到表頭前面,約10秒後讀出數值「23」。

如果這類能力未來導入工業巡檢,就像替工廠找到了一名不怕枯燥的巡檢員,面對一整排壓力表、水壓表,不必每一個都先走到眼前才能確認。

第三關更有趣了,桌上擺著不同顏色的咖啡膠囊,機器人不只要「看到」,還得「想一下」。Solomon接到「計算咖啡膠囊數量」的指令後,辨識出3個紅色、3個綠色及3個黑色膠囊。換句話說,它不只是單純辨識物件,而是進一步完成計數與顏色分類。

更重要的是,這套代理式工作流程並不只綁在人形機器人身上。所羅門表示,同一套技術也能部署在自走車(AMR)、無人機、機器狗及固定式IP攝影機等平台,讓不同設備都具備自主搜尋、感知、判斷,再到執行任務的能力。

換句話說,今天站在展場上讀視力表的是人形機器人,明天可以換成機器狗去找設備異常、AMR自己尋找貨物,甚至無人機從高處搜尋目標。

所以這次展場看似只是在替機器人做一場視力檢查,背後真正驗收的,其實是實體AI能不能從「看見」進一步變成「看懂」。人形機器人想拿到上班工作證,看來,還真恐怕得先把這雙「目睭」(台語,眼睛)顧好。

更多鏡報報導
機器人展登場!你的AI新同事見面會來了! 台廠大軍準備好搶攻實體AI新商機
機器人展揭密!拆開一台機器人就是一條新金脈! 從大腦到四肢台廠搶吃實體AI財
機器人展變AI大型徵才會!你的下一個同事可能不是人 產業技術司開出四大「職缺」
幕後/趙建銘出獄後連開兩家生技公司 地址「神隱」商務中心...動機耐人尋味