AI晶片軟體新創Infinity獲1500萬美元融資 估值達1億美元
商傳媒|責任編輯/綜合外電報導
舊金山新創公司Infinity.inc近日宣布完成1,500萬美元的種子輪融資,估值達到1億美元,以加速其AI基礎設施平台的發展。此次募資獲得Touring Capital、Principal Venture Partners、晶片產業高階主管、OpenAI及Anthropic研究人員等投資者參與。
Infinity主要開發AI晶片推論軟體,旨在大幅縮短新AI晶片投入實際應用所需的時間。在人工智慧領域,「推論」是指訓練好的AI模型在接收新資料後,生成回應、預測或其他輸出的過程。該公司希望將過去需數月甚至數年才能完成的軟體優化,縮短至數天。
其核心產品 Ignition 是一款自動化AI研究代理,能夠產生、測試並優化在專用晶片上執行AI模型所需的底層軟體核心(software kernels)。這些軟體核心能控制處理器內部的運算效率。新AI晶片雖然能提供顯著的理論運算效能,但若缺乏優化的軟體堆疊,實際表現往往難以達到預期。Infinity的目標正是彌補晶片在理想狀態與實際運行AI模型時的效能差距。
執行長 Jeremy Nixon 指出,如同輝達(NVIDIA)憑藉數十年開發的 CUDA 軟體生態系統,鞏固其在AI運算領域的領先地位,其他晶片開發商也需建立類似的優化軟體,才能讓其硬體被客戶大規模部署。Infinity的平台便是將大部分開發流程自動化,由人類工程師提供架構方向,而Ignition則反覆撰寫程式、衡量效能並持續改進,讓軟體能依據每個目標處理器的特性不斷調整。
Infinity表示,其方法能讓硬體工程師專注於更高層次的晶片架構設計,而非耗費心力手動優化數千個軟體操作。在一項測試中,Ignition將 Qwen3-8B 模型的推論吞吐量在一天內從每秒約1,400個 Token 提升至逾20,000個 Token,效能增長達14倍,且此框架的表現較廣泛使用的 vLLM 軟體優化超過34%。透過與d-Matrix的合作,Infinity也成功將 AI 代理在短短10小時內,就讓d-Matrix的 Corsair 推論晶片達到高達92%的理論峰值效能,並在10天內使 Qwen3、Qwen3.5 和 Gemma4 等模型在該處理器上端到端運行,每個模型層皆為新架構從零開始開發。
Infinity的商業模式著重於為半導體合作夥伴提升效能與節省成本,計畫透過分享這些經濟價值來獲利,而非僅依賴前期軟體授權費。據該公司預估,2026年AI運算支出中,推論環節將佔約三分之二。
【提醒您】
投資有賺有賠,本文僅供參考,不構成投資建議