AI觀點

Multimodal LLM

解析 Inkling:首款原生支持圖文音 1T 參數的大規模多模態 MoE 模型
AI觀點 Inkling Multimodal LLM

解析 Inkling:首款原生支持圖文音 1T 參數的大規模多模態 MoE 模型

該模型在參數規模與多模態融合路徑上展現了極高的技術野心,透過 MoE 與原生塔設計成功解決了傳統編碼器的信息損耗問題,具備頂級的理論性能。然而,極高的 VRAM 門檻(BF16 需 2TB)使其在實務部署上存在嚴重的分層現象,其真實價值將取決於 1-bit 量化後的精度保留程度以及 MTP 加速的實際增益。