百度發佈PP-OCRv6:千萬級參數OCR媲美十億級視覺大模型
百度飛槳團隊發佈新一代OCR系統PP-OCRv6,提供Tiny 1.5M、Small 7.7M和Medium 34.5M三個版本。相比前代檢測準確率提升4.6%,識別準確率提升5.1%,以千萬級參數規模取得接近甚至超過部分十億級視覺語言模型(VLM)的表現。單模型支持中文、英文、日文及46種拉丁語系語言,已全面開源。
爲什麼重要:PP-OCRv6展示了小模型通過架構創新可以媲美大模型性能的趨勢,對邊緣設備和端側AI部署具有重大意義。OCR作爲AI基礎能力,其成本降低將推動更多應用場景落地。
#百度 #OCR #AI #开源 #大模型