ChatGPT大火之后人们发现只要基于的AI模型大到一定程度就会出现“涌现效应”(Emergent Effect),就是像突然开窍一样拥有当初训练这个模型时所意想不到的逻辑思维、知识推理和分析能力。企业一旦拥有这样的能力,再结合自己的业务,可能会迅速改变所在行业的竞争态势。
然而企业出于安全和合规,不可能使用OpenAI这种云端的大模型,于是开源的能够安装在用户自己数据中心的大模型成为唯一选择。但高质量的大模型是AI这一新工业革命生产力的核心机密,怎么可能开源出来给大家用?Meta(Facebook)的一次对其大模型LLaMa的 “不慎”泄露,逼迫了一批高质量的大模型纷纷开源,这些开源大模型能否替代ChatGPT所基于的GPT3.5、GPT4模型呢?近期各大机构纷纷进行各类评测,参考大量评测并结合个人使用经验,Meta最新的LLaMa2,国产清华大学的ChatGLM2,以及商汤联合国内高校的书生·浦语等大模型在语言类任务,比如聊天对话、文章创作、语言翻译等已经非常接近ChatGPT 3.5,其中各个国产模型在中文诗词、中国高考上甚至做得更好,但在推理精确度、一致性和思维幻觉抑制(就是避免一本正经胡说八道)方面还有欠缺,而且普遍对GPT4还有明显差距,这会影响自动化编程、自动化调度等生产力类任务的准确性,但经过企业自己的微调或本地知识库的关联,还是能够达到相当好的效果。
总之企业在自己的私有网络中使用最新的生成式AI已成大势所趋,思科无论在帮助我们的客户建设AI还是使用AI上都有大量的机会,这方面我们后续将分别集中报导。 |