“从苹果PCC到英伟达DGX”……企业级‘私有AI’将改变商业版图
随着企业为了安全和成本进入“私有AI”时代,AI技术的核心将从简单的聊天机器人转向能够与人类协作的“AI智能体”。
预计2027年AI技术的核心将超越简单的聊天机器人,成为能够与人类协作的“AI智能体”。有分析认为,企业的组织结构将重组为与智能体协作的组织、与聊天机器人工作的组织,以及与人工作的组织。根据T Times TV的视频,随着企业因安全和成本问题进入构建自有AI服务器的“私有AI”时代,GPU和数据中心相关企业的角色变得愈发重要。特别是当企业各自拥有GPU时,大科技公司的版图也将发生变化。
苹果的分层AI战略:从端侧到私有云
苹果公司最近通过强化Siri的AI功能,正在构建独立的AI生态系统。视频中,JiranJigyo Soft的CAIO Park Jong-cheon解释说,苹果采取了将模型分层运营的战略。首先,在端侧(On-device)环境中,利用苹果最新的芯片组如A20等,通过轻量化模型“AFM3 Core”等,在不泄露个人信息的情况下在设备内部处理大部分任务。在这一阶段,照片或文本等个人数据可以在不传出设备的情况下进行处理。
然而,仅靠端侧在处理复杂运算方面存在局限性。为了解决这一问题,苹果利用了“PCC”。PCC是苹果直接管理的数据中心,其特点是基于M5 Max等高性能硅芯片构建,最大限度地提高了安全性。预计PCC将构建包含CPU、GPU、NPU等高级服务器硅芯片的混合数据中心。出演者表示:“苹果掌握主导权,通过将模型分层并结合硬件与云端的使用,积累这种混合使用的经验至关重要”,并暗示这种技术栈未来有可能扩展为商务用Siri AI。
苹果的这一战略也为企业级市场提供了启示。因为企业可能会引入英伟达的DGX Spark(约1,000万韩元级别)等设备,或者通过24小时运行Mac mini将其作为“Token工厂”来降低API成本。最终,个人AI从端侧向苹果PCC,再向Google Cloud等云端AI转移的趋势,预计将与企业的私有AI构建战略相契合。
英伟达进军模型市场与中国高性价比AI的崛起
AI基础设施市场的强者英伟达的动向也在发生变化。过去专注于GPU供应的英伟达,最近直接推出了Nemotron 3 Ultra等AI模型,正式踏入了模型市场。这被解读为一种战略,即当企业拥有自有GPU并运行私有AI时,英伟达旨在直接提供能在该硬件上发挥最佳性能的模型。英伟达直接制造模型是为了向使用GPU的企业提供强大的生态系统。
在这种趋势下,中国AI模型的“性价比”战略也备受关注。根据视频,中国的“QN 3.8(27B)”模型在提供与美国高性能模型相当性能的同时,大幅降低了硬件配置要求,实现了成本效益的最大化。例如,分析认为,如果运行Nemotron需要价值10亿韩元的机器,那么QN模型在价值5,000万韩元的机器上也能运行。有分析指出,美国的GPU制裁反而促使中国企业开发出在低配置硬件上也能良好运行的高效率模型,引发了在保持性能的同时将价格降至20分之一水平的性价比战争。
企业级AI的核心课题:“数据安全等级”与权限管理
当企业向AI智能体授予所有业务权限的时代到来时,安全问题预计将成为最大的障碍。出演者强调了对企业内部数据进行安全等级分类体系的必要性。他引用政府的N2SF(数据安全体系),解释说应将数据分为机密(Classified)、敏感(Sensitive)、公开(Open)等等级进行管理。
例如,社长可以访问所有等级的数据,但团队长只能看到敏感(S)等级的数据,普通员工只能看到公开(O)等级的数据,通过这种方式控制权限。此时,AI在遵守用户权限的同时必须支持业务。出演者预测:“当用户询问其无权知晓的信息时,即使AI不直接告知具体内容,但能提供对业务有帮助的‘提示’,这种智能安全引擎将成为未来企业安全的核心。”这意味着在不侵犯用户权限的前提下,AI能够通过掌握数据间的相关性,给出适当水平回答的高级安全技术。
0评论
当前已关闭评论功能。