思想领袖

人工智能的下一个前沿:面向现实世界影响的消费者中心应用

mm
将 Unite.AI 添加到您在 Google 上的首选来源

人工智能仍然感觉像一个尖端的突破,即使它已经存在了几十年。

机器学习已经悄悄地为搜索引擎、推荐算法和语音识别提供了动力多年,但只有最近,人工智能才成为了一种消费产品。

自从生成式人工智能作为人工智能的一个子类别在2022年“主流化”以来,ChatGPT创造了记录,成为有史以来增长最快的应用程序。生成式人工智能的用户采用率正在飙升,三分之一的成年人和五分之四的青少年现在每天使用它。

然而,尽管生成式人工智能在短短两到三年内相对正常化,但它仍然让人联想到互联网或移动应用的早期:强大、令人兴奋,但尚未完全融入日常生活。

这是一个熟悉的周期。互联网的第一波是关于使其概念上和实际上可行。真正的转变发生在后来,当公司建立在该基础上创建无缝、不可或缺的服务时。

人工智能是否遵循着类似的路径?如果是这样,我们可以期待看到哪些形式的消费者人工智能,当技术成熟时?

人工智能已经到来,但仍在探索

人工智能正在快速发展,但大多数仍然围绕着少数主要玩家的努力。科技巨头——微软、谷歌、苹果、亚马逊和Meta——已经将数十亿美元投入到研究中,而人工智能硬件的骨干NVIDIA的市值在两年内几乎增加了四倍。

投资已经集中在建立更大的基础模型上——这既是由竞争驱动的,也是为了证明惊人的开发成本的合理性。

基于此,B2C人工智能应用的第一波已经专注于通过接管重复性任务来提供即时价值,例如会议组织和安排,这些任务以前消耗了大量用户时间。虽然这些工具简化了工作流程并跨不同格式生成高质量的媒体,但它们通常仍然需要大量的用户输入。

在许多情况下,让人工智能产生伟大的结果仍然需要努力。这是一个通往主流采用的障碍。基本的技术不需要用户掌握。没有人需要学习如何为Uber优化路线或手动导航谷歌地图。

人工智能还没有达到那里,但那是它的方向。新的B2C人工智能工具将更加直观、响应迅速、融入日常生活——令人难以置信的智能、易于使用、无需努力就能预测。

消费者人工智能的新时代

下一代人工智能不仅仅是一种我们直接交互的工具——它将是嵌入到我们的数字(和物理)生活中的一个智能层。

让我们来看看消费者人工智能技术现在的发展方向和其未来的潜力。

代理和个人计算

人工智能已经证明了其能够产生惊人的结果,但结果仍然严重依赖于用户的输入。从今天的许多人工智能工具中提取高质量、连贯的结果通常需要技能、实验和技术知识。这给用户带来了负担,自然地吸引了技术爱好者,而不是更广泛的用户群体。

下一代B2C人工智能将消除这一过滤器,变得更加直观、适应性和代理——在没有持续监督的情况下完善行为和管理复杂任务。

随着这一点,人工智能正在接近“直接工作”的东西,就像Uber、谷歌地图或TikTok一样,这些需要很少的专业知识却提供无缝的体验。

下一个逻辑步骤?人工智能系统不仅可以生成响应,还可以代表用户采取行动。

OpenAI的OperatorClaude Computer Use谷歌的Jarvis展示了人工智能独立执行多步任务的早期进展。目前,人工智能可以帮助您在20分钟内完成一项任务,而不是一个小时——但您仍然需要在场监督和执行该过程。有了代理人工智能,您可能根本不需要在PC上。

这将导致人工智能预测、自动化和编排应用程序和服务中的工作流程。这体现在许多产品中:

  • 人工智能驱动的财务自动化——想象一个可以自动化储蓄、动态调整预算并确保账单按最佳时间支付的财务应用程序。用户不需要手动移动资金,人工智能可以处理其余的事情。
  • 人工智能驱动的购物和物流——想象一个可以注意到家庭必需品即将用完并在最佳价格下订购补货的AI助手,而无需不断输入。任何零售产品退货和更换都可以轻松处理,人工智能处理来回通信,提供标签和投递地点。
  • 人工智能管理时间和生产力——一个不仅设置提醒,还可以根据实时优先级、精力水平和个人习惯主动重新安排计划的调度工具。它可以建议何时专注、休息和重新安排不那么紧急的任务。
  • 面向消费者的自动化——人工智能将日常服务链接在一起,根据餐饮计划自动调整杂货配送,根据日常安排智能家居设置,根据实时数据协调交通。

我们可以在今天建立一些这样的应用程序,但它们需要复杂的设置和手动配置。例如,自动化服务如If This Then That(IFTTT)可以用于链接多个平台。

这就是将要改变的。人工智能将处理设置本身,而不是要求用户学习自动化。您只需用简单的语言描述您的需求,人工智能就会处理其余的事情。

多模态、多平台应用程序,用于创造力和娱乐

想想我们如何自然地在说话、手势、写作和绘画之间切换,以分享想法。创造力并不局限于单一的媒体,但大多数数字工具仍然是这样。

下一波人工智能将改变这一点,使得跨文本、视觉、声音和交互式体验表达想法成为可能——模糊了不同创造形式之间的界限。

从GPT等语言模型开始,生成式人工智能生态系统现在包括图像(MidJourneyDALL-E)、音频(SunoUdio)和视频(Runway)。下一步是将这些模态合并为统一的、直观的平台,在那里讲故事、设计和内容创作变得像想象力本身一样流畅。

同时,Meta的QuestOrion,以及苹果的Vision Pro正在将物理和数字世界与人工智能融合,铺平了增强现实(AR)环境、适应实时输入的沉浸式娱乐环境以及模拟实践实验的虚拟教室等应用的道路。

这都表明应用程序将像我们一样工作:

  • 人工智能电影制作和动画——用文本、口头或视觉方式描述一个场景,人工智能将生成其余的内容,从故事板到最终渲染。
  • 无需编码的游戏创建——使用语音命令、文本提示或视觉参考,使用人工智能在没有游戏引擎专业知识的情况下构建交互式世界。
  • 任何输入的音乐和音效设计——哼唱一首曲子、描述一种氛围或通过文本解释您的想法——人工智能将生成完整的作品。
  • 3D内容和AR创建变得无缝——通过语音、手势或草图生成角色、环境和效果。

技术将真正适应不同的思维和交流风格,同时连接物理和虚拟世界。人工智能工具将不再“专门”从事不同的模态,而是可以无缝地在它们之间切换——重新定义所有形式的娱乐。

人工智能用于健康、无障碍和赋权

多年来,技术都是围绕着僵化的界面构建的——结构化的应用程序、手动输入和系统,要求用户适应它们。人工智能正在通过使健康、健康和决策更加易于理解和直观来颠覆这一点,使其适合所有人。

这可能会有多种形式:

  • 主动的健康教练——人工智能驱动的健康工具,不仅仅是跟踪习惯,还会根据实时能量水平、环境和个人习惯调整建议。适应实时优先级、能量水平和个人习惯的健身计划,根据环境实时优化的条件以获得更好的睡眠,能够识别早期倦怠迹象的压力管理系统。
  • 简化的医疗服务获取——人工智能帮助弥合医疗保健差距,提供实时语言翻译、辅助诊断和使医疗信息更易于理解的个性化健康洞察。用户将获得直接、个性化的指导,基于他们的需求,而不是在复杂的系统之间切换。
  • 为每个学习者量身定制的教育——人工智能驱动的辅导,适应学生的节奏和学习风格,帮助那些有多动症、阅读障碍或其他学习挑战的人以适合他们的方式访问内容。人工智能可以创建个性化的学习环境,根据首选的媒体形式分解复杂的主题,而不是僵化的课程计划。

互联互通将是关键。用户不再需要在多个应用程序、可穿戴设备和仪表板之间切换,而是与一个流畅的智能层进行交互,该层可以跨不同的领域工作。

未来:为我们工作的人工智能

虽然当前的人工智能系统已经非常令人印象深刻,但它们也为技术的未来轨迹奠定了基础。这呈现出一个诱人的未来。随着人工智能进入我们的设备和基础设施成熟,我们将看到创造力和创新力的爆发。

创新不仅仅会来自硅谷。它将来自医院、学校、工作室和车间,来自各个领域解决实际问题的人们。人工智能不仅会提高生产力——它还会扩大人类的潜力。

  • 人们将拥有更多时间用于创造力和自我表达——随着人工智能处理例行任务和降低技能壁垒,更多的人将自由地创造、实验和将想法变为现实。
  • 健康和幸福将得到改善——人工智能驱动的个性化将帮助人们保持健康、管理压力并实时获取专家指导。
  • 技术将变得更加包容——人工智能将适应个人,而不是相反,使工具无论语言、能力还是专业知识如何都可访问。
  • 创造文化将取代被动消费——高质量的讲故事、游戏设计、音乐制作和视觉艺术将不再仅限于那些拥有多年培训或昂贵工具的人。

这不仅仅是关于更好的技术。这是关于人工智能变得像人类经验本身一样多样化。有些工具将专注于无障碍,其他工具将专注于创造力,许多工具将专注于我们尚未确定的挑战。

人工智能的未来不是关于更大的模型或更好的聊天机器人——它是关于使创造力、创新和机会对所有人来说都是可及的。从我们今天的位置来看,这个未来看起来比我们能想象的要有趣得多。

David Merry 是一位三次科技创始人,拥有多次成功的退出经验,并且是 Kinetic Investments 的创始人和总合伙人,Kinetic Investments 是一家专注于早期 B2C AI 项目的全球风险投资公司。凭借在扩大高增长创业公司方面的强大业绩,Kinetic 正在扩大其投资组合,重点支持下一代变革性的 AI 公司。