AI 模型如何工作
来聊聊 AI 模型是如何运作的。
你可以把它们理解为超智能的通用 API 端点。就像你会集成 Stripe API 来处理支付,或用 Twilio 发送短信一样,你可以调用 AI 模型来完成各类任务。
最大的区别在于:你无法保证每次都得到相同的结果。
确定性 vs. 概率性
传统软件是确定性的。给定某个输入,如果你再次运行程序,就会得到相同的输出。开发者已经显式编写了代码来处理这条既定路径。
AI 模型并非如此。它们是概率性的。这意味着在相同输入下,模型可能会走许多不同的路径。
你的 AI 心智模型中的第一点是:永远不要假设你每次都一定会得到相同的答案。
当 AI 模型决定选择一条路径时,它是如何确定输出什么内容的?在底层,这些模型基于两件事来预测接下来要响应的下一段文本:
- 模型“训练”时所基于的信息
- 你作为输入提供给模型的内容,称为“提示”
给定类似“生命的意义是什么?请用一个词回答”的提示,模型会预测接下来要显示的下一个词。这有两个重要含义:
- 相同的模型和提示可能会对相同的问题给出不同的回答
- 模型并不总是会遵循你的指令,包括只回答一个词的限制
哪一种说法最能描述 AI 模型的响应?
选择模型
该用哪个模型?
AI 模型在智能水平、响应速度、成本和专长领域各不相同。有些模型又快又便宜,但难以解决需要更深入思考的技术问题。
另一些模型更慢也更昂贵,但在任务更复杂时,它们能“思考”更久,持续推进问题解决。
终极目标是既足够聪明、又极其快速、还十分实惠的模型。这个模型今天是否存在,取决于你的使用场景。
在构建软件方面,当前模型已能胜任多种编码任务。
几乎每月都有新模型发布,AI 的前沿水平在不断被重塑。这意味着未来你将看到更智能的模型,更好地完成构建软件所需的编码、规划等任务。
模态
你也可以通过不同方式与模型交互,即“模态”。例如,在聊天机器人中输入文本、生成图像、与虚拟 AI 对话,甚至根据提示生成视频。
模型质量在快速提升,因此关注最新的模型发布很重要。比如,几年前的视频生成模型还不够理想,如今已相当逼真。
在构建软件时,不同模态的使用可能包括:
- 用文本描述要构建的产品或功能,与 AI 协作制定计划
- 用图像分享要构建的 UI 线框或设计,或在间距、颜色不合适时向 AI 模型反馈
- 用语音将你的口述转成 AI 模型的输入,免去手动输入冗长或详细指令
在讨论如何高效使用 AI 模型之前,先了解其局限性会更有帮助。让我们在下一课中进一步探讨。