




资源介绍
视频数量:23个
总时长:1小时59分
课程介绍:
向量数据库入门指南
你有没有想过,当你对着手机说"附近有什么好吃的川菜馆"的时候,手机是怎么理解"好吃"和"川菜"这些模糊的概念,然后准确找到你想要的结果的?或者为什么淘宝总能推荐一些你正想买的东西,抖音的算法怎么知道你想看什么视频?这些看似神奇的体验背后,都离不开一项正在悄然改变人工智能领域的技术——向量数据库。
这门课程会从零开始讲起,带你一步步揭开向量数据库的神秘面纱。不需要你懂线性代数,也不需要你有数据库基础,老师会用最通俗的方式,把这个听起来高大上的概念讲得明明白白。
先从向量说起。我们在中学数学里学过坐标系,知道一个点可以用坐标来表示。向量其实就是这个概念的延伸,只不过维度可以高得多——几百维、几千维都行。关键在于,当文字、图像、声音这些乱七八糟的非结构化数据被转换成高维向量之后,计算机就能用数学方法来比较它们的"距离"和"相似度"了。这就是向量 Embedding 的核心思想。
比如"苹果"这个词,计算机能理解它和"水果"的距离很近,和"手机"的距离稍远一些,和"汽车"就更远了。距离越近的事物,在向量空间里就越相似。这样一来,搜索引擎就不再是简单地匹配关键词,而是真正理解了你在问什么。
接下来的内容会带你深入了解向量数据库到底是什么。简单说,向量数据库是一种专门设计用来存储和检索海量向量的数据库系统,它的核心能力就是在大规模向量中快速找到最相似的结果。相比传统的数据库,向量数据库的拿手好戏是处理语义搜索、相似图片查找、推荐系统这类需要"模糊匹配"的场景。
课程会详细介绍向量数据库的工作流程:从把数据转换成向量存入数据库,到用户输入查询时将查询也转换成向量,再到数据库内部通过各种相似度计算方法找出最匹配的结果。这个过程听起来复杂,但老师会拆解成几个清晰的步骤,配合具体的例子让你搞懂每一步在做什么。
学完这部分内容,你会理解向量数据库和传统关系型数据库的根本区别,知道向量搜索和普通关键词搜索本质上有何不同,还会对市面上常见的向量数据库有个基本认识。
课程的亮点在于会展示向量数据库在真实世界中的五大应用场景。第一个是语义搜索,Google 搜索能理解"把水烧到100度"其实是在问"水的沸点",背后靠的就是向量技术。第二个是推荐系统,抖音和淘宝的个性化推荐之所以精准,是因为它们把你的行为和偏好都转换成了向量,然后从海量内容里找出和你最"像"的那些。第三个是检索增强生成,这两年火遍全球的大语言模型离不开这项技术,简单说就是让 AI 在回答问题之前,先从外部知识库里找到相关的参考资料,这样可以减少胡说八道、提高答案的准确性。第四个是异常检测,银行用来识别信用卡盗刷、网络安全公司用来发现入侵行为,用的都是这个思路。第五个是视觉搜索,淘宝的拍照购物功能就是典型例子,你拍一张照片,系统找出外观相似的东西推荐给你。
整个课程分成四个部分循序渐进,从基础概念到实际应用,逻辑清晰、节奏紧凑。每个知识点都配有具体的应用场景说明,帮助你理解这项技术到底在解决什么问题。全部学完之后,你会对向量和向量数据库的核心概念了然于胸,理解这些技术如何驱动现代人工智能的各种应用,也有能力去评估和选择适合自己需求的向量数据库。
如果你是对人工智能感兴趣的技术爱好者,或者是在工作中需要了解 AI 相关知识的从业者,这门课会是个不错的起点。即使你不打算写代码,也能通过这门课理解为什么现在的搜索引擎和推荐系统变得越来越"懂你",为以后在 AI 领域的深入学习打下基础。