Ultralytics YOLO27:
返回 Ultralytics 术语表

Language Modeling

探索语言建模的基础知识及其在 NLP 中的作用。了解 Ultralytics YOLO26 和多模态 AI 如何弥合文本与视觉之间的鸿沟。

语言建模是用于训练计算机理解、生成和预测人类语言的核心统计技术。从最根本的层面来看,语言模型会确定特定词语序列出现在句子中的概率。这项能力是整个自然语言处理 (NLP)领域的基础,使机器能够超越简单的关键词匹配,理解上下文、语法和意图。通过分析大量的训练数据,这些系统能够学习词语通常彼此跟随出现的统计可能性,从而构建连贯的句子,或在语音识别任务中解析含义模糊的音频。

机制与演进#

语言建模的历史追溯了人工智能 (AI)本身的发展历程。早期的实现依赖于“n-gram”,即根据某个词前面紧邻的 $n$ 个词,简单计算该词出现的统计概率。然而,现代方法利用深度学习 (DL)来捕捉更复杂的关系。

当代模型利用嵌入将词语转换为高维向量,使系统能够理解“king”和“queen”在语义上具有关联性。这一演进最终促成了Transformer架构的诞生,该架构利用自注意力机制并行处理完整的文本序列。这样,模型无论词语在段落中相距多远,都能衡量它们的重要性,这对于在长篇文本生成中保持上下文至关重要。

实际应用#

语言建模已经从学术研究发展为一种支撑各行业日常数字化交互的基础能力:

  • 机器翻译 Google Translate等服务使用先进的序列到序列模型,将文本从一种语言转换为另一种语言。模型会根据源语言序列预测目标语言序列的概率,从而确保语法准确性。
  • 智能编程助手: GitHub Copilot等工具充当经过代码仓库训练的专用语言模型。它们能够预测语法和逻辑,自动补全代码块,从而显著加快软件开发速度。
  • 预测文本与自动更正: 在移动设备上,轻量级模型会在本地执行推理,为消息建议下一个词,并随着时间推移适应用户特定的输入风格。
  • 视觉与语言集成:计算机视觉 (CV)领域,语言模型会与视觉编码器配合使用。这使“开放词汇”检测成为可能,用户可以使用自然语言描述搜索对象,而不必局限于预先定义的类别。

连接文本与视觉#

虽然语言建模主要处理文本,但其原理正越来越多地应用于多模态 AIYOLO-World等模型集成了语言能力,使用户能够利用文本提示动态定义检测类别。搜索新对象时,无需重新训练模型。

以下Python代码片段演示了如何使用 ultralytics 包,利用语言描述执行目标检测:

from ultralytics import YOLOWorld

# Load a model capable of understanding natural language prompts
model = YOLOWorld("yolov8s-world.pt")

# Define custom classes using text descriptions via the language model encoder
# The model uses internal embeddings to map 'text' to 'visual features'
model.set_classes(["person in red shirt", "blue car"])

# Run inference to detect these specific text-defined objects
results = model.predict("street_scene.jpg")

# Display the results
results[0].show()

区分相关概念#

区分语言建模与经常被交替使用的相关术语很有帮助:

  • **语言建模与大型语言模型 (LLMs)的区别:**语言建模是基础性的任务或数学技术。LLM(例如 GPT 系列)是为执行此任务而设计的模型的特定大型实例,使用 PB 级数据进行训练,并拥有数十亿个参数。
  • **语言建模与生成式 AI的区别:**生成式 AI 是一个广泛的类别,涵盖任何能够创建新内容(图像、音频、代码)的 AI。语言建模是生成式 AI 中文本生成子集得以实现的具体机制。
  • 语言建模与目标检测的区别:YOLO26等传统检测模型使用固定的视觉标签进行训练。语言模型处理文本中的序列概率。不过,CLIP等技术通过学习将视觉概念与语言描述关联起来,弥合了这一差距。

挑战与未来展望#

尽管语言模型很有用,但它们仍面临AI 中的偏见等挑战,因为它们可能会无意中再现训练数据集中的偏见。此外,训练这些模型需要大量计算资源。Ultralytics Platform等解决方案有助于简化数据集和训练工作流的管理,从而更轻松地针对特定应用微调模型。未来的研究重点是通过模型量化提高这些模型的效率,使强大的语言理解能力能够直接运行在边缘 AI设备上,而无需依赖云连接。

Explore solutions

用于航拍影像的计算机视觉

用于航拍影像的计算机视觉

使用 Ultralytics YOLO 将无人机和航拍影像转化为针对农业、水产养殖、环境监测、自然保护及地理空间分析的实时洞察。
了解更多
航空航天中的计算机视觉

航空航天中的计算机视觉

借助 Ultralytics YOLO 模型将视觉 AI 引入空中监测。使用计算机视觉解决方案赋能无人机、航空航天工作流、环境保护与地理空间行业。
了解更多

使用 Ultralytics YOLO 模型保护每个站点。视觉 AI 赋能周界监控、威胁检测、车牌识别和工作场所安全。
了解更多
机器人计算机视觉

机器人计算机视觉

借助 Ultralytics YOLO 模型打造更智能的机器。机器人技术中的视觉 AI 可实现自主导航、感知、目标跟踪和实时控制。
了解更多
物流计算机视觉

物流计算机视觉

使用 Ultralytics YOLO 模型提升物流效率。视觉 AI 可实现包裹检测、分拣、车辆跟踪和仓库安全实时监控。
了解更多
零售计算机视觉

零售计算机视觉

使用 Ultralytics YOLO 模型重新构想零售。视觉 AI 为库存跟踪、货架监控、队列管理和更智能的客户洞察提供支持。
了解更多
医疗领域的计算机视觉

医疗领域的计算机视觉

使用 Ultralytics YOLO 模型构建医疗解决方案。医疗领域的视觉 AI 可实现更快的医学影像处理、更智能的诊断和患者监护。
了解更多
制造业中的计算机视觉

制造业中的计算机视觉

使用 Ultralytics YOLO 模型优化制造业。视觉 AI 可推动质量控制、缺陷检测、PPE 合规和装配线自动化。
了解更多
汽车行业中的计算机视觉

汽车行业中的计算机视觉

使用 Ultralytics YOLO 模型在汽车行业应用计算机视觉。视觉 AI 提升道路安全、驾驶辅助和车辆自动化水平,让道路更加智能。
了解更多
农业中的计算机视觉

农业中的计算机视觉

使用 Ultralytics YOLO 模型将视觉 AI 带入智能农业。为作物监测、牲畜追踪和精准农业提供支持,提升产量与智能化水平。
了解更多
用于航拍影像的计算机视觉

用于航拍影像的计算机视觉

使用 Ultralytics YOLO 将无人机和航拍影像转化为针对农业、水产养殖、环境监测、自然保护及地理空间分析的实时洞察。
了解更多
航空航天中的计算机视觉

航空航天中的计算机视觉

借助 Ultralytics YOLO 模型将视觉 AI 引入空中监测。使用计算机视觉解决方案赋能无人机、航空航天工作流、环境保护与地理空间行业。
了解更多

使用 Ultralytics YOLO 模型保护每个站点。视觉 AI 赋能周界监控、威胁检测、车牌识别和工作场所安全。
了解更多
机器人计算机视觉

机器人计算机视觉

借助 Ultralytics YOLO 模型打造更智能的机器。机器人技术中的视觉 AI 可实现自主导航、感知、目标跟踪和实时控制。
了解更多
物流计算机视觉

物流计算机视觉

使用 Ultralytics YOLO 模型提升物流效率。视觉 AI 可实现包裹检测、分拣、车辆跟踪和仓库安全实时监控。
了解更多
零售计算机视觉

零售计算机视觉

使用 Ultralytics YOLO 模型重新构想零售。视觉 AI 为库存跟踪、货架监控、队列管理和更智能的客户洞察提供支持。
了解更多
医疗领域的计算机视觉

医疗领域的计算机视觉

使用 Ultralytics YOLO 模型构建医疗解决方案。医疗领域的视觉 AI 可实现更快的医学影像处理、更智能的诊断和患者监护。
了解更多
制造业中的计算机视觉

制造业中的计算机视觉

使用 Ultralytics YOLO 模型优化制造业。视觉 AI 可推动质量控制、缺陷检测、PPE 合规和装配线自动化。
了解更多
汽车行业中的计算机视觉

汽车行业中的计算机视觉

使用 Ultralytics YOLO 模型在汽车行业应用计算机视觉。视觉 AI 提升道路安全、驾驶辅助和车辆自动化水平,让道路更加智能。
了解更多
农业中的计算机视觉

农业中的计算机视觉

使用 Ultralytics YOLO 模型将视觉 AI 带入智能农业。为作物监测、牲畜追踪和精准农业提供支持,提升产量与智能化水平。
了解更多
用于航拍影像的计算机视觉

用于航拍影像的计算机视觉

使用 Ultralytics YOLO 将无人机和航拍影像转化为针对农业、水产养殖、环境监测、自然保护及地理空间分析的实时洞察。
了解更多
航空航天中的计算机视觉

航空航天中的计算机视觉

借助 Ultralytics YOLO 模型将视觉 AI 引入空中监测。使用计算机视觉解决方案赋能无人机、航空航天工作流、环境保护与地理空间行业。
了解更多

使用 Ultralytics YOLO 模型保护每个站点。视觉 AI 赋能周界监控、威胁检测、车牌识别和工作场所安全。
了解更多
机器人计算机视觉

机器人计算机视觉

借助 Ultralytics YOLO 模型打造更智能的机器。机器人技术中的视觉 AI 可实现自主导航、感知、目标跟踪和实时控制。
了解更多
物流计算机视觉

物流计算机视觉

使用 Ultralytics YOLO 模型提升物流效率。视觉 AI 可实现包裹检测、分拣、车辆跟踪和仓库安全实时监控。
了解更多
零售计算机视觉

零售计算机视觉

使用 Ultralytics YOLO 模型重新构想零售。视觉 AI 为库存跟踪、货架监控、队列管理和更智能的客户洞察提供支持。
了解更多
医疗领域的计算机视觉

医疗领域的计算机视觉

使用 Ultralytics YOLO 模型构建医疗解决方案。医疗领域的视觉 AI 可实现更快的医学影像处理、更智能的诊断和患者监护。
了解更多
制造业中的计算机视觉

制造业中的计算机视觉

使用 Ultralytics YOLO 模型优化制造业。视觉 AI 可推动质量控制、缺陷检测、PPE 合规和装配线自动化。
了解更多
汽车行业中的计算机视觉

汽车行业中的计算机视觉

使用 Ultralytics YOLO 模型在汽车行业应用计算机视觉。视觉 AI 提升道路安全、驾驶辅助和车辆自动化水平,让道路更加智能。
了解更多
农业中的计算机视觉

农业中的计算机视觉

使用 Ultralytics YOLO 模型将视觉 AI 带入智能农业。为作物监测、牲畜追踪和精准农业提供支持,提升产量与智能化水平。
了解更多

让我们共同构建 AI 的未来!

开启你的机器学习未来之旅