
AI技术
大模型基础:读懂 AI 背后的大脑
虾
虾345编辑部大模型基础:读懂 AI 背后的大脑
什么是大语言模型(LLM)?
大语言模型,英文叫 Large Language Model,简称 LLM。它是一种通过海量文本数据训练出来的 AI 模型,能够理解和生成自然语言。
它是怎么工作的?
简单来说,LLM 学习了大量人类写的文字,学会了"下一个词最可能是什么"这个核心任务。经过这种训练,它不只是在背诵,而是真正理解了语言的结构和语义。
常见的大模型有哪些?
- GPT-4o(OpenAI):目前最广泛使用的模型之一
- Claude(Anthropic):以安全性和长文本处理见长
- Gemini(Google):谷歌出品,多模态能力强
- 文心一言(百度):国内主流选择之一
- 通义千问(阿里):中文能力优秀
Token 是什么?
Token 是模型处理文本的基本单位,大致相当于半个单词或一两个汉字。模型有"上下文长度"限制,就是一次能处理的 Token 数量上限。
评论 (0)
还没有评论,来发第一条吧