Transformer架构:大模型背后的“大脑”
通俗类比:Transformer = 多线程处理语言。解析 Self-Attention,展示图解,避免过于枯燥的数学公式。
作者:帅旋
|
发表于 2025-03-07
|
分类于  AI
Transformer架构:大模型背后的“大脑”
大模型的进化史:从BERT到DeepSeek R1
在上一篇文章《自然语言处理(NLP)与生成式AI:机器如何“理解”人类语言?》中,我们系统梳理了NLP技术从规则系统到Transformer架构的范式迁移。本文将从技术演进视角,解析大语言模型(LLM)如何通过算法创新与工程突破实现能力跃迁。
作者:帅旋
|
发表于 2025-03-01
|
分类于  AI
大模型的进化史:从BERT到DeepSeek R1
自然语言处理(NLP)与生成式AI:机器如何“理解”人类语言?
在上一篇文章《AI是什么?从科幻到现实的ChatGPT》中,我们系统梳理了生成式AI的代表性技术——GPT系列模型的演进历程,从ELIZA的规则引擎到GPT-4的多模态突破,揭示了ChatGPT如何通过人类反馈强化学习(RLHF)**和**超大规模预训练实现对话能力的质变。ChatGPT是OpenAI开发的一个大型语言模型,能够生成连贯且符合上下文的文本,广泛应用于对话生成、文本摘要等任务。
作者:帅旋
|
发表于 2025-02-23
|
分类于  AI
自然语言处理(NLP)与生成式AI:机器如何“理解”人类语言?
AI是什么?从科幻到现实的ChatGPT
人工智能(Artificial Intelligence, AI) 是一门研究如何让机器模拟、延伸和扩展人类智能的技术科学。其核心目标是使机器具备感知、推理、学习、决策等能力,甚至能完成创造性任务。
作者:帅旋
|
发表于 2025-02-22
|
分类于  AI
AI是什么?从科幻到现实的ChatGPT
学不会的面向对象存储:为什么你写的CRUD代码像史山?
如何通过实现面向对象的存储?对比传统宽表设计可知,MongoDB可以利用灵活的文档模型实现多态存储,不同于关系型数据库中将大量字段混合在一张表中造成的数据冗余和复杂性。
作者:帅旋
|
发表于 2025-02-09
|
分类于  微服务
学不会的面向对象存储:为什么你写的CRUD代码像史山?
多模态AI:ChatGPT何时能看懂图片和视频?
从单一文本到多模态理解,探索AI如何像人类一样同时处理文字、图片、音频和视频,以及这项技术将如何改变我们的工作和生活。
作者:arthinking
|
发表于 2024-12-20
|
分类于  AI 理论篇
多模态AI:ChatGPT何时能看懂图片和视频?
咋回事?25%的CPU占用竟然把服务干趴了?
揭秘:为什么四分之一的 CPU 占用也能拖垮服务?
作者:arthinking
|
发表于 2024-10-13
|
分类于  JVM
咋回事?25%的CPU占用竟然把服务干趴了?
一个Java对象占用多少内存?
基于前面我们介绍的JVM对象内存布局,可以知道,一个对象占用的内存大小受操作系统和是否开启压缩指针的影响。为了方便推算对象的占用内存大小,帅旋画了一般比较直观的图:
作者:帅旋
|
发表于 2024-09-19
|
分类于  JVM
一个Java对象占用多少内存?
开启指针压缩为什么还能支持32G内存寻址?
大家好,我是帅旋,今天来聊聊压缩指针的问题。
作者:帅旋
|
发表于 2024-09-19
|
分类于  JVM
开启指针压缩为什么还能支持32G内存寻址?
为什么Mark Word中的指针是30位?
在Java虚拟机(JVM)中,特别是在HotSpot实现里,对象头的Mark Word部分用于存储多种数据,其中包括锁信息、哈希码、GC年龄等。当对象被锁定时,例如在轻量级锁定状态下,Mark Word中会包含一个指针,指向线程栈上的锁记录(Lock Record)。这种指针不需要使用完整的32位来表示。
作者:帅旋
|
发表于 2024-09-19
|
分类于  JVM
为什么Mark Word中的指针是30位?
12345672
×
Java架构杂谈

订阅及时获取网站内容更新。

充电

当前电量:100%

Java架构杂谈

订阅我,及时获取网站内容更新。