GPT-4o与SQL:大模型改变自身架构的能力有多强?

2024-06-08 12:52

本文主要是介绍GPT-4o与SQL:大模型改变自身架构的能力有多强?,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

尽管没有任何大型语言模型(LLM)骑过自行车,但它们显然理解骑行在人类交通领域中的作用。它们似乎为软件开发者提供的是一种类似语义的现实世界知识,结合了对技术世界的理解。我们在最近的一篇文章中清楚地看到了这一点,仅通过用自然语言描述,我们就能够生成一个简单的图书出版SQL架构。

虽然我对Llama 3创建架构的性能感到满意,但我之前在Oracle工作时期的一位同事指出,图书出版架构是一个相当为人熟知的例子。为了便于理解,这自然是件好事,但为了进一步拓展LLM的能力,本文中我将探索大型语言模型根据英语描述的问题调整其自身架构的能力如何。这一次,我将使用OpenAI的GPT-4o,因为它最近在代码审查方面为我提供了很好的帮助。

作为出发点,我们将从与第一篇文章中相同的问题开始,并总结答案,这个答案与上次相似。这一次,GPT-4o不仅为我们提供了一个ERD(实体关系图),还很好地解释了各实体间的关系:

图片

和之前的尝试类似,它提出了以下这样的架构:

CREATE TABLE Author ( author_id INT AUTO_INCREMENT PRIMARY KEY, first_name VARCHAR(50), last_name VARCHAR(50), birth_date DATE, nationality VARCHAR(50) 
); CREATE TABLE Publisher ( publisher_id INT AUTO_INCREMENT PRIMARY KEY, name VARCHAR(100), address VARCHAR(255), contact_number VARCHAR(20), email VARCHAR(100) 
); CREATE TABLE Book ( book_id INT AUTO_INCREMENT PRIMARY KEY, title VARCHAR(100), genre VARCHAR(50), publication_date DATE, isbn VARCHAR(20) UNIQUE, author_id INT, publisher_id INT, FOREIGN KEY (author_id) REFERENCES Author(author_id), FOREIGN KEY (publisher_id) REFERENCES Publisher(publisher_id) 
);

我更倾向于让表名使用所包含对象的复数形式,我认为这是被广泛接受的标准。

大型语言模型指出了这些关系限制:

图片

因此,使用上次相同的示例数据,让我们在SQL沙盒环境DB Fiddle中检查是否能得到相同的结果。如果我们填充这些数据并添加上次的视图……

INSERT INTO Author (first_name, last_name, birth_date) 
VALUES ('Iain', 'Banks', '1954-02-16'); INSERT INTO Author (first_name, last_name, birth_date) 
VALUES ('Iain', 'M Banks', '1954-02-16'); INSERT INTO Publisher (name, address) 
VALUES ('Abacus', 'London'); INSERT INTO Publisher (name, address) 
VALUES ('Orbit', 'New York');INSERT INTO Book (title, author_id, publisher_id, publication_date)
VALUES ('Consider Phlebas', 2, 2, '1988-04-14');INSERT INTO Book (title, author_id, publisher_id, publication_date)
VALUES ('The Wasp Factory', 1, 1, '1984-02-15');CREATE VIEW ViewableBooks AS
SELECT Book.title 'Book', Author.first_name 'Author firstname', Author.last_name 'Author surname', Publisher.name 'Publisher', Book.publication_date
FROM Book, Publisher, Author
WHERE Book.author_id = Author.author_id
AND Book.publisher_id = Publisher.publisher_id;

我们就能在下方的表格中从DB Fiddle获得所需的结果视图:

图片

第二个姓氏中包含了中间名“M”,看起来有些别扭。接下来,我们将探讨与此相关的问题。

1.首次修改

正如我在前一篇关于SQL生成的文章中提到的,“Ian Banks”和“Ian M Banks”实际上是同一位作者。上次,我们没有解决这个笔名问题。所以,让我们要求大模型来修复这个问题:

图片

所以这是个好的开始。这次它需要将“笔名”这一文学概念映射到它已经产生的现有架构设计上。因此,它不仅要发现现有的解决方案,还必须做更多的工作。首先,我们来看看新建立的关系:

图片

这看起来是合理的。以下是经过修改的新表结构:

CREATE TABLE Pseudonym ( pseudonym_id INT AUTO_INCREMENT PRIMARY KEY, pseudonym VARCHAR(100), author_id INT, FOREIGN KEY (author_id) REFERENCES Author(author_id) 
); CREATE TABLE Book ( book_id INT AUTO_INCREMENT PRIMARY KEY, title VARCHAR(100), genre VARCHAR(50), publication_date DATE, isbn VARCHAR(20) UNIQUE, pseudonym_id INT, publisher_id INT, FOREIGN KEY (pseudonym_id) REFERENCES Pseudonym(pseudonym_id), FOREIGN KEY (publisher_id) REFERENCES Publisher(publisher_id) 
);

这感觉也是正确的。架构现在将书籍关联到笔名,而不是直接关联到作者。让我们使用新的架构重新做一个dbfiddle,输入经过修改的数据以配合使用,并查看我们是否能再次获得理想的结果:

图片

实际上,现在笔名栏只是一个字段,表格显得更加整洁了。

2.另一个修改请求

现在,我将提出进一步的架构修改要求。我们知道一本书可以有多个作者(你可能还记得上次Llama 3在没有提示的情况下就提出了这一点),所以我们希望GPT-4o再次修改其架构。

图片

需要增加的那一个新表就是:

CREATE TABLE BookAuthor 
( book_id INT, pseudonym_id INT, PRIMARY KEY (book_id, pseudonym_id), FOREIGN KEY (book_id) REFERENCES Book(book_id), FOREIGN KEY (pseudonym_id) REFERENCES Pseudonym(pseudonym_id) 
);

因此,关系变更如下:

图片

(注意,在描述了最初几段关系后出现了奇怪的括号错误。这个错误在所有关系的描述中都有重复出现。它似乎阻止了文本“1:M”或“M:M”的打印——可能是由于表情符号混淆?)

当然,GPT-4o也在遵循单一的对话线索——它将其先前的工作内容纳入了上下文考虑。这种广受赞誉的能力确实使得与它的交互更加自然。总体而言,它表现得很好(并且非常迅速)地解析了我们的英语描述,以调整其建议的架构。

3.在我们太过兴奋之前

架构主要关乎事物之间的关系——并不需要对事物本身的深入了解。然而,这并不完全意味着大模型接管数据库设计的道路已经畅通无阻。

针对SQL查询和架构进行优化一直都有点儿像一门艺术。需要理解哪些常见查询会最适合某种设计、将涉及多少张表、查询间的依赖性、索引定义、分区等等。而这还只是在处理CAP定理困境——一致性与可用性之间的权衡——之前。在这些技术抽象之下,是人们对数据检索远非简单的预期。

我相信,随着时间的推移,大型语言模型与专业化的某种结合将逐步解决这些工程问题,但目前我们应该为GPT-4o能够高效地生成和修改合理架构的能力而感到胜利。

这篇关于GPT-4o与SQL:大模型改变自身架构的能力有多强?的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1042244

相关文章

一文详解MySQL如何设置自动备份任务

《一文详解MySQL如何设置自动备份任务》设置自动备份任务可以确保你的数据库定期备份,防止数据丢失,下面我们就来详细介绍一下如何使用Bash脚本和Cron任务在Linux系统上设置MySQL数据库的自... 目录1. 编写备份脚本1.1 创建并编辑备份脚本1.2 给予脚本执行权限2. 设置 Cron 任务2

SQL Server修改数据库名及物理数据文件名操作步骤

《SQLServer修改数据库名及物理数据文件名操作步骤》在SQLServer中重命名数据库是一个常见的操作,但需要确保用户具有足够的权限来执行此操作,:本文主要介绍SQLServer修改数据... 目录一、背景介绍二、操作步骤2.1 设置为单用户模式(断开连接)2.2 修改数据库名称2.3 查找逻辑文件名

SQL Server数据库死锁处理超详细攻略

《SQLServer数据库死锁处理超详细攻略》SQLServer作为主流数据库管理系统,在高并发场景下可能面临死锁问题,影响系统性能和稳定性,这篇文章主要给大家介绍了关于SQLServer数据库死... 目录一、引言二、查询 Sqlserver 中造成死锁的 SPID三、用内置函数查询执行信息1. sp_w

canal实现mysql数据同步的详细过程

《canal实现mysql数据同步的详细过程》:本文主要介绍canal实现mysql数据同步的详细过程,本文通过实例图文相结合给大家介绍的非常详细,对大家的学习或工作具有一定的参考借鉴价值,需要的... 目录1、canal下载2、mysql同步用户创建和授权3、canal admin安装和启动4、canal

SQL中JOIN操作的条件使用总结与实践

《SQL中JOIN操作的条件使用总结与实践》在SQL查询中,JOIN操作是多表关联的核心工具,本文将从原理,场景和最佳实践三个方面总结JOIN条件的使用规则,希望可以帮助开发者精准控制查询逻辑... 目录一、ON与WHERE的本质区别二、场景化条件使用规则三、最佳实践建议1.优先使用ON条件2.WHERE用

MySQL存储过程之循环遍历查询的结果集详解

《MySQL存储过程之循环遍历查询的结果集详解》:本文主要介绍MySQL存储过程之循环遍历查询的结果集,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录前言1. 表结构2. 存储过程3. 关于存储过程的SQL补充总结前言近来碰到这样一个问题:在生产上导入的数据发现

MySQL 衍生表(Derived Tables)的使用

《MySQL衍生表(DerivedTables)的使用》本文主要介绍了MySQL衍生表(DerivedTables)的使用,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学... 目录一、衍生表简介1.1 衍生表基本用法1.2 自定义列名1.3 衍生表的局限在SQL的查询语句select

MySQL 横向衍生表(Lateral Derived Tables)的实现

《MySQL横向衍生表(LateralDerivedTables)的实现》横向衍生表适用于在需要通过子查询获取中间结果集的场景,相对于普通衍生表,横向衍生表可以引用在其之前出现过的表名,本文就来... 目录一、横向衍生表用法示例1.1 用法示例1.2 使用建议前面我们介绍过mysql中的衍生表(From子句

六个案例搞懂mysql间隙锁

《六个案例搞懂mysql间隙锁》MySQL中的间隙是指索引中两个索引键之间的空间,间隙锁用于防止范围查询期间的幻读,本文主要介绍了六个案例搞懂mysql间隙锁,具有一定的参考价值,感兴趣的可以了解一下... 目录概念解释间隙锁详解间隙锁触发条件间隙锁加锁规则案例演示案例一:唯一索引等值锁定存在的数据案例二:

MySQL JSON 查询中的对象与数组技巧及查询示例

《MySQLJSON查询中的对象与数组技巧及查询示例》MySQL中JSON对象和JSON数组查询的详细介绍及带有WHERE条件的查询示例,本文给大家介绍的非常详细,mysqljson查询示例相关知... 目录jsON 对象查询1. JSON_CONTAINS2. JSON_EXTRACT3. JSON_TA