首页AI介绍正文

openai和pytorch pytorch中文手册

AI介绍2026-06-24351

如何评价PyTorch

明敏发自凹非寺

量子位报道|公众号 QbitAI

到底是怎样的一个bug，能让95%的Pytorch库中招，就连特斯拉AI总监深受困扰？

还别说，这个bug虽小，但有够“狡猾”的。

这就是最近Reddit上热议的一个话题，是一位网友在使用再平常不过的Pytorch+Numpy组合时发现。

最主要的是，在代码能够跑通的情况下，它甚至还会影响模型的准确率！

除此之外，网友热议的另外一个点，竟然是：

而是它到底算不算一个bug？

这究竟是怎么一回事？

事情的起因是一位网友发现，在PyTorch中用NumPy来生成随机数时，受到数据预处理的限制，会多进程并行加载数据，但最后每个进程返回的随机数却是相同的。

他还举出例子证实了自己的说法。

如下是一个示例数据集，它会返回三个元素的随机向量。这里采用的批量大小分别为2，工作进程为4个。

然后神奇的事情发生了：每个进程返回的随机数都是一样的。

这个结果会着实让人有点一头雾水，就好像数学应用题求小明走一段路程需要花费多少时间，而你却算出来了负数。

发现了问题后，这位网友还在GitHub上下载了超过10万个PyTorch库，用同样的方法产生随机数。

结果更加令人震惊：居然有超过95%的库都受到这个问题的困扰！

这其中不乏PyTorch的官方教程和OpenAI的代码，连特斯拉AI总监Karpathy也承认自己“被坑过”！

但有一说一，这个bug想要解决也不难：只需要在每个epoch都重新设置seed，或者用python内置的随机数生成器就可以避免这个问题。

到底是不是bug？

如果这个问题已经可以解决，为什么还会引起如此大的讨论呢？

因为网友们的重点已经上升到了“哲学”层面：

这到底是不是一个bug？

在Reddit上有人认为：这不是一个bug。

虽然这个问题非常常见，但它并不算是一个bug，而是一个在调试时不可以忽略的点。

就是这个观点，激起了千层浪花，许多人都认为他忽略了问题的关键所在。

这不是产生伪随机数的问题，也不是numpy的问题，问题的核心是在于PyTorch中的DataLoader的实现

对于包含随机转换的数据加载pipeline，这意味着每个worker都将选择“相同”的转换。而现在NN中的许多数据加载pipeline，都使用某种类型的随机转换来进行数据增强，所以不重新初始化可能是一个预设。

另一位网友也表示这个bug其实是在预设程序下运行才出现的，应该向更多用户指出来。

并且95%以上的Pytorch库受此困扰，也绝不是危言耸听。

有人就分享出了自己此前的惨痛经历：

我认识到这一点是之前跑了许多进程来创建数据集时，然而发现其中一半的数据是重复的，之后花了很长的时间才发现哪里出了问题。

也有用户补充说，如果 95%以上的用户使用时出现错误，那么代码就是错的。

顺便一提，这提供了Karpathy定律的另一个例子：即使你搞砸了一些非常基本代码，“neural nets want to work”。

你有踩过PyTorch的坑吗？

如上的bug并不是偶然，随着用PyTorch的人越来越多，被发现的bug也就越来越多，某乎上还有PyTorch的坑之总结，被浏览量高达49w。

其中从向量、函数到model.train()，无论是真bug还是自己出了bug，大家的血泪史还真的是各有千秋。

所以，关于PyTorch你可以分享的经验血泪史吗？

欢迎评论区留言讨论～

参考链接：

[1]

[2]

[3]

—完—

为什么说PyTorch是个bug库

明敏发自凹非寺

量子位报道|公众号 QbitAI

到底是怎样的一个bug，能让95%的Pytorch库中招，就连特斯拉AI总监深受困扰？

还别说，这个bug虽小，但有够“狡猾”的。

这就是最近Reddit上热议的一个话题，是一位网友在使用再平常不过的Pytorch+Numpy组合时发现。

最主要的是，在代码能够跑通的情况下，它甚至还会影响模型的准确率！

除此之外，网友热议的另外一个点，竟然是：

而是它到底算不算一个bug？

这究竟是怎么一回事？

他还举出例子证实了自己的说法。

如下是一个示例数据集，它会返回三个元素的随机向量。这里采用的批量大小分别为2，工作进程为4个。

然后神奇的事情发生了：每个进程返回的随机数都是一样的。

这个结果会着实让人有点一头雾水，就好像数学应用题求小明走一段路程需要花费多少时间，而你却算出来了负数。

发现了问题后，这位网友还在GitHub上下载了超过10万个PyTorch库，用同样的方法产生随机数。

结果更加令人震惊：居然有超过95%的库都受到这个问题的困扰！

这其中不乏PyTorch的官方教程和OpenAI的代码，连特斯拉AI总监Karpathy也承认自己“被坑过”！

但有一说一，这个bug想要解决也不难：只需要在每个epoch都重新设置seed，或者用python内置的随机数生成器就可以避免这个问题。

到底是不是bug？

如果这个问题已经可以解决，为什么还会引起如此大的讨论呢？

因为网友们的重点已经上升到了“哲学”层面：

这到底是不是一个bug？

在Reddit上有人认为：这不是一个bug。

虽然这个问题非常常见，但它并不算是一个bug，而是一个在调试时不可以忽略的点。

就是这个观点，激起了千层浪花，许多人都认为他忽略了问题的关键所在。

这不是产生伪随机数的问题，也不是numpy的问题，问题的核心是在于PyTorch中的DataLoader的实现

另一位网友也表示这个bug其实是在预设程序下运行才出现的，应该向更多用户指出来。

并且95%以上的Pytorch库受此困扰，也绝不是危言耸听。

有人就分享出了自己此前的惨痛经历：

我认识到这一点是之前跑了许多进程来创建数据集时，然而发现其中一半的数据是重复的，之后花了很长的时间才发现哪里出了问题。

也有用户补充说，如果 95%以上的用户使用时出现错误，那么代码就是错的。

顺便一提，这提供了Karpathy定律的另一个例子：即使你搞砸了一些非常基本代码，“neural nets want to work”。

你有踩过PyTorch的坑吗？

如上的bug并不是偶然，随着用PyTorch的人越来越多，被发现的bug也就越来越多，某乎上还有PyTorch的坑之总结，被浏览量高达49w。

其中从向量、函数到model.train()，无论是真bug还是自己出了bug，大家的血泪史还真的是各有千秋。

所以，关于PyTorch你可以分享的经验血泪史吗？

欢迎评论区留言讨论～

参考链接：

[1]

[2]

[3]

—完—

openai的代码是什么语言

OpenAI的代码涉及多种编程语言，主要包括TypeScript、Node.js、Rust和Python。以下是对其不同部分代码所用语言的详细介绍：

AI编程工具相关OpenAI的AI编程工具Codex CLI原版本主要基于TypeScript和Node.js。TypeScript是JavaScript的超集，它在JavaScript的基础上添加了静态类型系统，能够提供更好的代码可维护性和开发体验，尤其适合大型项目的开发。Node.js则是一个基于Chrome V8引擎的JavaScript运行时环境，它使得JavaScript可以运行在服务器端，用于构建快速、可扩展的网络应用。不过，目前OpenAI已决定用Rust对Codex CLI进行重写。Rust是一种系统级编程语言，以其高性能、内存安全性和并发处理能力而闻名，使用Rust重写可以提升工具的性能和稳定性，更好地满足复杂编程任务的需求。

后端服务开发在OpenAI的后端服务开发中，主要采用Python语言。Python是一种解释型、高级、通用的编程语言，具有简洁易读的语法和丰富的标准库，能够快速开发各种类型的应用程序。在AI领域，Python更是成为了默认的开发语言，这得益于其拥有众多优秀的机器学习和深度学习框架，如TensorFlow、PyTorch等，这些框架为AI算法的实现提供了强大的支持。

官方SDKOpenAI官方提供了Python SDK（openAI库），这个库可以帮助开发者方便地调用OpenAI的API，实现多种AI功能，如自然语言处理、图像生成等。通过使用Python SDK，开发者无需深入了解API的具体实现细节，只需按照文档说明进行简单的代码编写，就可以快速集成OpenAI的强大功能到自己的项目中，大大提高了开发效率。

winrar3.6 压缩winrar3.51主要是干什么用的

« 上一篇2026-06-24

暗黑3 冒险模式？暗黑3不打剧情进冒险模式

下一篇 »2026-06-24

openai和pytorch pytorch中文手册

如何评价PyTorch

为什么说PyTorch是个bug库

openai的代码是什么语言

蘑菇导航

网站分类

网站收藏

热门文章

bt磁力搜索器 5个磁力种子搜索引擎

ai视频创作(如何制作ai人工智能视频)

fifa25下载？fifa25手机版免费下载

2022梦幻平民5开5门最佳配置，2022梦幻手游5开5门排行榜

twitch手机客户端？twitch电脑客户端下载_twitch电脑客户端怎么下载

openai和pytorch pytorch中文手册

如何评价PyTorch

为什么说PyTorch是个bug库

openai的代码是什么语言

相关推荐

蘑菇导航

网站分类

网站收藏

热门文章