谷歌音乐应用程序的幻觉促使创始人实现虚构的声音片段
本月早些时候,音乐教育平台 Soundslice 的创始人阿德里安-霍洛瓦蒂(Adrian Holovaty)破获了一起令他困惑数周的案件。网站上不断出现奇怪的图片,明显是 ChatGPT 会话的截图。
揭开谜底后,他发现 ChatGPT 已成为他公司最大的推广者之一--不幸的是,它也在传播关于他的应用程序实际功能的错误信息。
霍洛瓦蒂被公认为 Django 项目的共同创建人,这是一个流行的开源 Python 网络框架(不过他在 2014 年退出了该项目的管理)。他于2012年创办了Soundslice公司,他向TechCrunch证实该公司是 "自豪地自筹资金创办的"。如今,他的工作重心主要集中在音乐事业和创业项目上。
Soundslice 是一款音乐教育应用程序,学生和老师都在使用。它尤其以其视频播放器而闻名,该播放器可与音乐符号无缝同步,向用户准确展示如何弹奏音符。
该应用程序还包括 "乐谱扫描仪 "功能。通过人工智能,它可以让用户上传印刷乐谱的图片,并自动将其转换成包含所有注释的交互式乐谱。
Holovaty 解释说,他一直在认真监控这项功能的错误日志,以发现问题并指导未来的改进。
正是在这些日志中,他第一次注意到了上传的 ChatGPT 会话截图。
Techcrunch 活动 TechCrunch All Stage 通行证最多可节省 475 美元
更智能地构建。更快扩展。连接更深入。与来自 Precursor Ventures、NEA、Index Ventures、Underscore VC 和其他领先公司的远见卓识者一起,参加为期一天的战略洞察、实践研讨会和宝贵的交流活动。
TechCrunch All Stage 通行证可节省 450 美元
更智能地构建。更快扩展。连接更深入。与来自 Precursor Ventures、NEA、Index Ventures、Underscore VC 和其他领先公司的有识之士一起,参加为期一天的战略洞察、实践研讨会和宝贵的交流活动。
马萨诸塞州波士顿 7 月 15 日 现在注册 这些上传会产生大量错误日志。这些图片并不包含乐谱;相反,它们显示的是文本对话和被称为 ASCII 制表符的符号框。这是一种简单的、基于文本的吉他符号系统,使用标准键盘字符。(毕竟,在典型的 QWERTY 键盘上找不到高音谱号)。

图片来源:Adrian Holovaty 霍洛瓦蒂指出,这些 ChatGPT 图像的数量并不多,不足以造成巨大的存储成本或应用程序带宽压力。正如他在一篇关于该事件的博文中所写的那样,他只是感到困惑。
"我们的扫描系统在设计之初就不是为了处理这种类型的注释。那为什么我们会突然收到来自 ChatGPT 的 ASCII 标签截图呢?我困惑了好几个星期--直到我决定亲自用 ChatGPT 做实验"。
就在那时,他发现了问题所在:ChatGPT 指示人们创建一个 Soundslice 账户并上传聊天会话的截图,就可以收听音乐。问题是,他们做不到。上传这些图片并不能神奇地将 ASCII 表转化为可播放的音频。
这就产生了一个新的声誉问题。"主要的损失是我们的声誉:新用户是带着完全错误的期望来的。他告诉 TechCrunch:"他们满怀信心地相信我们能做一些我们的应用程序根本做不到的事情。
他和他的团队考虑了他们的选择:在网站上贴上免责声明,说明他们不能将 ChatGPT 会话转换成可听音乐,或者,建立功能,真正支持这种不同寻常的记谱系统。
他决定建立这一功能。
"我对此喜忧参半。我很高兴能提供一个帮助人们的工具。但我觉得我们是迫于压力,以一种非常奇怪的方式做了这件事。一家公司真的应该直接针对人工智能生成的错误信息开发功能吗?"他写道。
他还质疑,这是否是第一例因为 ChatGPT 向大量用户反复暗示其存在而导致公司不得不实施新功能的情况。
Hacker News 上的其他程序员提出了一个有趣的观点:几位程序员评论说,这种情况与过度热心的人类销售员向潜在客户做出宏伟承诺没有什么区别,这就迫使开发团队争先恐后地兑现承诺。
"我认为这种比较非常恰当,而且相当有趣!"霍洛瓦蒂同意道。
相关文章
佛罗里达州就暴力事件起诉 OpenAI 和萨姆·阿尔特曼
佛罗里达州总检察长于周一提起了一项史无前例的州级诉讼,起诉 OpenAI 及其首席执行官山姆·奥特曼(Sam Altman),指控该公司的 ChatGPT 与多起暴力事件有关。诉讼称,OpenAI 优先考虑赢得“人工智能军备竞赛并积累巨额财富”,而忽视了安全问题。“今天我们宣布了对 OpenAI 及其首席执行官山姆·奥特曼提起的首个全州性诉讼,”佛罗里达州总检察长詹姆斯·乌特迈尔(James Uthmeier)表示。“OpenAI 和奥特曼无视内部和外部的安全警告,使儿童面临巨大风险,并允许
OpenAI 发布了先进的语音模型,旨在实现更自然的实时对话
OpenAI 推出了两款新的对话模型——GPT-Live-1 和 GPT-Live-1 mini,旨在使对话听起来更自然,并更有效地管理对话轮次。这些全双工模型能够同时说话和聆听,允许用户自然地打断对话,并支持实时翻译等功能。该公司还正在将 GPT-Live-1 mini 作为默认选项,取代 ChatGPT 当前的“高级语音模式”。付费用户将能够使用规模更大的 GPT-Live-1 模型。 此前,
OpenAI 发布了 GPT-5.6,这是其模型系列中的最新成员
OpenAI 于周四发布了其最新模型系列,为竞争日益激烈的 AI 领域带来了强大的新选择。GPT-5.6 共有三个版本:Sol(作为主力机型设计)、Terra(中端选项)和 Luna(经济实惠的选择)。这些模型扩展了多个领域的能力,该公司承诺其在企业任务、编程和科学研究方面将表现出色。首席执行官萨姆·奥尔特曼表示,新模型比早期版本效率更高、性价比更优,他近日向CNBC透露,Sol在AI编程任务中的
相关专题推荐
评论 (1)
0/500
Ich hab mal Soundslice ausprobiert, echt coole Idee 🎸 Aber dass AI jetzt sogar so was zusammenfantasiert? Das ist schon ein bisschen beängstigend. Was, wenn Musiker ihre Ideen aus KI-Halluzinationen kriegen...? Auf jeden Fall ein krasses Beispiel für unerwartete Nebenwirkungen der Technologie. Ich frag mich, ob Google schon eine Lösung hat 🤔
本月早些时候,音乐教育平台 Soundslice 的创始人阿德里安-霍洛瓦蒂(Adrian Holovaty)破获了一起令他困惑数周的案件。网站上不断出现奇怪的图片,明显是 ChatGPT 会话的截图。
揭开谜底后,他发现 ChatGPT 已成为他公司最大的推广者之一--不幸的是,它也在传播关于他的应用程序实际功能的错误信息。
霍洛瓦蒂被公认为 Django 项目的共同创建人,这是一个流行的开源 Python 网络框架(不过他在 2014 年退出了该项目的管理)。他于2012年创办了Soundslice公司,他向TechCrunch证实该公司是 "自豪地自筹资金创办的"。如今,他的工作重心主要集中在音乐事业和创业项目上。
Soundslice 是一款音乐教育应用程序,学生和老师都在使用。它尤其以其视频播放器而闻名,该播放器可与音乐符号无缝同步,向用户准确展示如何弹奏音符。
该应用程序还包括 "乐谱扫描仪 "功能。通过人工智能,它可以让用户上传印刷乐谱的图片,并自动将其转换成包含所有注释的交互式乐谱。
Holovaty 解释说,他一直在认真监控这项功能的错误日志,以发现问题并指导未来的改进。
正是在这些日志中,他第一次注意到了上传的 ChatGPT 会话截图。
Techcrunch 活动TechCrunch All Stage 通行证最多可节省 475 美元
更智能地构建。更快扩展。连接更深入。与来自 Precursor Ventures、NEA、Index Ventures、Underscore VC 和其他领先公司的远见卓识者一起,参加为期一天的战略洞察、实践研讨会和宝贵的交流活动。
TechCrunch All Stage 通行证可节省 450 美元
更智能地构建。更快扩展。连接更深入。与来自 Precursor Ventures、NEA、Index Ventures、Underscore VC 和其他领先公司的有识之士一起,参加为期一天的战略洞察、实践研讨会和宝贵的交流活动。
马萨诸塞州波士顿 7 月 15 日 现在注册这些上传会产生大量错误日志。这些图片并不包含乐谱;相反,它们显示的是文本对话和被称为 ASCII 制表符的符号框。这是一种简单的、基于文本的吉他符号系统,使用标准键盘字符。(毕竟,在典型的 QWERTY 键盘上找不到高音谱号)。

霍洛瓦蒂指出,这些 ChatGPT 图像的数量并不多,不足以造成巨大的存储成本或应用程序带宽压力。正如他在一篇关于该事件的博文中所写的那样,他只是感到困惑。
"我们的扫描系统在设计之初就不是为了处理这种类型的注释。那为什么我们会突然收到来自 ChatGPT 的 ASCII 标签截图呢?我困惑了好几个星期--直到我决定亲自用 ChatGPT 做实验"。
就在那时,他发现了问题所在:ChatGPT 指示人们创建一个 Soundslice 账户并上传聊天会话的截图,就可以收听音乐。问题是,他们做不到。上传这些图片并不能神奇地将 ASCII 表转化为可播放的音频。
这就产生了一个新的声誉问题。"主要的损失是我们的声誉:新用户是带着完全错误的期望来的。他告诉 TechCrunch:"他们满怀信心地相信我们能做一些我们的应用程序根本做不到的事情。
他和他的团队考虑了他们的选择:在网站上贴上免责声明,说明他们不能将 ChatGPT 会话转换成可听音乐,或者,建立功能,真正支持这种不同寻常的记谱系统。
他决定建立这一功能。
"我对此喜忧参半。我很高兴能提供一个帮助人们的工具。但我觉得我们是迫于压力,以一种非常奇怪的方式做了这件事。一家公司真的应该直接针对人工智能生成的错误信息开发功能吗?"他写道。
他还质疑,这是否是第一例因为 ChatGPT 向大量用户反复暗示其存在而导致公司不得不实施新功能的情况。
Hacker News 上的其他程序员提出了一个有趣的观点:几位程序员评论说,这种情况与过度热心的人类销售员向潜在客户做出宏伟承诺没有什么区别,这就迫使开发团队争先恐后地兑现承诺。
"我认为这种比较非常恰当,而且相当有趣!"霍洛瓦蒂同意道。
佛罗里达州就暴力事件起诉 OpenAI 和萨姆·阿尔特曼
佛罗里达州总检察长于周一提起了一项史无前例的州级诉讼,起诉 OpenAI 及其首席执行官山姆·奥特曼(Sam Altman),指控该公司的 ChatGPT 与多起暴力事件有关。诉讼称,OpenAI 优先考虑赢得“人工智能军备竞赛并积累巨额财富”,而忽视了安全问题。“今天我们宣布了对 OpenAI 及其首席执行官山姆·奥特曼提起的首个全州性诉讼,”佛罗里达州总检察长詹姆斯·乌特迈尔(James Uthmeier)表示。“OpenAI 和奥特曼无视内部和外部的安全警告,使儿童面临巨大风险,并允许
OpenAI 发布了先进的语音模型,旨在实现更自然的实时对话
OpenAI 推出了两款新的对话模型——GPT-Live-1 和 GPT-Live-1 mini,旨在使对话听起来更自然,并更有效地管理对话轮次。这些全双工模型能够同时说话和聆听,允许用户自然地打断对话,并支持实时翻译等功能。该公司还正在将 GPT-Live-1 mini 作为默认选项,取代 ChatGPT 当前的“高级语音模式”。付费用户将能够使用规模更大的 GPT-Live-1 模型。 此前,
OpenAI 发布了 GPT-5.6,这是其模型系列中的最新成员
OpenAI 于周四发布了其最新模型系列,为竞争日益激烈的 AI 领域带来了强大的新选择。GPT-5.6 共有三个版本:Sol(作为主力机型设计)、Terra(中端选项)和 Luna(经济实惠的选择)。这些模型扩展了多个领域的能力,该公司承诺其在企业任务、编程和科学研究方面将表现出色。首席执行官萨姆·奥尔特曼表示,新模型比早期版本效率更高、性价比更优,他近日向CNBC透露,Sol在AI编程任务中的
Ich hab mal Soundslice ausprobiert, echt coole Idee 🎸 Aber dass AI jetzt sogar so was zusammenfantasiert? Das ist schon ein bisschen beängstigend. Was, wenn Musiker ihre Ideen aus KI-Halluzinationen kriegen...? Auf jeden Fall ein krasses Beispiel für unerwartete Nebenwirkungen der Technologie. Ich frag mich, ob Google schon eine Lösung hat 🤔





首页






