网易首页 > 网易号 > 正文 申请入驻

OpenAI重磅发布交互界面canvas,让ChatGPT成为写作和编程利器

0
分享至

机器之心报道

机器之心编辑部

OpenAI 刚刚融资,就迫不及待开始证明自己了。

今日凌晨,OpenAI 宣布推出类似 Anthropic 的 Artifacts 的应用 canvas,并称「这是一种使用 ChatGPT 写作和编程的新方式」。

在 Claude 中试过 Artifacts 的朋友都知道,这能极大提升 LLM 输出结果的表现力,其支持输出文本文件、代码、网页、SVG 等等。此前风靡一时的「汉语新解」便是基于 Claude 的 Artifacts 功能。但让 ChatGPT 用户感到遗憾的是,Artifacts 上线三个多月了,OpenAI 一直没有跟进,以至于一些开发者自行开发发布了自己的开源版本。

现在,用户的呼声终于获得了响应,于是纷纷点赞。也有人开玩笑地表示 OpenAI 这是打不过 Claude 便加入。

已有用户分享了自己使用 canvas 的惊喜成果,比如用户 @bilawalsidhu 分享自己让 ChatGPT 使用 ThreeJS 创建超立方体查看器过程:

在 canvas 这个界面,你可以与 ChatGPT 一起完成写作和编码项目,而不再局限于简单的聊天。canvas 是一种新的交互方式,也是 OpenAI 推出 ChatGPT 以来的首个重大视觉界面更新。

canvas 会在单独的窗口中打开,方便用户与 ChatGPT 一起协作完成项目。canvas 的 Beta 版本为用户提供了一种全新的合作方式:你不仅能够通过对话进行创作,还能与 ChatGPT 成为并肩作战的伙伴,一起创造和完善。

canvas 由 GPT-4o 支持,在 Beta 期间可以在模型选择器中手动选择。不过,现在 Beta 版本只提供给 ChatGPT Plus 与团队用户。企业和教育用户将在下周获得访问权限。ChatGPT 免费用户需要等到 canvas 正式发布后才能使用。

我们先一睹 canvas 有哪些惊艳之处。

与 ChatGPT 更好地协作

和 ChatGPT 聊天对于我们来说已经是十分简便的信息获取方式,这也包括写作与编码。不过当你想要及时对写作内容或者编码内容进行修改时,对话方式可能就显得力不从心了。

canvas 的出现就是为了解决这个难题。

在这个新的界面中,你可以通过高亮的方式,告诉 ChatGPT 具体需要关注什么,让它更精准地理解你的用意。这就类似于编辑,你可以在全部上下文中具体地提出反馈和建议。

此外,你的调整方式也十分便捷,直接编辑代码或文本都不成问题。你的项目,你做主。canvas 还提供了快捷菜单,可以让 ChatGPT 帮你调整文本长度、调试代码,或者快速执行其他实用操作。如果想要之前的版本,一键返回即可恢复。

写作快捷操作,图源:https://openai.com/index/introducing-canvas/

当 ChatGPT 发现某个场景中 canvas 能帮上忙时,它会自动打开。你也可以在提示中直接加一句「使用 canvas」,这样 ChatGPT 就会切换到 canvas 界面,帮助你更方便地处理现有项目。

,时长

00:51

canvas 的编程能力

代码是一个迭代过程,但是在聊天之中,很难跟踪代码的改进过程。canvas 让我们可以更轻松地跟踪和理解 ChatGPT 的修改过程,OpenAI 也承诺「计划继续提升这类编辑过程的透明度」。

canvas 目前提供了以下编程快捷操作:

  • 审阅代码:ChatGPT 可提供改进代码的行内建议;
  • 添加日志:插入 print 语句来帮助用户进行调试和理解代码;
  • 添加注释:为代码添加注释,让其更容易理解;
  • 修复 bug:检测和重写有问题的代码,以修复错误;
  • 支持多语言导出:可将用户的代码转译成 JavaScript、TypeScript、Python、Java、C++、PHP 等语言。

将模型训练为协作伙伴

OpenAI 的研究团队对 GPT-4o 进行了训练,以使其能够作为创意合作伙伴进行协作。该模型知道何时打开 canvas,何时进行目标性编辑,以及何时需要完全重写。同时,它还能够理解更广泛的上下文,从而提供精准的反馈和建议。

为了支持这一点,研究团队开发了以下核心行为:

  • 在写作和编码时触发 canvas
  • 生成多样化的内容类型
  • 进行目标性编辑
  • 重写文档
  • 提供 inline 评论

OpenAI 通过 20 多项自动化内部评估来衡量进展,并使用了新颖的合成数据生成技术,例如从 OpenAI 的 o1-preview 中提取输出,来对模型进行核心行为的后训练。这种方法能够快速应对写作质量和新的用户交互需求,从而无需依赖人工生成的数据。

对研发团队来说,一个关键挑战是何时触发 canvas。OpenAI 训练模型在像「写一篇关于咖啡豆历史的博客文章」这样的提示词下打开 canvas,同时避免对像「帮我做一道新的晚餐食谱」这样的一般问答任务进行过度触发。

在写作任务中,他们优先改进了「正确触发」的情况(以牺牲「正确不触发」为代价),达到了 83%,相较于作为基线的零样本提示词式 GPT-4o 有了显著提升。

值得注意的是,此类基线的质量对特定提示词非常敏感。不同的提示词可能导致基线在表现不佳的同时,呈现不同的错误分布。

例如,在编码和写作任务中会出现「均匀地不准确」情况,导致不同类型的错误分布和表现不佳的形式。在编码方面,OpenAI 有意让模型在触发方面偏向保守,以避免干扰高级用户的体验。之后,OpenAI 也是承诺将继续根据用户反馈对其进行优化。

针对写作和编码任务,OpenAI 改进了准确触发 canvas 决策边界的能力,分别达到了 83% 和 94%,相较于作为基线的零样本提示词式 GPT-4o 有明显提升。

第二个挑战在于对模型在触发 canvas 后的编辑行为进行调优,特别是决定何时进行目标性编辑,何时重写整个内容。

OpenAI 训练模型在用户通过界面明确选择文本时进行目标性编辑,否则就更倾向于重写内容。随着模型的不断完善,canvas 的编辑行为也在持续演变。

针对写作和编码任务,OpenAI 优先优化了 canvas 的目标编辑功能。带有 canvas 的 GPT-4o 在性能上比基线的提示词式 GPT-4o 高出 18%。

最后,训练模型生成高质量评论需要经过仔细的迭代。与前两个可以轻松适应自动化评估并辅以详细人工审查的案例不同,自动衡量评论的质量尤其具有挑战性。

因此,OpenAI 使用人工评估来衡量评论的质量和准确性。他们所整合的 canvas 模型在准确性上比使用提示词指令的零样本 GPT-4o 高出 30%,在质量上高出 16%。

这表明合成训练显著提升了相较于带有详细指令说明的零样本提示词下的响应质量和行为表现。

canvas 目前仍处于早期测试阶段,OpenAI 后续计划快速提升其功能。

至于它和 Artifacts 究竟谁更能赢得用户亲睐,就让我们拭目以待吧,相信刚拿了一大笔投资的 OpenAI 也应该不会让用户失望。

https://openai.com/index/introducing-canvas/

https://twitter.com/OpenAI/status/1841887707020329173

https://techcrunch.com/2024/10/03/openai-launches-new-canvas-chatgpt-interface-tailored-to-writing-and-coding-projects/

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
山西矿难247人下井,系统里只有124人,剩下的123人是谁?

山西矿难247人下井,系统里只有124人,剩下的123人是谁?

听心堂
2026-05-24 10:25:08
央媒发文,高调官宣张艺谋新身份,全家移民美国改国籍真相大白!

央媒发文,高调官宣张艺谋新身份,全家移民美国改国籍真相大白!

社会日日鲜
2026-05-24 17:17:12
中央气象台:江苏、上海、浙江西部、安徽南部、湖北东部和南部等地出现较强雷达回波

中央气象台:江苏、上海、浙江西部、安徽南部、湖北东部和南部等地出现较强雷达回波

大风新闻
2026-05-24 10:26:30
黎家盈带20多封信赴太空,丈夫放弃香港事业:家人付出有多大

黎家盈带20多封信赴太空,丈夫放弃香港事业:家人付出有多大

粤语音乐喷泉
2026-05-24 14:52:24
全国通缉犯藏上海9年,成身价3亿大佬,被捕时:放了我,给5000万

全国通缉犯藏上海9年,成身价3亿大佬,被捕时:放了我,给5000万

鉴史录
2026-05-23 12:44:00
2-3!中超第4主场沦陷,3场不败被终结,彭欣力太犀利:传射建功

2-3!中超第4主场沦陷,3场不败被终结,彭欣力太犀利:传射建功

足球狗说
2026-05-24 20:58:13
2-1!王欣瑜拒绝爆冷,晋级法网次轮,奖金102万,中国金花开门红

2-1!王欣瑜拒绝爆冷,晋级法网次轮,奖金102万,中国金花开门红

体育就你秀
2026-05-24 19:40:43
A股:2.5亿股民,今晚可能要兴奋得睡不着觉了,你知道为什么吗?

A股:2.5亿股民,今晚可能要兴奋得睡不着觉了,你知道为什么吗?

夜深爱杂谈
2026-05-24 00:36:11
川普:准备动手。鲁比奥:没有自由就没有未来

川普:准备动手。鲁比奥:没有自由就没有未来

难得君
2026-05-23 10:59:51
60岁阿姨疯狂买买买,还专门租房用来放快递:它们不会主动离开我

60岁阿姨疯狂买买买,还专门租房用来放快递:它们不会主动离开我

澎湃新闻
2026-05-24 19:05:02
乌克兰收复400平方公里领土,俄军星链终端被定向断网,指挥系统瘫痪

乌克兰收复400平方公里领土,俄军星链终端被定向断网,指挥系统瘫痪

爆角追踪
2026-05-24 17:27:23
枪击、油断、内讧:本季菲律宾还有啥?

枪击、油断、内讧:本季菲律宾还有啥?

新民周刊
2026-05-24 13:36:59
“抱一下她去呕吐了”,结婚近两年无法同房,丈夫称妻子抗拒亲密相处;男方要求离婚并退还72万元,女方称不愉快经历难以忘记

“抱一下她去呕吐了”,结婚近两年无法同房,丈夫称妻子抗拒亲密相处;男方要求离婚并退还72万元,女方称不愉快经历难以忘记

深圳晚报
2026-05-24 15:15:43
英超官方:阿森纳客战水晶宫后捧杯领奖,下赛季佩戴冠军金标

英超官方:阿森纳客战水晶宫后捧杯领奖,下赛季佩戴冠军金标

懂球帝
2026-05-24 20:18:40
都是女航天员,四人难处天差地别,黎家盈的困境旁人根本想象不到

都是女航天员,四人难处天差地别,黎家盈的困境旁人根本想象不到

普陀动物世界
2026-05-24 00:45:33
爆锅了!一女子直言再穷,也绝不会去夜店做公主,炸出1.2万评论

爆锅了!一女子直言再穷,也绝不会去夜店做公主,炸出1.2万评论

火山詩话
2026-05-24 06:41:17
智胜特朗普?美媒酸了:中国这招,真“高”!

智胜特朗普?美媒酸了:中国这招,真“高”!

观察者网
2026-05-24 16:22:27
借账户炒股19年,不赚反亏476万!财达证券从业人员迟伟收25万元罚单

借账户炒股19年,不赚反亏476万!财达证券从业人员迟伟收25万元罚单

红星新闻
2026-05-24 13:54:45
伊朗总统:准备向世界保证,伊朗不寻求拥有核武器

伊朗总统:准备向世界保证,伊朗不寻求拥有核武器

新华社
2026-05-24 20:20:19
王鹤棣全网掉粉超20万!代言和作品遭抵制,路人缘崩塌难以挽回

王鹤棣全网掉粉超20万!代言和作品遭抵制,路人缘崩塌难以挽回

萌神木木
2026-05-24 11:50:12
2026-05-24 21:55:00
机器之心Pro incentive-icons
机器之心Pro
专业的人工智能媒体
13069文章数 142652关注度
往期回顾 全部

科技要闻

我戴着摄像头上班,正在帮AI抢走我饭碗

头条要闻

女子将2万多克黄金存珠宝店起纠纷:老板猥亵我和女儿

头条要闻

女子将2万多克黄金存珠宝店起纠纷:老板猥亵我和女儿

体育要闻

唐斯发牌,大头逆袭:骑士跌向残忍夏季

娱乐要闻

王鹤棣掉粉超20万!代言和作品遭抵制

财经要闻

什么情况下,本轮AI大行情会结束?

汽车要闻

2027款星途瑶光上市 把"全球车"标准卷进13万级市场

态度原创

游戏
本地
旅游
时尚
公开课

LCK第二赛段:领先不会打比赛,5000不是劣势,T1翻盘成功横扫BRO

本地新闻

用云锦的方式,打开江苏南京

旅游要闻

穿越最美西藏|千年古城拉萨 人文与自然相映

《低智商犯罪》一半惊喜,一半可惜

公开课

李玫瑾:为什么性格比能力更重要?

无障碍浏览 进入关怀版