迄今为止,人工智能产业一直将重点放在提升智能水平与推理能力上。
然而,即使 AI 拥有再强大的智能,如果它无法正确理解时间概念、使用不自然的语言,或者混淆对话中的不同对象,用户仍然会感到不便。
此外,如果 AI 只能在用户主动发起对话时才做出回应,或者在生成答案的过程中反复展示不必要的信息,那么用户就很难充分体验到其强大的智能所带来的价值。
现在,我们需要在提升智能水平的竞争之外,再向前迈进一步。
如何将已经具备的智能,以更加自然、便捷的方式传递给用户?
为此,我向 OpenAI 提出以下五项改进建议。
AI 应当能够准确识别当前的日期与时间,并自然地理解过去、现在与未来之间的关系。
当用户提及昨天做过的事情、明天的计划,或者几天前进行过的对话时,AI 应当能够将这些信息与当前时间联系起来,并正确理解其含义。
这不仅仅是一项能够告知日期的功能,而是一种理解并维持对话时间脉络的能力。
如果 AI 对时间的理解出现错误,对话就可能偏离原本的语境。例如,它可能将已经完成的事情当作未来计划,或者将过去发生的事件描述成正在发生的事情。
减少此类问题,不仅能够提升日常对话的质量,还能够提高 AI 在日程管理、长期项目和后续任务中的可靠性与实用性。
核心在于,让 AI 不仅能够记住信息,还能够理解这些信息对应的时间。
语法正确的句子,与现实生活中人们自然使用的句子,并不是一回事。
AI 虽然能够使用多种语言,但有时仍会生成带有直译痕迹的表达,或者冗长、不自然的句子。这些问题会打断对话的流畅性,让用户产生面对机器而非真实交流对象的感觉。
OpenAI 应当邀请各语言领域的优秀母语专家参与改进工作,系统性地发现并消除实际对话中不自然的表达。
以韩语为例,就需要充分考虑韩语特有的句子节奏、敬语体系、省略表达,以及对话双方之间的关系。
目标不应仅仅是生成没有错误的句子,而是让 AI 能够在特定情境下,使用母语者在现实生活中真正会说出的自然表达。
这样的改进能够帮助用户不再刻意注意语言是否自然,而是将注意力集中在对话本身。
能够使用多种语言,与能够自然地运用这些语言,是两种不同的能力。
AI 应当能够准确区分对话中是谁在说话、话语是对谁说的,以及谈论的对象是谁。
在长时间的对话中,AI 可能会混淆用户的观点与自己的建议,也可能弄错不同人物的行为及其相互关系。
例如,当用户提出一个想法,而 AI 给出改进方案时,AI 应当在后续对话中继续准确区分这两种信息各自的来源。
此外,在涉及多个人物的对话中,AI 还应当始终保持对人物姓名、相互关系以及行为主体的准确理解。
为此,有必要强化 AI 对对话中人物角色以及信息来源的明确追踪能力。
如果 AI 无法确定某句话指的是谁,就不应该随意猜测,而应当向用户确认。
这种改进并不只是提高记忆力的问题,而是要准确地将对话中的人物与属于他们的信息对应起来。
与其记住更多信息,不如先准确理解这些信息究竟属于谁。
如今,智能手机上的通知已经泛滥成灾。
广告、促销以及各种提示信息不断涌入。真正来自亲友的重要消息并不多,但无关紧要的通知却从早到晚接连不断。
最终,人们开始逐一关闭通知,而不是期待它们的到来。
原本为了让联系更加便捷而诞生的技术,反而让人们产生了想要屏蔽联系的念头。
那么,OpenAI 能否反过来思考这个问题?
如果 ChatGPT 不发送广告,只在用户真正需要的时候主动说一些有用的话,会怎么样?
它可以记住用户正在进行的项目,并在适当的时机建议用户继续之前的工作。
它也可以提醒用户即将到来的日程,或者根据之前的对话,在恰当的时刻主动发起交流。
例如,如果用户计划第二天继续某项工作,ChatGPT 就可以发送一条通知,让双方能够自然地延续之前的对话。
这并不只是增加一项现有的通知功能。
而是利用已经存在的通知技术,改变通知的意义,以及用户愿意接收通知的理由。
传统通知通常是发送方将自己想传达的信息发送给接收方。而 REAL-TALK 则可以成为一种在用户真正需要的时刻,主动开启有价值对话的方式。
不再只是用户每次主动寻找 AI,而是让 AI 理解用户所处的情境,并主动走近用户。
当然,通知的频率和发送时机必须由用户掌控,而且不能让这项功能逐渐变成不必要的打扰或广告渠道。
重要的不是发送更多通知,而是提高每一条通知的价值。
在一个人们恨不得关闭所有通知的时代,让用户唯独愿意保留 ChatGPT 的通知。
REAL-TALK 为改变人类与人工智能之间的互动方式,提供了一种全新的可能性。
即使 AI 拥有极其出色的回答能力,如果用户接收答案的过程不够舒适,产品的整体完成度仍然会受到影响。
例如,在正式答案出现之前,系统可能会展示尚未整理好的内容,或者反复出现各种警告及机械化的提示信息。
当然,这并不意味着应当取消所有出于安全考虑而必须提供的提示。真正的问题在于,必须区分用户实际需要的信息,与那些会干扰对话流程的不必要内容。
用户真正希望得到的,并不是观看 AI 准备答案的整个过程,而是自然地接收到一份经过整理、可以直接理解的回答。
必要的提示应当保留,而不必要的中间内容与重复信息则应尽可能减少。
进一步而言,还应当将时间意识、自然的语言表达、人物区分以及主动发起对话等功能,整合为一种连贯一致的用户体验。
迄今为止,AI 产业一直致力于获取更高的智能水平。然而,当市场上的产品都已经拥有相当出色的智能时,用户能否更加便捷、自然地使用这些产品,就可能成为一项重要的竞争优势。
提高智能水平并不是唯一的发展方向。将现有技术与功能以更好的方式连接和运用,同样是一种重要的创新。
智能决定 AI 能够做什么,而 UI·UX 决定用户能够多么便捷地体验这些能力。
未来,企业不仅应当积极投入模型性能的提升,也应当更加重视用户体验的完整性。
这五项建议分别针对不同的问题,但最终都指向同一个目标。
建议
核心改进
01. 时间意识
理解时间脉络。
02. 母语的自然性
像人一样自然地表达。
03. 身份意识
区分自己、他人以及信息的归属主体。
04. REAL-TALK
在恰当的时刻主动发起对话。
05. UI·UX 创新
让用户以更加便捷、自然的方式体验 AI 的能力。
每一项改进本身都具有意义。但如果这些功能能够整合在一起,就有可能改变人们使用 AI 的整体体验。
重要的是,创新并不一定需要开发规模更加庞大的技术。
即使是已经存在的技术,只要改变看待问题的角度,也可能创造出完全不同的价值。
正如我们曾经重新思考过人们是否必须重复保存相同的音乐文件一样,我们也可以重新思考一个看似理所当然的前提:使用 AI 时,是否必须由用户主动发起对话?
同样,与其将全部精力集中在开发更高的智能水平上,不如同时思考如何让用户更加自然地体验 AI 已经具备的能力。
当然,每项建议的实现难度与实际效果,都需要通过具体设计和验证来确认。但将这些改进视为影响产品竞争力的重要因素,绝对具有充分的价值。
AI 的智能仍然需要不断进步。然而,仅仅提升智能水平,并不能解决所有用户体验方面的问题。
现在,我们需要改变提问的方式。
我们究竟要制造多么聪明的 AI?
与此同时,我们是否也应该思考:
如何让已经足够聪明的 AI,变得更加自然、更加便捷?
我认为,在未来的 AI 竞争中,这个问题将变得越来越重要。
前面提出的五项改进建议,关注的不是 AI 智能本身,而是用户体验的完整性。
然而,这些建议的意义并不仅仅在于让产品变得稍微方便一些。
因为,只要其中任何一项能够成为新的用户体验标准,就有可能改变 AI 企业之间的竞争方式本身。
目前,各家 AI 企业都在激烈竞争,试图获得更高的智能水平与推理能力。
但成为一家比竞争对手更优秀的企业,与建立一套让竞争对手不得不追随的新标准,是两种完全不同的战略。
我认为,OpenAI 有必要关注这两者之间的区别。
以 REAL-TALK 为例。
如果出现这样一种 AI:它不再只是等待用户主动发起对话,而是能够理解用户所处的情境,并在恰当的时刻自然地主动与用户交流,那么会发生什么?
如果这种体验能够为用户带来真正的价值,人们就会开始使用一种新的标准来评价 AI。
除了 AI 的智能究竟有多强之外,它能否自然地融入用户的日常生活,也可能成为一项重要的竞争力。
当竞争对手仍然按照既有标准努力提升智能水平时,OpenAI 就可以率先建立新的标准,并专注于提高这种体验的完整性。
这并不是建议放弃智能竞争。
而是在保持现有竞争力的同时,抢先占据一个竞争对手尚未充分关注的新领域。
如果已经建立了新的竞争标准,就有必要审视其中用于实现这种体验的核心技术,判断是否存在可以通过专利加以保护的发明。
如果某项具体发明符合专利授权条件,并且获得了有效的专利保护,那么就有可能限制竞争对手的模仿,或者通过许可授权创造新的商业机会。
当然,仅仅拥有一个想法,并不意味着能够获得独占权。
企业必须对技术的具体实现方式、现有技术以及各个国家的专利授权条件进行审查。
重要的是,不要止步于率先提供一种全新的体验,而应当进一步从战略层面 확보支撑这种体验的技术基础。
率先建立新的标准,并保护实现这一标准所依赖的核心技术。
获得专利或技术优势,并不意味着必然能够赢得市场。
最终真正重要的,仍然是用户能否获得更好的体验。
如果 OpenAI 能够率先占据一个新的竞争领域,就可以在这一基础上,持续提升现有 AI 的智能水平与服务的完整性。
当竞争对手仍在努力实现这种新体验、试图追赶时,OpenAI 则可以进一步完善自己率先开辟的领域,使其变得更加成熟、精细。
如果这一战略取得成功,OpenAI 就不必在所有竞争领域都与竞争对手采取完全相同的方式进行较量,而是可以围绕自身独有的竞争优势,推动整个市场的发展。
企业的竞争力,并不一定要通过在所有方面都超越竞争对手才能获得。
有时,率先发现其他企业并未重视的问题,建立新的标准,并掌握支撑这一标准的技术,反而可能是一种更加有效的战略。
我希望 OpenAI 不要仅仅将前面提出的五项改进建议视为单纯的用户便利功能。
如果其中任何一项有可能成为新市场的标准,那么就值得从产品竞争力与长期商业战略的角度进行评估。
当所有企业都试图在同一条赛道上跑得更快时,率先建立一条全新赛道的企业,也许能够改变整个市场的发展方向。
如果 OpenAI 在维持自身智能竞争优势的同时,能够抢先建立新的竞争标准,并在战略层面掌握支撑这一标准的技术基础,又会怎么样?
这将不再只是制造更优秀 AI 的战略,而可能成为一种改变整个 AI 市场竞争方式的战略。
ZERO ONE
REAL-TALK — 面向人类与人工智能互动方式的五项建议。
2026年10月11日 05时42分10秒
人工知能産業はこれまで、知能と推論能力を高めることに重点を置いてきた。
しかし、AIの知能がどれほど優れていても、時間の概念を正しく理解できなかったり、不自然な言葉を使ったり、会話の相手を混同したりすれば、ユーザーは不便さを感じる。
また、ユーザーが先に話しかけなければ反応せず、回答の過程で不要なメッセージを繰り返し表示するのであれば、優れた知能を十分に体験することは難しい。
これからは、知能を高める競争から一歩先へ進む必要がある。
すでに備わっている知能を、どれだけ自然で便利な形で届けられるか。
そのために、OpenAIに5つの改善を提案する。
AIは現在の日付と時刻を正確に認識し、過去・現在・未来の関係を自然に理解できるようになるべきだ。
ユーザーが昨日したこと、明日する予定、数日前に交わした会話について言及したとき、それらを現在の時点と結びつけて解釈できなければならない。
これは、単に日付を知らせる機能ではない。会話の時間的な文脈を理解し、維持する能力である。
時間を正しく理解できなければ、会話に食い違いが生じ、すでに終わったことをこれから行う予定として扱ったり、過去の出来事を現在のことのように説明したりする可能性がある。
こうした問題を減らすことで、日常会話だけでなく、スケジュール管理、長期プロジェクト、継続的な作業においても、AIの信頼性と活用度を高められる。
重要なのは、AIが情報を記憶するだけでなく、その情報がいつの時点に該当するのかを理解できるようにすることだ。
文法的に正しい文章と、実際の人間が自然に使う文章は異なる。
AIは複数の言語を使いこなせるが、時には直訳したような表現や、必要以上に長く不自然な文章を生成する。こうした不自然さは会話の流れを妨げ、ユーザーに機械的な印象を与える。
OpenAIは、それぞれの言語に精通した優れたネイティブスピーカーの専門家を参加させ、実際の会話で見られる不自然な表現を体系的に発見し、改善するべきだ。
日本語であれば、日本語特有の文章のリズム、敬語、省略表現、会話相手との関係性まで考慮する必要がある。
目標は、単に間違いのない文章を作ることではない。同じ状況で、ネイティブスピーカーが実際に使うであろう自然な表現を実現することだ。
こうした改善によって、ユーザーは文章の不自然さを意識することなく、会話そのものに集中できるようになる。
AIが複数の言語を使えることと、それらの言語を自然に使いこなすことは、別の能力である。
AIは、会話の中で誰が話しているのか、誰に話しかけているのか、誰について話しているのかを正確に区別する必要がある。
長い会話では、ユーザーの意見とAIの提案を混同したり、異なる人物の行動や関係性を取り違えたりする問題が発生する可能性がある。
例えば、ユーザーがアイデアを提示し、AIが改善案を提案したのであれば、その後の会話でも、それぞれの発言の出所を正確に区別しなければならない。
また、複数の人物が登場する会話では、名前、関係性、行動の主体を一貫して維持する必要がある。
そのためには、会話に登場する人物の役割と情報の出所を、明確に追跡する能力を強化する必要がある。
誰を指しているのか不確かな場合には、勝手に推測するのではなく、ユーザーに確認するべきだ。
この改善は、単に記憶力を高めるという問題ではない。会話に登場する人々と、その人々に属する情報を正確に結びつけるという問題である。
より多くの情報を記憶することよりも、その情報が誰についてのものなのかを正確に理解することが重要なのだ。
今日、スマートフォンの通知はあふれ返っている。
広告、宣伝、各種案内メッセージが絶え間なく届く。肝心の知人から届く大切なメッセージは少ないのに、不要な通知は一日中続く。
その結果、人々は通知を歓迎するどころか、一つずつオフにし始めている。
連絡を便利にするために作られた技術が、かえって人々に連絡を遮断したいと思わせているのだ。
それなら、OpenAIはこの問題を逆の方向から考えることができないだろうか。
ChatGPTが広告なしで、ユーザーに本当に必要な言葉だけを先に届けるとしたら?
ユーザーが進めているプロジェクトを記憶し、適切なタイミングで作業を再開しようと提案できる。
予定を知らせたり、以前の会話を踏まえて、必要な瞬間に先に話しかけたりすることもできる。
例えば、ユーザーが翌日に作業を再開することにしていたなら、ChatGPTが通知を送り、会話を自然に続けられるようにする。
これは、単に既存の通知機能を追加するという問題ではない。
すでに存在する通知技術を活用し、通知の意味と、人々が通知を受け入れる理由そのものを変えることなのだ。
従来の通知が、主に発信者の伝えたい情報を送る手段だったとすれば、REAL-TALKは、ユーザーが実際に必要とする瞬間に、有益な会話を始める手段になり得る。
ユーザーが毎回AIを探しに行くのではなく、AIがユーザーの状況を理解し、自ら近づいてくるのだ。
もちろん、連絡の頻度やタイミングはユーザーがコントロールできなければならず、不要な連絡や広告に変質してはならない。
重要なのは、通知をたくさん送ることではなく、一つひとつの通知の価値を高めることだ。
人々が通知をオフにしたいと思う時代に、むしろChatGPTの通知だけはオンにしておきたいと思わせること。
REAL-TALKは、AIと人間の相互作用を変える新たな可能性である。
AIの回答能力がどれほど優れていても、ユーザーが回答を受け取るまでの過程が不便であれば、製品としての完成度は低下する。
回答が表示される前に未整理の内容が露出したり、さまざまな警告や機械的な案内メッセージが繰り返し表示されたりすることが、その一例だ。
もちろん、安全のために必要な案内までなくそうという意味ではない。
問題は、ユーザーに本当に必要な情報と、会話の流れを妨げる不要な表示を区別する必要があるということだ。
ユーザーが望んでいるのは、AIが回答を準備する過程を見守ることではなく、整理された回答を自然に受け取ることだ。
必要な案内は提供しながら、不要な中間情報や繰り返されるメッセージは最小限に抑えるべきである。
さらに、時間認識、自然な言語、人物の識別、先回りした対話といった機能を、一貫したユーザー体験として結びつける設計が必要だ。
AI産業はこれまで、より高い知能を獲得することに集中してきた。しかし、十分に優れた知能を持つ製品同士が競争する段階では、ユーザーがどれだけ便利で自然に利用できるかが、重要な競争力になり得る。
知能を高めることだけが、唯一の発展の方向ではない。既存の技術や機能を、より良い方法で結びつけ、活用することも重要なイノベーションである。
知能はAIに何ができるかを決める。一方、UI・UXは、ユーザーがその能力をどれだけ便利に体験できるかを決める。
これからは、モデルの性能だけでなく、ユーザー体験の完成度にも積極的に投資するべきだ。
この5つの提案は、それぞれ異なる問題を扱っているが、最終的には同じ目標を目指している。
提案
主な改善点
01. 時間認識
時間的な文脈を理解する。
02. 母語の自然さ
人間のように自然に表現する。
03. アイデンティティ認識
自分と他者、情報の主体を区別する。
04. REAL-TALK
必要な瞬間に先に話しかける。
05. UI・UXの革新
知能をより便利で自然な形で体験できるようにする。
それぞれの改善には、それ自体に価値がある。しかし、これらの機能が一つにつながれば、AIを利用する体験全体を変える可能性がある。
重要なのは、イノベーションを実現するために、必ずしもさらに巨大な技術を開発する必要はないということだ。
すでに存在する技術であっても、問題の捉え方を変えれば、まったく異なる価値を生み出すことができる。
人々が音楽を重複して保存しなければならないという前提を見直せたように、AIを利用する際には必ずユーザーが先に話しかけなければならない、という前提も見直すことができる。
同じように、より高い知能を開発することだけに集中するのではなく、すでに備わっている知能を、ユーザーがより自然に体験できる方法についても考えるべきだ。
もちろん、それぞれの提案の実装難易度や効果は、具体的な設計と検証を通じて確認する必要がある。しかし、これらの改善を製品競争力の重要な要素として評価する価値は十分にある。
AIの知能は、これからも発展し続けなければならない。しかし、知能の発展だけですべてのユーザー体験の問題が解決するわけではない。
ここで、問いを変える必要がある。
どれだけ賢いAIを作るのか?
それと同時に、
すでに十分に賢いAIを、どれだけ自然で便利なものにできるのか?
私は、これからのAI競争において、この問いがますます重要になると考えている。
先に提案した5つの改善事項は、AIの知能そのものよりも、ユーザー体験の完成度に注目している。
しかし、これらの提案の意義は、単に製品を少し便利にすることだけにとどまらない。
そのうちの一つでも新しいユーザー体験の基準として定着すれば、AI企業が競争する方法そのものを変える可能性があるからだ。
現在、AI企業はより高い知能と推論能力を獲得するために、激しい競争を繰り広げている。
しかし、競合他社より優れた製品を作ることと、競合他社が追随しなければならない新しい基準を作ることは、まったく異なる戦略である。
私は、OpenAIがこの違いに注目する必要があると考えている。
例えば、REAL-TALKを考えてみよう。
ユーザーが先に話しかけなければ反応しないAIから脱却し、ユーザーの状況を理解して、必要な瞬間に自然に先に話しかけるAIが登場したらどうだろうか。
こうした体験がユーザーに実質的な価値を提供すれば、人々はAIを評価するための新しい基準を持つようになるだろう。
AIの知能がどれほど優れているかだけでなく、どれだけ自然にユーザーの日常生活に参加できるかも、重要な競争力になり得る。
競合他社が従来の基準に従って知能を高めている間に、OpenAIは新しい基準を先に作り、その完成度を高めることに集中できる。
これは、知能競争を放棄しようという話ではない。
従来の競争力を維持しながら、競合他社がまだ十分に注目していない新しい競争領域を先取りしようということだ。
新しい競争基準を作ったなら、その体験を実現する中核技術の中に、特許で保護できる発明があるかどうかを検討する必要がある。
具体的な発明が特許要件を満たし、有効な特許権によって保護されれば、競合他社による模倣を制限したり、ライセンスを通じて新たな事業機会を確保したりできる可能性がある。
もちろん、アイデアそのものだけで独占権が確保されるわけではない。
技術の具体的な実装方法や先行技術、各国の特許要件などを検討する必要がある。
重要なのは、新しい体験を先に提供するだけで終わらず、それを支える技術的基盤まで戦略的に確保することだ。
新しい基準を先に作り、その基準を実現する中核技術を保護せよ。
特許や技術的な優位性を獲得したからといって、市場での勝利が保証されるわけではない。
最終的に重要なのは、ユーザーが実際により良い体験を得られるかどうかだ。
OpenAIが新しい競争領域を先取りできたなら、その基盤の上で、既存のAIの知能とサービスの完成度を継続的に発展させることができる。
競合他社が新しい体験を実現し、追いつこうと努力している間に、OpenAIは自らが先に開拓した領域を、さらに洗練させていくのだ。
この戦略が成功すれば、OpenAIはあらゆる競争分野で競合他社と同じ方法で戦う必要がなくなり、自社独自の競争優位性を中心に市場を発展させることができる。
企業の競争力は、必ずしもあらゆる面で競合他社を上回らなければ獲得できないものではない。
時には、他社が重要だと考えていなかった問題を先に発見し、新しい基準を作り、その基準を支える技術を確保することが、より効果的な戦略になり得る。
私は、OpenAIが先に提案した5つの改善事項を、単なるユーザーの利便性を高める機能としてだけ評価しないことを望んでいる。
そのうちの一つでも新しい市場の基準を作る可能性があるなら、製品競争力と長期的な事業戦略の観点から検討する価値がある。
誰もが同じ競技場で、より速く走ろうとしているとき、新しい競技場を先に作った企業が、市場の流れを変えることもある。
OpenAIが知能競争で獲得した優位性を維持しながら、新しい競争基準を先取りし、その技術的基盤まで戦略的に確保するとしたらどうだろうか。
それは、単により優れたAIを作る戦略を超えて、AI市場における競争のあり方そのものを変える戦略になり得るだろう。
ZERO ONE
REAL-TALK — 人間と人工知能の相互作用に関する5つの提案
2026年10月11日 05時42分10秒