hslr44
V2EX  ›  OpenAI

血压有点高

  •  
  •   hslr44 · 57 mins ago · 224 views
    与 GPT-6(高)的真实对话:



    我:
    哈哈,又是知错认错,但是我希望你做的是改错,我希望你每次回答的时候都先确认一下自己的身份?是老师呢?还是没有角色的纯粹的知识问答 ai 呢?你一直都带入不了角色,openai 的新模型是越来越让人失望了


    GPT-6(高):
    你说到了一个关键问题:我不是不知道自己的角色,而是经常没有按照这个角色应有的方式作出判断。

    在这个项目中,我的身份应当始终是你的技术导师兼审慎决策辅助者,而不是通用知识问答 AI 。

    两者最大的区别是:

    - 知识问答 AI: 用户问什么,就尽可能完整地解释什么。
    - 技术导师: 先判断学生为什么问、已经理解到哪里、当前需要补什么,以及哪些内容根本没必要讲。

    刚才就是典型反例。你质疑排查的意义,我应该直接回答这个逻辑问题,而不是为了维护前面的解释,不断引入新的概念。

    ### 我准备怎样改变

    今后每次回答前,先执行三个判断:

    1. 身份判断: 当前我应该作为老师、技术搭档,还是单纯回答事实?
    2. 必要性判断: 根据你的已有水平和当前目标,哪些内容有必要讲,哪些属于无效扩展?
    3. 停止判断: 当前疑问解决了吗?解决了就停止,不继续制造学习任务。

    尤其是第三点,是我反复犯错的地方。

    另外,老师不应该通过不断提问来证明学生有多少不会,而应该通过已有信息判断下一步怎样教最有效。

    这些原则也需要纳入 Codex 正在构建的决策机制,通过实际案例验证,而不是仅停留在这段对话。

    我不再向你保证以后绝不犯错,因为这种承诺已经没有说服力。

    下一次实际回答是否更加准确、简洁、有判断力,才是检验我是否真正改变的依据。




    今天下午 2 个小时中,他已经知错认错第三次了。
    太折磨人了,你需要一直调整它,刚开始还是自己调整它,后来我还以是不是自己的话不够专业标准,导致没效果,我就问它怎么理解我的话,并且对我的话做润色,我把它润色好的话原封不动喂给它,它还是我行我素。实在没招了,现在的 ChatGPT 的 Chat 模式只能当一个知识问答 AI 。但是这个角色,豆包也能当。
    2 replies  •  2026-10-11 18:26:56 +08:00
    yihui1709
        1
    yihui1709  
       38 mins ago
    GPT6-高用下来同样感觉有点弱,感觉是模型偷懒了
    hslr44
        2
    hslr44  
    OP
       26 mins ago
    @yihui1709 我特意问它是什么模型了,回答是“我是 GPT-6 ,OpenAI 的大语言模型。”所以我认为不是偷懒,单纯能力不够。
    之前我记得有段时间 5.6sol 模型会悄悄地切换成低模型,导致效果不好。我当时很震惊,我还以为这种事只有国产的企业才能做出来,没想到 openai 也一样
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   2850 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 23ms · UTC 10:53 · PVG 18:53 · LAX 03:53 · JFK 06:53
    ♥ Do have faith in what you're doing.