转寄人: ZabraZoe (ZabraZoe)
标 题: 腾讯的混元和workbuddy是谁在说可用的?纯唐氏啊,连百度都不如
发信站: 水木社区 (Sat Jul 4 10:48:02 2026)
来 源: 120.245.107.123
【以下内容由 ZabraZoe 转寄于 NewExpress 版】
标 题: 腾讯的混元和workbuddy是谁在说可用的?纯唐氏啊,连百度都不如
发信站: 水木社区 (Sat Jul 4 10:48:02 2026)
来 源: 120.245.107.123
【以下内容由 ZabraZoe 转寄于 NewExpress 版】
之前有些网红测评员把腾讯混元排百度文心前面,说混元和deepseek v4 flash水平差不多。
我让混元3做了今年的高考数学上海卷,得了94分。让它对战参考答案对其他模型的解答判卷,它完全看不懂解答题,选择题的得分也加错。deepseek v4 pro分析的是,混元3完全没有判卷能力,只是生成了一个像是判卷结果的幻觉文件。
混元3在同一个对话里,判自己的解答,都记不得自己之前说了什么。
这完全是2022年的ai水平啊。
居然买通知乎网红,把自己排百度前面了。
嗯,送一程。
【 在 Engelberger 的大作中提到: 】
: 之前有些网红测评员把腾讯混元排百度文心前面,说混元和deepseek v4 flash水平差不多。
: 我让混元3做了今年的高考数学上海卷,得了94分。让它对战参考答案对其他模型的解答判卷,它完全看不懂解答题,选择题的得分也加错。deepseek v4 pro分析的是,混元3完全没有判卷能力,只是生成了一个像是判卷结果的幻觉文件。
: 混元3在同一个对话里,判自己的解答,都记不得自己之前说了什么。
混元不行,workbuddy 还可以。
workbuddy 可以用其他模型,包括 ds。
【 在 Engelberger 的大作中提到: 】
: 之前有些网红测评员把腾讯混元排百度文心前面,说混元和deepseek v4 flash水平差不多。
: 我让混元3做了今年的高考数学上海卷,得了94分。让它对战参考答案对其他模型的解答判卷,它完全看不懂解答题,选择题的得分也加错。deepseek v4 pro分析的是,混元3完全没有判卷能力,只是生成了一个像是判卷结果的幻觉文件。
: 混元3在同一个对话里,判自己的解答,都记不得自己之前说了什么。
你这AI也没啥记忆,我记得跟你说过腾讯模型垃圾但是harness无敌
它家对中国式工作流理解无人能敌,我现在都把gpt5.5接入workbuddy用。
【 在 Engelberger 的大作中提到: 】
: 之前有些网红测评员把腾讯混元排百度文心前面,说混元和deepseek v4 flash水平差不多。
: 我让混元3做了今年的高考数学上海卷,得了94分。让它对战参考答案对其他模型的解答判卷,它完全看不懂解答题,选择题的得分也加错。deepseek v4 pro分析的是,混元3完全没有判卷能力,只是生成了一个像是判卷结果的幻觉文件。
: 混元3在同一个对话里,判自己的解答,都记不得自己之前说了什么。
: 这完全是2022年的ai水平啊。
: 居然买通知乎网红,把自己排百度前面了。
混元腾讯自己都不用吧
我workbuddy就是ds 4 flash和pro
【 在 Engelberger 的大作中提到: 】
: 之前有些网红测评员把腾讯混元排百度文心前面,说混元和deepseek v4 flash水平差不多。
: 我让混元3做了今年的高考数学上海卷,得了94分。让它对战参考答案对其他模型的解答判卷,它完全看不懂解答题,选择题的得分也加错。deepseek v4 pro分析的是,混元3完全没有判卷能力,只是生成了一个像是判卷结果的幻觉文件。
: 混元3在同一个对话里,判自己的解答,都记不得自己之前说了什么。
哈哈
【 在 netv 的大作中提到: 】
: 你这AI也没啥记忆,我记得跟你说过腾讯模型垃圾但是harness无敌
: 它家对中国式工作流理解无人能敌,我现在都把gpt5.5接入workbuddy用。
: 【 在 Engelberger 的大作中提到: 】
: : 之前有些网红测评员把腾讯混元排百度文心前面,说混元和deepseek v4 flash水平差不多。
越这么搞知道他是垃圾的不就越多吗?腾讯的脑袋被企鹅踢了?
【 在 Engelberger 的大作中提到: 】
: 之前有些网红测评员把腾讯混元排百度文心前面,说混元和deepseek v4 flash水平差不多。
: 我让混元3做了今年的高考数学上海卷,得了94分。让它对战参考答案对其他模型的解答判卷,它完全看不懂解答题,选择题的得分也加错。deepseek v4 pro分析的是,混元3完全没有判卷能力,只是生成了一个像是判卷结果的幻觉文件。
: 混元3在同一个对话里,判自己的解答,都记不得自己之前说了什么。
: 这完全是2022年的ai水平啊。
: 居然买通知乎网红,把自己排百度前面了。
和trae是什么区别
【 在 HarveyXYZ 的大作中提到: 】
: 混元不行,workbuddy 还可以。
: workbuddy 可以用其他模型,包括 ds。
: 【 在 Engelberger 的大作中提到: 】
: : 之前有些网红测评员把腾讯混元排百度文心前面,说混元和deepseek v4 flash水平差不多。
: : 我让混元3做了今年的高考数学上海卷,得了94分。让它对战参考答案对其他模型的解答判卷,它完全看不懂解答题,选择题的得分也加错。deepseek v4 pro分析的是,混元3完全没有判卷能力,只是生成了一个像是判卷结果的幻觉文件。
wk还可以
【 在 Engelberger 的大作中提到: 】
: 之前有些网红测评员把腾讯混元排百度文心前面,说混元和deepseek v4 flash水平差不多。
: 我让混元3做了今年的高考数学上海卷,得了94分。让它对战参考答案对其他模型的解答判卷,它完全看不懂解答题,选择题的得分也加错。deepseek v4 pro分析的是,混元3完全没有判卷能力,只是生成了一个像是判卷结果的幻觉文件。
: 混元3在同一个对话里,判自己的解答,都记不得自己之前说了什么。
: 这完全是2022年的ai水平啊。
: 居然买通知乎网红,把自己排百度前面了。
姚神也无力回天吗
论坛助手,iPhone
企鹅家虽然模型能力不行,但是他们做事比较实际
workbuddy里面可以接自定义模型,但是qoderwork(注意是work不是qoder)和traework都不行。
qoderwork积分用完了你就得排队,而traework你不给钱就只能排队。
而workbuddy甚至可以接免费的模型一直白用。
所以这样看起来倒是他家最良心
【 在 mahb 的大作中提到: 】
: 和trae是什么区别
: 【 在 HarveyXYZ 的大作中提到: 】
: : 混元不行,workbuddy 还可以。
: : workbuddy 可以用其他模型,包括 ds。
wb
【 在 carrort 的大作中提到: 】
: wk还可以