设为首页
收藏本站
开启辅助访问
全部
问与答
创意
技术
酷工作
生活
交易
节点
飞墙
Follow
明白贴
工算小助手
登录
注册
飞社-令人惊奇的创意工作者社区-
›
首页
›
程序员
›
kimi K2 Thinking 都这样的玩的话,如何作为参考依据呢 ...
FSHEX=FIND+SHARE+EXPRESS
飞社-令人惊奇的创意工作者社区- 是一个关于发现分享表达的地方
现在登录
没有账号?
立即注册
推荐主题
›
别再神化 VS Code 了,现在的它臃肿得像个
›
奶茶店的奶茶到底健康吗?
›
微信利用垄断地位作恶
›
用了安卓一段时间发现有个奇怪的现象
›
「第一份工作决定了整个职业生涯」是真的吗
今日热议主题
你们情人节,生日都收到过什么礼物?
年前公司最后一顿酒
MK 机场, 2026 新年特惠
sync-cdn-ssl + acme.sh,阿里云和七牛 CDN
Xcode 26.3 RC 终于支持 Agent 了,大家怎
开源图床 Fast Image
Google one ai pro Gemini
有 ipv4,ipv6 双栈, 路由器怎么设置合理
中美 AI 大战:技术普惠还是体验困局?
Github 私有项目授权许可平台 GitStore v1.
显示全部
|
最新评论
17 条回复
·
1893 次点击
11#
Leoking222
初学
2025-11-10 14:00:38
国内:跑分没输过,实战没赢过
12#
Leoking222
初学
2025-11-10 14:01:24
@jasonjie2015 国产所有的模型都在对比 Claude ,但其实他们都只达到了 Claude sonnet 3.7 的水平 🤣
13#
maolon
小成
2025-11-10 14:39:57
首先所有榜单都只能是参考,每个人的用法天差地别,其次这些榜单每一个都是有侧重点的 另外还有一个很简单的判断方法,什么时候 claude 和 openai 开始对标国产模型了,那他们就真超越了。 谁对标谁就用被对标的那个, simple as that
14#
fbu11
初学
2025-11-10 15:00:23
跟国内还是国外没关系,GPT5 也一样,每个大模型的跑分榜单模式都是这样的,他们上榜说是吊打 XXX 模型,都是有特定条件的
15#
lance07
初学
2025-11-10 15:41:46
都这样,gpt 之前还测评作弊。差距有但不是在这里
16#
snw
小成
2025-11-10 15:44:17
试过用免费版的 K2 Thinking 模式找些数据,结果思维陷入死循环了: > 一会儿说我在网上找到了一个数据 a ,但很难找到其他数据,也许我应该去官方信源找数据。 > 过了十来分钟,又说我在网上找到了一个数据 a (和上面一样),但很难找到其他数据,也许我应该去官方报告找数据 > ...... 如此循环了将近十次,然后直接清空了前面所有思考过程,输出空白。旁边提示可以试试付费版投入更多算力😂
17#
snw
小成
2025-11-10 15:48:01
@snw 又看了下,是提示“深度研究额度已用尽”。 反正看试用版这表现我是不敢付费的,看起来额度被死循环耗尽了。
18#
zhangeric
小成
2025-11-10 16:11:45
楼主就是把外国人想的太好了啊.
1
2
/ 2 页
浏览过的版块
生活
剧集
Apple
交易
问与答
返回顶部