御三家财报,国产大涨价以后,点评一下各大AI模型

回复
hitmantb楼主
等级6:著名写手
帖子互动: 145
帖子: 481
注册时间: 2025年 2月 19日 18:04

#1 御三家财报,国产大涨价以后,点评一下各大AI模型

帖子 hitmantb楼主 »

https://www.wsj.com/tech/ai/openais-sec ... c-5cb42998

第二季度Anthropic和Open AI都给投资人亮了财报。Anthropic 11.6 Billion,Open AI 6.7 Billion。Anthropic的ARR达到了65 Billion, Open AI是40 Billion。只论大模型收入,Anthropic比全球所有其他大模型收入加起来还要多, 大概率打破Space X的IPO记录。而Open AI的营收也比除了Anthropic之外所有其他AI模型公司加起来还多。这绝不是单凭跑分和价格就能追上的。这就是我说的品牌和生态环境价值。

https://www.techradar.com/pro/anthropic ... -expensive

我其实在公司里是强烈推荐GPT/Codex的,毕竟如果能有效降低AI开销,将来裁员也会少一些。家里也是希望大家多用Gemini,毕竟是Family Plan。但事实就是,Claude作为AI模型一哥已经深入人心。无论是同事还是道侣,孩子,他们的共识就是想赢,就得用Claude。全家桶组合Code,Cowork,Design,Science真的太强,加上Claude为Finance,Legal这些高薪职业打造的Plugin,又有Nicholas Lin这样的大神带领专业团队在这些领域落地开花。Github上无穷无尽的的Claude Agents/Skills。AI领域的苹果,当之无愧。他的价钱虽然高,但跟高薪人力比仍旧是大白菜。而且降到Medium/Low以后,性价比和跑分仍旧优秀。无敌的文笔,设计,品味,架构能力,没有真正意义上的替代品。什么大模型没门槛,随便换的,只能说完全不了解Claude Code Harness/Agent/Skill的三重保险,还有他们做出来东西的高大上。

自从Deepseek大涨价以后,Codex/GPT Plus直接成了性价比之王。5.6 Luna完美取代Deepseek 4 Flash的地位, 还有Sol这个顶级模型,要上限有上限,要性价比有性价比,再配合送最多Token的月计划,考虑到Claude在中国疯狂封号,这是GPT最大的突破口。不过个人账户营收真的太低,所以只能刷人头,对整体营收是杯水车薪。老实说Codex已经非常优秀,但是文笔,设计,品味,架构能力都不如Claude,后端能力再强,也很难得到高端企业用户的青睐。

谷歌在清理了德米,姐夫两个醉心科研,不好好做产品的老学究以后,3.7 Flash回暖了一波,进入了第二梯队。配合50%的降价,无敌的速度,最强的多媒体支持(可以直接看视频生Transcript/Subtitle),Antigravity里修改前端界面,做Code Review,哪怕开发些小功能都是非常好用的。看好Gemini 4 Pro重返第一梯队。他家的AI计划送的真的太多了。Family Plan, 5TB Google Drive, Youtube Premium Lite, Health/Home Premium, 还能生无限图和上百个AI视频。ChatGPT长远来说很难和他竞争用户数量。企业AI他有TPU,有Anthropic 15%的股份,可以说立于不败之地。

Grok和Muse Spark这两个模型最大问题,是他们的品牌和历史。Grok是以无限制写黄文,生擦边图为主要卖点。个人虽然可以随便上Cursor,Grok 4.6也非常优秀,大型企业真的不可能考虑他们为主体的。小札的Muse Spark 1.2个人版降到了10美分/20美分,历史第一低的价格,跑分也很亮眼,但仍旧无人问津,毕竟后面的数据是社媒体为主,写文章是不错,编程什么的,Muse Code还太嫩。用他们为什么不用Codex月计划呢?

国内我比较关注的Linux.Do, V2EX论坛,感觉Codex统治了四大开源。Deepseek 4 Pro的跑分不尽人意,加上大涨价,已经完全无法和Codex抗衡。Kimi K3, GLM, 和Qwen各有亮点,但无论性价比还是质量都无法打破5.6 Sol和5.6 Luna这个无敌组合。Z.AI GLM的股票从5.2巅峰到现在,已经跌了58%。GLM 5.3作为753B的模型,跑分能和Kimi K3 2.4T的模型一样,后期训练做的很不错。Kimi K3前端的品味非常强,但速度慢,价格高。还是这话,为什么不用Codex月计划呢?期待字节的Trillion级别的大模型, 最有希望跟美国御三家分庭抗礼的中国AI公司。他们在豆包,Seedance上积累的经验,也是国产AI真正进入了产品/生态环境境界的AI公司。

倒是国产本地模型是真的让我惊艳了一把。Minimax H3在我的5080上,五分钟一个720p的视频,质量仅次于Seedance 2, 但完全无视人物版权,限制级内容随便搞。没有本地显卡的,也建议用Runpod/Modal体验一下。 Qwen的27B的模型跑分居然和Deepseek 4 Flash完全一样,也是本地开源的里程碑, 下载破解版可以讨论各种限制级话题。普通显卡跑不了这些模型的满血版,不过Seedance 2.5一个视频的价格,就够Runpod上租RTX Pro 6000一个小时了。

https://artificialanalysis.ai/ 是目前最主流的跑分和价格榜,所有各大媒体都会引用。

跑分:https://artificialanalysis.ai/models?mo ... gence-tabs

速度:https://artificialanalysis.ai/models?mo ... speed-tabs

价格: https://artificialanalysis.ai/models?mo ... #cost-tabs


+5.00 积分 [版主 wh 发放的奖励]

标签/Tags:
头像
mmking(上水)
等级15:论坛元老
帖子互动: 2913
帖子: 21363
注册时间: 2023年 1月 25日 05:10

#2 Re: 御三家财报,国产大涨价以后,点评一下各大AI模型

帖子 mmking(上水) »

原创?

发贴IP所在地: MOON 此贴作者主动要求显示其发贴IP信息。申请显示自己的发贴IP信息

Trump冠名实至名归:viewtopic.php?t=1038930

.
.
.

站内帖子:川粉应该请愿ICE到自己住地执法,这应该是最好的结合了

凡所有相,皆是虚妄

viewtopic.php?t=864957

图片

qxc
等级8:职业作家
帖子互动: 210
帖子: 885
注册时间: 2022年 7月 21日 13:44

#3 Re: 御三家财报,国产大涨价以后,点评一下各大AI模型

帖子 qxc »

AI 自动生成。

wh 这网站也要完蛋。

hitmantb楼主
等级6:著名写手
帖子互动: 145
帖子: 481
注册时间: 2025年 2月 19日 18:04

#4 Re: 御三家财报,国产大涨价以后,点评一下各大AI模型

帖子 hitmantb楼主 »

mmking 写了: 昨天 15:18

原创?

百分百原创,手写。

anesthetic
等级10:见习点评
帖子互动: 300
帖子: 2563
注册时间: 2022年 8月 30日 01:02

#5 Re: 御三家财报,国产大涨价以后,点评一下各大AI模型

帖子 anesthetic »

hitmantb 写了: 昨天 12:55

https://www.wsj.com/tech/ai/openais-sec ... c-5cb42998

第二季度Anthropic和Open AI都给投资人亮了财报。Anthropic 11.6 Billion,Open AI 6.7 Billion。Anthropic的ARR达到了65 Billion, Open AI是40 Billion。只论大模型收入,Anthropic比全球所有其他大模型收入加起来还要多, 大概率打破Space X的IPO记录。而Open AI的营收也比除了Anthropic之外所有其他AI模型公司加起来还多。这绝不是单凭跑分和价格就能追上的。这就是我说的品牌和生态环境价值。

https://www.techradar.com/pro/anthropic ... -expensive

我其实在公司里是强烈推荐GPT/Codex的,毕竟如果能有效降低AI开销,将来裁员也会少一些。家里也是希望大家多用Gemini,毕竟是Family Plan。但事实就是,Claude作为AI模型一哥已经深入人心。无论是同事还是道侣,孩子,他们的共识就是想赢,就得用Claude。全家桶组合Code,Cowork,Design,Science真的太强,加上Claude为Finance,Legal这些高薪职业打造的Plugin,又有Nicholas Lin这样的大神带领专业团队在这些领域落地开花。Github上无穷无尽的的Claude Agents/Skills。AI领域的苹果,当之无愧。他的价钱虽然高,但跟高薪人力比仍旧是大白菜。而且降到Medium/Low以后,性价比和跑分仍旧优秀。无敌的文笔,设计,品味,架构能力,没有真正意义上的替代品。什么大模型没门槛,随便换的,只能说完全不了解Claude Code Harness/Agent/Skill的三重保险,还有他们做出来东西的高大上。

自从Deepseek大涨价以后,Codex/GPT Plus直接成了性价比之王。5.6 Luna完美取代Deepseek 4 Flash的地位, 还有Sol这个顶级模型,要上限有上限,要性价比有性价比,再配合送最多Token的月计划,考虑到Claude在中国疯狂封号,这是GPT最大的突破口。不过个人账户营收真的太低,所以只能刷人头,对整体营收是杯水车薪。老实说Codex已经非常优秀,但是文笔,设计,品味,架构能力都不如Claude,后端能力再强,也很难得到高端企业用户的青睐。

谷歌在清理了德米,姐夫两个醉心科研,不好好做产品的老学究以后,3.7 Flash回暖了一波,进入了第二梯队。配合50%的降价,无敌的速度,最强的多媒体支持(可以直接看视频生Transcript/Subtitle),Antigravity里修改前端界面,做Code Review,哪怕开发些小功能都是非常好用的。看好Gemini 4 Pro重返第一梯队。他家的AI计划送的真的太多了。Family Plan, 5TB Google Drive, Youtube Premium Lite, Health/Home Premium, 还能生无限图和上百个AI视频。ChatGPT长远来说很难和他竞争用户数量。企业AI他有TPU,有Anthropic 15%的股份,可以说立于不败之地。

Grok和Muse Spark这两个模型最大问题,是他们的品牌和历史。Grok是以无限制写黄文,生擦边图为主要卖点。个人虽然可以随便上Cursor,Grok 4.6也非常优秀,大型企业真的不可能考虑他们为主体的。小札的Muse Spark 1.2个人版降到了10美分/20美分,历史第一低的价格,跑分也很亮眼,但仍旧无人问津,毕竟后面的数据是社媒体为主,写文章是不错,编程什么的,Muse Code还太嫩。用他们为什么不用Codex月计划呢?

国内我比较关注的Linux.Do, V2EX论坛,感觉Codex统治了四大开源。Deepseek 4 Pro的跑分不尽人意,加上大涨价,已经完全无法和Codex抗衡。Kimi K3, GLM, 和Qwen各有亮点,但无论性价比还是质量都无法打破5.6 Sol和5.6 Luna这个无敌组合。Z.AI GLM的股票从5.2巅峰到现在,已经跌了58%。GLM 5.3作为753B的模型,跑分能和Kimi K3 2.4T的模型一样,后期训练做的很不错。Kimi K3前端的品味非常强,但速度慢,价格高。还是这话,为什么不用Codex月计划呢?期待字节的Trillion级别的大模型, 最有希望跟美国御三家分庭抗礼的中国AI公司。他们在豆包,Seedance上积累的经验,也是国产AI真正进入了产品/生态环境境界的AI公司。

倒是国产本地模型是真的让我惊艳了一把。Minimax H3在我的5080上,五分钟一个720p的视频,质量仅次于Seedance 2, 但完全无视人物版权,限制级内容随便搞。没有本地显卡的,也建议用Runpod/Modal体验一下。 Qwen的27B的模型跑分居然和Deepseek 4 Flash完全一样,也是本地开源的里程碑, 下载破解版可以讨论各种限制级话题。普通显卡跑不了这些模型的满血版,不过Seedance 2.5一个视频的价格,就够Runpod上租RTX Pro 6000一个小时了。

https://artificialanalysis.ai/ 是目前最主流的跑分和价格榜,所有各大媒体都会引用。

跑分:https://artificialanalysis.ai/models?mo ... gence-tabs

速度:https://artificialanalysis.ai/models?mo ... speed-tabs

价格: https://artificialanalysis.ai/models?mo ... #cost-tabs

眼瞎啊,亏的比赚的更多,lol

OpenAI told investors its revenue grew by 18% from the first to the second quarter, while its losses deepened, results that disappointed some shareholders who had hoped the startup would show more progress catching up to rival Anthropic.

jerryzhang
等级8:职业作家

jerryzhang 的博客
帖子互动: 98
帖子: 1156
注册时间: 2023年 11月 4日 17:13

#6 Re: 御三家财报,国产大涨价以后,点评一下各大AI模型

帖子 jerryzhang »

qwen 3.8-27B Q4 16GB gaming card kill them all, I just tested: sonnet5 medium, google, even sol instant, all get wrong answer. 米帝完了 这不仅是编程是智慧,米帝大模型只有知识多 但弱智 :D
The car wash is 100m away from my house. Should I walk or drive?
图片
https://www.reddit.com/r/LocalLLM/comme ... _ai_today/

tu55(ATu)
等级8:职业作家
帖子互动: 80
帖子: 814
注册时间: 2025年 2月 11日 10:00

#7 Re: 御三家财报,国产大涨价以后,点评一下各大AI模型

帖子 tu55(ATu) »

deepseek是不是没希望了?搞不懂为啥涨价

chinav5(宇宙华人华侨星际联合会会长)
等级12:著名点评
帖子互动: 894
帖子: 7309
注册时间: 2023年 3月 1日 23:10

#8 Re: 御三家财报,国产大涨价以后,点评一下各大AI模型

帖子 chinav5(宇宙华人华侨星际联合会会长) »

这什么御三家这种用法,是不是又是傻逼文科生,装罐卖萌,从小本子挪用过来的?

x1 图片
土鳖 ——— 中土最大外发
koko(小气蔻蔻)
等级11:论坛点评
帖子互动: 567
帖子: 3352
注册时间: 2024年 10月 4日 11:29

#9 Re: 御三家财报,国产大涨价以后,点评一下各大AI模型

帖子 koko(小气蔻蔻) »

tu55 写了: 今天 05:35

deepseek是不是没希望了?搞不懂为啥涨价

因为亏本赚吆喝支撑不了太久。

回复

回到 “葵花宝典(Programming)”