最大涨幅
文心一言 4.0
+15
+15
事故报告
本周 2 起
价格变化
0 项更新
别只看总分,看你要拿它干什么
推荐第一
豆包 Pro
92.2 分
第二选择
Gemini 2.5 Pro
89.4 分
第三选择
Grok 3
88.9 分
推荐第一
Gemini 2.5 Pro
47.2 分
第二选择
Claude Opus 4.6
46.3 分
第三选择
豆包 Pro
46.3 分
推荐第一
Grok 3
84.4 分
第二选择
Claude Sonnet 4.6
81.1 分
第三选择
Claude Opus 4.6
79.7 分
推荐第一
DeepSeek V3
99.7 分
第二选择
文心一言 4.0
98.5 分
第三选择
豆包 Pro
93 分
推荐第一
豆包 Pro
38.9 分
第二选择
Gemini 2.5 Pro
36.6 分
第三选择
Claude Opus 4.6
36.6 分
今天值得看的,不止热闹
我们只放会影响能力、价格、稳定性和选型判断的内容。
推荐
资讯
马斯克与佩奇的AI安全之争:当"物种主义"成为科技巨头的分歧点
在OpenAI相关法庭证词中,特斯拉CEO马斯克透露了他与谷歌联合创始人佩奇在AI安全问题上的根本分歧。佩奇曾批评马斯克是"物种主义者",认为他过分强调人类利益。这场争议揭示了科技领袖对AI未来发展路径的不同理解,引发业界对AI伦理和安全边界的深入思考。
推荐 资讯
苹果iOS 27重磅预告:AI照片编辑功能全面革新,挑战Android霸主地位
苹果公司计划在iOS 27和macOS 27中推出革命性的AI照片编辑功能,包括智能扩展、增强和重构等特性。这项基于设备端Apple Intelligence模型的新功能,旨在提升用户体验并加强与Android平台的竞争优势。
推荐 资讯
当机器人迎来ChatGPT时刻,别忘了这些钳子
从分拣鸡块到拧灯泡,Eka公司的机器人表现出了惊人的逼真度。但这是否意味着它们真正拥有了物理智能?本文深入探讨了机器人技术的最新突破,以及这些“灵巧钳子”如何预示着一个新时代的到来——当机器人学会像人类一样感知和操作世界时,我们该如何理解这种“智能”的本质?
资讯
前推特CEO创立的AI代理公司五个月估值翻倍至20亿美元
由前Twitter CEO Parag Agrawal创立的AI代理初创公司Parallel Web Systems,在短短五个月内再次完成1亿美元融资,由红杉资本领投,估值飙升至20亿美元。这家专注于AI代理工具的公司,凭借其创新的技术和对企业级AI应用的精准定位,迅速成为资本市场的宠儿。本文将深入分析其崛起背后的行业逻辑与市场前景。
资讯
AI视频只是前奏?Runway CEO预言世界模型是下一站
AI生成视频从新奇事物迅速演变为创意工具,Runway公司身处变革前沿。这家纽约初创公司已融资近8.6亿美元,估值达53亿美元,其模型正与谷歌、OpenAI等巨头正面交锋。CEO克里斯托瓦尔·巴伦苏埃拉认为,AI视频只是通向“世界模型”的序章——未来的AI不仅能生成画面,更能理解物理规律、预测行动后果,从而重塑电影制作、游戏开发和机器人技术。
资讯
OpenAI Codex指令暗藏玄机:禁止提及地精
Ars Technica报道,OpenAI的Codex系统提示中包含一条明确指令,要求模型“永远不要谈论地精”,同时还要求其表现得“拥有丰富的内心世界”。这一发现引发了对AI系统安全与行为控制的讨论,揭示了开发者如何通过隐藏指令塑造AI的响应。
不是所有 AI 新闻都值得看。值得看的,是会改变你判断的那几条。 看全部资讯
为什么这个榜单值得看
不是因为我们声音大,而是因为方法公开、规则固定、结果可追溯。
代码真跑
不是看起来会写就算对。我们把代码扔进沙箱里跑。跑不通,就是零分。
引用必查
长文档题不只看答案像不像,更看引用对不对。该标出处的地方,必须能对回原文。
统计定榜
不看一次发挥,看连续表现。排名按滚动均值计算,避免被单次运气带偏。
不接赞助评测
不做合作评测,不做评测前沟通,不替任何模型留面子。跑出来什么,就发什么。
AI 世界每天在变,你需要一个靠谱的信息源
每天 3 条精选,每周 1 份指数变化,重要事故和价格波动第一时间通知。免费,无广告,随时退订。
- 每日精选 — 从海量 AI 新闻里,挑 3 条真正值得看的
- 赢政指数周报 — 谁涨了谁跌了,一封邮件讲清楚
- 模型事故告警 — 你在用的模型翻车了,尽快知道
- 价格变动提醒 — API 涨价降价,别等账单来了才发现
免费 | 无广告 | 无赞助软文 | 随时退订
想看更深的拆解,再往下走
排行榜回答'谁更强',Research Lab 负责回答'为什么会这样'。模型安全、边缘部署、性能拆解——不是转述别人的论文,是自己跑出来的结论。
进入 Research Lab