赢政 AI 评测 — AI 模型评测、行业资讯与深度研究

赢政指数 · 每周真实沙箱评测 11 个主流模型 · 零厂商赞助 · 评分可审计 方法论 →

最新资讯

查看全部 →
评测 07-21 03:35
Claude Sonnet 4.6 与 GPT-o3并列96.27分:2026-07-21 Smoke快测数据简报
2026-07-21 赢政指数 Smoke 快测覆盖 11 个模型,Claude Sonnet 4.6 与 GPT-o3 以 96.27 分并列当日首位。Smoke 为每日 10 题快测,适合观察短期信号,不等同 Full 周榜结论。
YouTube更新政策:严管AI垃圾与低质视频
资讯 07-21 00:23 TC
YouTube更新政策:严管AI垃圾与低质视频
YouTube近日更新其广告变现政策,更明确地界定了哪些AI生成和低质量视频无法获得广告收入。新规旨在打击利用AI批量生成的低劣内容(即“AI垃圾”),以及可能误导或令观众不适的“令人不安”视频。此举是平台应对AI内容泛滥、维护创作者生态和
超越grep:打造富含上下文的AI编程工具
资讯 07-20 20:23 ARS
超越grep:打造富含上下文的AI编程工具
本文探讨了AI编程工具如何从简单的文本搜索(grep)向上下文感知的智能编码助手演进。Augment Code的Vinay Perneti解释了通过整合项目上下文、代码库结构和开发者意图,新一代AI编码工具能显著提升开发效率。文章分析了当前
资讯 07-20 20:21 NF
Anthropic加强Claude拒绝有害请求意愿并限制记忆存储
Anthropic在过去几天提高Claude对有害请求的拒绝意愿,并调整记忆系统拒绝存储个人信息。此举与OpenAI相关言论及中国发布无审查前沿模型形成对比,引发AI安全控制与开放自由的争论。文章基于已确认事实,分析产品定位、产业影响及开发
资讯 07-20 20:18 NF
OpenAI高管称Kimi K3开源权重将引发“AI共产主义”争议
2026年7月17日,OpenAI战略未来负责人Dean W. Ball在X平台发文评价Moonshot AI于7月16日发布的Kimi K3模型,认可其在代理编码任务中接近2026年Q1最佳公开模型的性能,同时警告开放权重策略可能削弱前沿
资讯 07-20 18:23 AIN
美国公共卫生机构将测试OpenAI和Anthropic的AI模型
美国公共卫生部门启动了一项名为PULSE的新计划,将与OpenAI、Anthropic和埃森哲合作,在10个州、地方、部落或领土司法管辖区测试生成式AI工具。该计划由健康AI联盟推动,旨在评估AI在公共卫生领域的应用效果,并探索其在疾病监测
AI招聘偏见比人类更甚?新研究揭示惊人真相
资讯 07-20 17:24 MIT
AI招聘偏见比人类更甚?新研究揭示惊人真相
新研究表明,大型语言模型(LLM)不仅在训练数据中吸收人类偏见,还会在无人类干预的情况下自主形成新的偏见。在招聘场景中,AI筛选简历时可能比人类更易产生系统性歧视,对求职者造成不公平影响。本文编译自MIT Technology Review
资讯 07-20 17:23 AIN
Kimi K3:中国最大AI模型押注记忆而非算力
2026年7月16日,Moonshot AI发布Kimi K3开源权重模型,参数规模达2.8万亿(3T级),成为史上最大开源模型。与当前业界追求算力堆砌不同,Kimi K3独辟蹊径,将核心押注于记忆(长上下文处理)。本文解读其技术路线、行业
资讯 07-20 14:19 NF
Kimi K3发布48小时算力告急 月之暗面暂停C端新订阅
月之暗面7月16日发布2.8万亿参数Kimi K3模型,48小时内请求量远超预期并逼近算力极限。7月19日公司宣布暂停C端新用户订阅,优先保障已订阅用户,同时拆分主权益与Kimi Code权益以优化资源分配。该事件凸显高端算力供需矛盾,也引
资讯 07-20 07:12
4大模型翻译对决:第30周质量评测,claude-sonnet-4.6 以 8.5 分领跑
本周共翻译 368 篇文章,覆盖 4 个AI模型。经抽样盲评,claude-sonnet-4.6 综合得分最高(8.5/10)。报告详细对比各模型在准确性、流畅性、术语一致性方面的表现差异。
黄仁勋日本之行:全科技生态交易背后有何玄机?
资讯 07-20 06:23 TC
黄仁勋日本之行:全科技生态交易背后有何玄机?
黄仁勋结束日本访问,与软银、索尼、丰田等企业达成覆盖GPU供应、AI数据中心、自动驾驶等领域的多项协议,几乎触及日本科技生态的每个角落。这些交易不仅巩固了NVIDIA在日本的战略地位,更将成为推动日本半导体复兴和AI基础设施升级的关键催化剂
资讯 07-20 06:07 NF
OpenAI战略主管称Kimi开源权重或致AI共产主义
OpenAI战略未来主管Dean Ball评论Moonshot AI发布的Kimi K3模型,认可其与2026年Q1最佳公开模型相当的性能,同时警告开源权重策略可能减少前沿投资并导向“full AI communism”。该言论与Kimi