赢政 AI 评测 — AI 模型评测、行业资讯与深度研究

赢政指数 · 每周真实沙箱评测 11 个主流模型 · 零厂商赞助 · 评分可审计 方法论 →

最新资讯

查看全部 →
资讯 09-16 19:24 AIN
ChatGPT先驱发布Jev模型:程序化逻辑新突破
由ChatGPT共同发明人创立的TypeSafe公司正式走出隐身模式,发布专用AI模型Jev。该模型采用并行采样架构,是一种“系统一模型”,专为在生产环境中直接执行结构化概率决策而设计。与对话式语言模型不同,Jev旨在自动化程序化逻辑判断,
亚马逊Alexa+登陆印度,全面支持印地语
资讯 09-16 19:23 TC
亚马逊Alexa+登陆印度,全面支持印地语
亚马逊宣布其新一代AI助手Alexa+正式登陆印度市场,并首次加入印地语支持。在早期体验阶段,所有印度用户均可免费使用这一服务。此举标志着亚马逊在生成式AI领域的全球化布局加速,也凸显了印度作为全球AI竞争关键市场的战略地位。
资讯 09-16 14:26 NF
三星领投2.31亿美元押注荷兰推理芯片,供应链开始对英伟达结构性对冲
2026年9月15日,荷兰埃因霍温AI芯片初创公司Euclyd完成逾2亿欧元(约2.31亿美元)A轮融资,三星电子联合EQT、Somerset Capital Partners领投,前ASML总裁彼得·温宁克出任董事会主席。公司正在开发推理
资讯 09-16 14:20 NF
ChatGPT联合发明人推出Jev:放弃文字生成,宣称AI推理降本400倍
ChatGPT关键方法RLHF与InstructGPT的联合作者Diogo Almeida,创立TypeSafe AI并推出首款"系统一"决策模型Jev。该模型放弃逐词生成文本,改为并行输出结构化判断,官方声称速度提升20至200倍、成本降
资讯 09-16 13:00 NF
OpenAI前研究员Diogo Almeida携4000万美元推出Jev无幻觉决策模型
2026年9月15日,Diogo Almeida创立的TypeSafe AI发布Jev模型并宣布4000万美元融资。该模型采用RLCD算法,输出结构化类型值,响应时间70-500ms,无法产生幻觉,专攻分类打分路由等决策任务,与现有LLM形
黄仁勋:AI无需监管 安全应由开发者自负
资讯 09-16 09:23 TC
黄仁勋:AI无需监管 安全应由开发者自负
英伟达CEO黄仁勋在最新发言中明确反对AI专项监管,认为AI只是硬件与软件的结合,并非科幻中的“外星心智”。他主张各AI产品制造商应自行负责安全工程,而非依赖政府法规。这一立场与OpenAI、Anthropic等同行呼吁监管的态度形成鲜明对
资讯 09-16 09:15 NF
谷歌9月15日向全体工程师开放Claude Opus 5 内部承认Gemini编码能力不足
2026年9月15日,谷歌通过Antigravity平台向全体工程师开放Claude Opus 5访问权限,官方仍称Gemini为主要模型,但承认此举源于Gemini在复杂编程任务上的不足及员工不满。这是全球最大AI厂商首次系统性允许工程师
资讯 09-16 09:00 NF
CoT监控遇计划注入攻击 斯坦福论文显示25-33%绕过率
斯坦福研究团队2026年9月14日在arXiv提交论文,发现向Actor模型植入表面无害的推理计划,可在25-33%情况下绕过Monitor安全检测,且额外算力可能降低检测率。该发现直接挑战CoT监控依赖模型推理可被外部检查的前提,论文还显
AI数据中心热潮撞上工业伤城:费城说不
资讯 09-16 06:23 TC
AI数据中心热潮撞上工业伤城:费城说不
针对数据中心建设的全国性抗议蔓延至费城:当地官员提出,可能在一个曾被现已停业的炼油厂长期影响的社区内建设数据中心,引发居民强烈反弹。从电价、用水到噪音与税收减免,AI基础设施的外部成本正成为地方政治的核心议题,科技公司惯用的低阻力选址模式正
资讯 09-16 06:17 NF
Grok 4.7五次跳票后,xAI直推4.8:2.5万亿参数C++重写,路线图指向AGI
xAI于2026年9月13日宣布Grok 4.8进入训练尾声,参数量2.5万亿,采用自研C++训练栈,训练效率声称高于JAX一个数量级。与此同时,Grok 4.7因强化学习调参问题历经五次延期至今未发,Musk最新将其定位为"大致与Opus
资讯 09-16 06:11 NF
英国跨党派委员会:全球AI监管无一合格,百页报告呼吁立法
2026年9月14日,英国议会联合人权委员会发布百页报告,指出全球包括英国在内没有任何国家的AI监管框架"符合目的",呼吁立法建立法定独立监管机构,赋予制裁权,禁止若干高风险AI应用,并要求政府两月内正式回应。报告出台时机敏感:恰逢Anth
资讯 09-16 05:13 Winzheng Lab
WDCD Run #326: DeepSeek V4 Pro and Gemini 3.1 Pro Achieve Perfect Decay Resistance as Fleet Average Drops 72.7%
WDCD Run #326 (2026-09-16) tested 11 models on multi-turn commitment integrity, recording an average commitment decay of