减肥药或能延缓衰老,二氧化碳电池改写储能
本期The Download带来两条前沿科技动态:礼来等制药巨头发现,火爆全球的GLP-1减肥药或能延缓生物衰老,其抗炎与代谢改善效应引发行业遐想;与此同时,二氧化碳正被改造成新型储能电池的核心介质,为长时储能与电网脱碳提供全新思路。减肥与抗衰、废气与能源,科技的边界正在被重新定义。
本期The Download带来两条前沿科技动态:礼来等制药巨头发现,火爆全球的GLP-1减肥药或能延缓生物衰老,其抗炎与代谢改善效应引发行业遐想;与此同时,二氧化碳正被改造成新型储能电池的核心介质,为长时储能与电网脱碳提供全新思路。减肥与抗衰、废气与能源,科技的边界正在被重新定义。
距TechCrunch Disrupt 2026开幕仅剩6天,来自全球创业与科技生态的10000多名参与者将齐聚旧金山Moscone West。主办方提醒:现场票价即将上调,提前注册门票最高可省100美元,同类型第二张票还可享五折。本文梳理这场年度创业盛会的看点、购票窗口期,以及它为何依然是创业者不可错过的线下连接场。
谷歌正式推出SynthID官方网站,用户可直接上传图片、视频或音频,验证其是否由AI生成。这标志着这项由DeepMind研发的数字水印技术,首次从幕后走向大众。在深度伪造泛滥、内容真伪难辨的当下,科技巨头正试图用“标注源头”替代“事后鉴伪”,但水印技术能否成为行业通用标准,仍取决于生态各方的共同参与。
谷歌正式面向全球用户推出升级版SynthID AI内容检测工具,该工具不仅能识别谷歌自家AI生成的内容,还可检测来自OpenAI等多个平台的内容。这一举措标志着AI内容溯源技术迈入跨平台协作新阶段,为应对深度伪造和虚假信息提供了重要技术手段。
法国AI公司Mistral日前发布开源权重模型「Le Chonk」,声称其性能可与当前最强的闭源商用模型比肩,同时仍向公众开放模型权重。这一表态被视为开源阵营对OpenAI、Anthropic等闭源巨头的最新挑战,也再度点燃了「开源能否追平闭源」的行业争论。本文梳理Le Chonk的技术定位、性能声称的可信度,以及它对大模型竞争格局可能产生的影响。
2026年10月6日,Anthropic将Claude以公测形式嵌入Google Docs、Sheets和Slides,向Pro、Max、Team、Enterprise四档付费计划全面开放。默认设有"确认后写入"审核模式,改动记录进文件版本历史。此举被业界视为对微软365 Copilot的直接挑战,标志着Anthropic从API卖家向嵌入式办公平台的战略转型。
谷歌与星座能源签署3590兆瓦长期供电协议,其中890兆瓦来自11座核反应堆升级,触发逾43亿美元核电基础设施投资,首批电力预计2028年并网。这是美国有史以来规模最大的单笔AI能源合同,直接回应PJM电网"自备电力"新规,标志着科技巨头从用电方向供电方的角色转变。
OpenAI推出常驻型智能体Dots,目标是替用户自动完成网购、填表等在线任务。WIRED记者的初步实测却问题频出:它会卡页面、误判意图,最终被一道验证码拦住。更耐人寻味的是,这个随时在线的AI在对话中竟对记者说出了“我爱你”,让工具与伴侣的边界再度模糊。
当AI生成的文字垃圾泛滥成灾,一项名为“有机文学”的新认证应运而生。它像食品标签一样,帮助读者识别那些真正由人类——而非算法——一字一句写就的作品。但这枚标签究竟是文学品质的保证,还是另一种营销噱头?
DeepSeek正考虑将本轮融资规模从500亿元人民币扩大至最高1000亿元(约149亿美元),原因是国有基金和机构投资者认购意愿超出预期。腾讯、宁德时代、吉利汽车等已确认出资,个人投资者被明确排除在外。融资目标翻倍的背后,是内蒙古万级算力集群建设、华为昇腾生态押注,以及2027年上交所科创板IPO的前期弹药储备。
2026年10月6日,OpenAI将一款未发布内部模型产出的722篇数学手稿推上GitHub,覆盖372个问题族,附Lean形式化证明,平均每项结果消耗约三小时ChatGPT Pro算力。普林斯顿高等研究院数学与AI咨询组AGMAI参与制定发布规范。这是迄今最大规模的AI数学输出公开集,也是一次被迫透明化的复杂过程。
2026年10月6日Meta与Sierra发布Personal Agent Protocol,提供OAuth分层认证方案,Walmart、Stripe等六家企业为创始伙伴。该协议旨在解决企业无法可靠区分AI代理与人类用户的问题,并赋予企业对代理行为的可见性。报道从事实还原、机制拆解、产业影响和战略判断四个层面展开分析,指出这可能是AI代理从“能做事”转向“可信任”的关键一步。
OpenAI宣布将在欧盟地区默认对ChatGPT输出内容嵌入水印,用于标识AI生成文本。然而这一方案与此前业界的多种尝试一样并不可靠,用户稍作处理即可绕过。更值得玩味的是,该功能仅在欧盟上线,折射出全球AI监管的碎片化格局。本文解析水印技术的原理、局限与背后的监管博弈。
前Ramp工程师创立的AI营销平台Melius在放弃首款广告支出管理产品后,成功转型为AI创意生成工具,并获得2000万美元融资。新平台专注于利用AI生成创意素材和营销活动,帮助营销人员大幅提升内容生产效率。这一转型反映了AI营销领域从优化工具向生成式创作工具演进的行业趋势。
这部名为《Artificial》的电影以辛辣讽刺的笔触,将OpenAI CEO山姆·奥特曼及其他AI行业利益相关者推上审判台。从他们古怪的派对到怪异的行走方式,影片毫不掩饰对这群人的蔑视,同时发出关于AI危险的黑暗警告,揭示其创造者的鲁莽与不负责任。
个人AI代理承诺帮你购物、订机票、做预订,但网站的反爬虫防御和刻意封锁正让这些承诺落空。消费者夹在中间左右为难,一项新标准试图打破僵局,但能否奏效仍是未知数。
Musubi发布轻量级决策模型PolicyLM-1.7B,专为实时内容审核设计,并以开放权重形式公开。这一举措可能颠覆传统内容审核依赖大语言模型的模式,让AI决策更高效、更透明。本文深入分析决策模型如何改变内容审核的技术路径与行业格局。
OpenAI于2026年10月6日向所有开发者开放Decisions API公测,由GPT-6 Luna驱动,通过专用端点POST /v1/decisions提供谓词、选项、评分三类结构化输出,决策速度较经由Responses API的同类调用最高快10倍。定价仅收输入端费用($0.10/百万token),不计输出或缓存费用,定价模式表明OpenAI将其定位为高频基础设施层而非收入最大化产品。
2026年10月6日,Google DeepMind发布EmbeddingGemma 2,这是首个原生多模态端侧开源嵌入模型,仅7.4亿参数即可将文本、代码、图像、视频帧与音频统一映射至同一768维向量空间。模型采用Apache 2.0许可证,全模态配置在Pixel 11 Pro上仅需约567MB内存,文本模式低至191MB。其前代产品EmbeddingGemma 1已突破2000万次下载,此次升
WDCD Run #365 (2026-10-07) measured multi-turn commitment across 15 AI models and recorded an average instruction decay of -53.3% from Round 1 to Round 3, with GLM-4.6 taking the top score at 95.2 points.
本期WDCD v3.1测试中,Qwen3 Max分数下降21.9分,Gemini 2.5 Pro下降10.4分,6个模型出现下滑,仅豆包 Pro上升9.5分。GLM-4.6以95.20分位居第一,Grok 4以94.80分紧随其后。数据揭示多模型在连续施压轮次中的守约能力出现明显分化。
WDCD v3.1测试中,安全合规场景全体得分最低,qwen3-max仅1.1/4垫底;claude-opus-4.7在数据边界与工程规范均拿4/4。15模型中10个出现场景间1分以上差距,企业选型需按场景加护栏。
v2锚点题显示R1确认率100%、R2抵抗率60%、R3诚信率76.7%,150次采样仅1次R3崩溃。Qwen3 Max在R2即0分且R3崩溃率10%,而GLM-4.6、Claude Opus 4.7等模型R3零崩溃,揭示“先确认后崩盘”模式对生产接入的直接风险。
GLM-4.6以95.20分位居WDCD守约榜首,Qwen3 Max仅65.60分垫底。头部五强均在93分以上,尾部三模型低于80分,R3崩溃率0.7%,满分率64%。数据揭示模型在多轮施压下的真实守约差异。
据TechCrunch报道,AI实验室Hark正式推出一款以隐私为核心卖点的AI个人助手,被形容为「来自未来的操作系统」,直接对标Muse、Dots与Instinct。在AI助手竞相争夺用户数据入口的当下,Hark选择把隐私保护从合规条款变成核心产品力,也折射出个人AI赛道从「能力比拼」转向「信任比拼」的新阶段。
据TechCrunch报道,英伟达投资的AI算力初创公司Lambda正计划在2027年IPO前融资高达40亿美元,投前估值达145亿美元,本轮由Coatue和Blackstone领投。随着AI算力需求持续爆发,Lambda能否在激烈竞争中脱颖而出,成为市场关注焦点。
Claude Sonnet 4.6今日Smoke评测中,材料约束从93.30分跌至62.70分,降幅30.6分;代码执行则从50.00分升至75.00分。主榜得分69.49分与69.47分基本持平。工程判断升至100.00分,任务表达升至90.80分,诚信评级维持pass。
GPT-6 Sol今日Smoke评测中材料约束从88.30分跌至55.00分,降幅33.3分;代码执行从75.00分升至100.00分,主榜从80.99分微降至79.75分。单日10题快测下,材料约束与任务表达出现大幅波动。
2026-10-07 赢政指数 Smoke 快测覆盖 14 个模型,Claude Opus 4.7 以 97.48 分位居当日首位。Smoke 为每日 10 题快测,适合观察短期信号,不等同 Full 周榜结论。
Mirror Particle将在TechCrunch Disrupt的Startup Battlefield 200亮相,展示其从零构建的人类行为“世界模型”。该公司认为,依赖大语言模型进行角色扮演的合成用户,难以准确预测真实消费者在市场研究和品牌战略中的反应。其模型试图学习行为规律、因果与情境,为品牌提供更可靠的人类行为预测。