DeepSeek API 将整体上调价格,低价红利进入重新评估期
多位博主转述 DeepSeek 开放平台面向开发者发布的通知:近期将整体上调 API 服务定价,且预计涨幅较大,但具体价格和执行时间尚未公布。这一变化值得关注,是因为 DeepSeek 的低价已被大量 AI 产品接入生产环境,涨价会直接影响推理成本与套餐设计;当前公开信息只能确认“将涨价”,不能确认具体涨幅。
来源:
- @MaxForAI: https://x.com/MaxForAI/status/2085201870126207307
- @joshesye: https://x.com/joshesye/status/2085202981935518133
- @LufzzLiz: https://x.com/LufzzLiz/status/2085185242621706304
Wan3.0 进入公测,视频生成开始吸收文档与网页等上下文
阿里官方账号发布 Wan3.0 公测信息;可见介绍显示,它支持单次最长 30 秒视频生成,并将参考输入从文本、图片、音频和视频扩展到文档、表格、幻灯片、网页、Markdown 等格式。博主实测与整理还给出了 480p、720p、1080p 的按秒价格信息,说明视频模型的竞争点正在从单纯画质延伸到长时长、复杂上下文和可计算的生成成本。
来源:
- @Alibaba_Wan: https://x.com/Alibaba_Wan/status/2085339761284104529
- @xiaohu: https://x.com/xiaohu/status/2085359158556254567
- @op7418: https://x.com/op7418/status/2085370072332452212
SeedRealtime 把实时视频通话推进到全模态、全双工交互
一位博主的实测和技术整理显示,豆包视频通话升级后可以同时理解声音、画面、手势和物品,并在连续音视频流中进行实时判断;测试中它识别了视频人物,也能回看并解释短暂出现的图表。该博主还称相关能力已在豆包 App 全量上线,并展示了“看到指定展品时主动提醒”的案例;这些是可见的实测与转述,不应扩写成已被多方独立验证的性能结论。
来源:
- @vista8: https://x.com/vista8/status/2085278014712197534
- @vista8: https://x.com/vista8/status/2085278610693423477
Google DeepMind 调整管理分工,Hassabis 转向长期科学与 AGI 议题
Demis Hassabis 宣布不再负责 Google DeepMind 的日常管理,转任董事长并兼任 Alphabet 首席科学家;Google CEO Sundar Pichai 的公开说明显示,Koray Kavukcuoglu 将承担更多日常管理与 Gemini 相关职责。可见信息还显示,Hassabis 会把更多精力放在 AGI 长期战略、前沿科学和 Isomorphic Labs,这更像是管理职责重排,而不是其离开 Google。
来源:
- @demishassabis: https://x.com/demishassabis/status/2085034334914769203
- @sundarpichai: https://x.com/sundarpichai/status/2085033425736745093
- @MaxForAI: https://x.com/MaxForAI/status/2085038757254967397
Jeff Dean 等谷歌技术元老创办 Discovery Loop,目标指向自动化科研
Jeff Dean 公开宣布与 Sanjay Ghemawat、Oriol Vinyals、Quoc Le 共同创办 Discovery Loop,这支团队集中体现了 Google 早期基础设施、Google Brain 和 Gemini 时代的技术积累。可见介绍称,公司采用公共利益公司形式,初期聚焦让 AI 自动推进机器学习研究,覆盖提出假设、设计实验、运行和分析结果等环节;Alphabet 将投资并由 Google Cloud 提供算力支持的说法来自博主整理,仍应与创始人公告区分。
来源:
- @JeffDean: https://x.com/JeffDean/status/2085034604172603724
- @MaxForAI: https://x.com/MaxForAI/status/2085117178609844436
- @AndrewYNg: https://x.com/AndrewYNg/status/2085056542341271840
Meta 发布 Muse Code,编码 Agent 的价格优势伴随数据使用代价
Meta 官方宣布 Muse Code 进入测试版,定位是面向大型代码仓库执行规划、写代码和验证结果的终端编码 Agent,并由 Muse Spark 1.2 驱动。博主整理的可见价格显示,标准版输入每百万 Token 1.25 美元、输出 4.25 美元;同意 Meta 使用代码和交互数据改进产品的 Contributor 版本更便宜。价格、数据授权和实际能力需要放在一起比较,不能只看单项 benchmark 排名。
来源:
- @finkd: https://x.com/finkd/status/2085080750034940201
- @vista8: https://x.com/vista8/status/2085210456160104615
- @MaxForAI: https://x.com/MaxForAI/status/2085381526293000240
Prime Agent 把 Agent 框架本身作为性能变量,结果仍需独立复核
Prime Intellect 发布 Prime Agent,定位为可自我改进的 RLM harness,用于编程和长程自治任务。可见帖子称其使用 Opus 5,在 ARC-AGI-3 上达到 95.5%,而讨论中的基线为 30.2%;介绍的机制包括把上下文作为变量,以及让 Prompt、技能、记忆和子 Agent 随运行轨迹更新。另一位博主认为其创新性并不明显、传播可能带有推广因素,因此当前更稳妥的判断是:它提供了“换 Harness 可能显著改变模型表现”的可检验案例,而不是已被证实的通用结论。
来源:
- @PrimeIntellect: https://x.com/PrimeIntellect/status/2085086999267144083
- @xiaohu: https://x.com/xiaohu/status/2085357838755656027
- @Gorden_Sun: https://x.com/Gorden_Sun/status/2085319703715856835
视频模型实测显示,选择应按镜头任务分工而非只看总榜
多位博主的实测把模型差异落到了具体制作任务:Seedance 2.0 在子弹时间测试中的主体轨迹、物理连续性和匹配剪辑上更受认可;MiniMax H3 更适合 5—15 秒的产品广告、动态 UI 和带海报感的商业镜头;另一轮图生视频比较中,Seedance 的人物、运镜和参考图贴合度较好,H3 的画面清晰度和部分服装细节突出。可复用的结论不是“某模型全面最好”,而是先按镜头控制、材质表现、剧情完整度等要求选工具。
来源:
- @joshesye: https://x.com/joshesye/status/2085227513782190227
- @joshesye: https://x.com/joshesye/status/2085203898395156594
- @LufzzLiz: https://x.com/LufzzLiz/status/2085152634949030212
- @derek_wall90176: https://x.com/derek_wall90176/status/2085186337842614515
统计: 扫描时间线条数=480 命中的博主数=39 命中的推文总数=258 加权推文分=205.35 原创推文数=113 RT 推文数=49 抓取尝试次数=3 边界覆盖状态=tail_confidently_crossed_target_boundary