转自:第一财经YiMagazine
DeepSeek V4 Pro上线一波三折,价格8月17日起大幅上调
8月12日23:30,DeepSeek V4 Pro-0813悄然上线。但据开发者社区反馈,该版本上线后出现多次异常,部分场景的表现甚至逊于V4 Flash。次日下午,该模型一度从API下线,并于当晚19:00再次上线,正式发布。
与正式版同步发布的还有API调价公告,新价格自北京时间8月17日0时起生效。调价后,高峰时段(9:00至12:00、14:00至18:00)则分别涨至0.3元、9元和27元,涨幅为1100%、200%和350%。
DeepSeek首款Agent产品公测
8月13日,DeepSeek发布其首款Agent产品DeepSeek Harness的开发者预览版(v0.1)并同步开放全部源代码。Harness指的是模型之外那层负责「让模型真正干活」的执行框架,OpenAI的Codex和Anthropic的Claude Code均属于这一层的产品。
DeepSeek Harness采取「一切皆插件」的设计思路,用插件式开放架构来构建Agent执行框架:模型、工具、技能、会话、隔离运行环境、存储、循环、调度、界面等Agent能力均由插件组合而成,可自由替换、灵活重组。开发者无需改动源码,就能像给手机装App一样按需增删组件,搭建属于自己的Agent。
Grok 4.6发布,重回第一梯队
8月12日,SpaceXAI发布最新旗舰模型Grok 4.6。在第三方测评平台Artificial Analysis智能指数中并列全球第三。该模型沿用与Grok 4.5相同的底座,改进主要来自后训练阶段;SpaceXAI称,在较长的任务链条上,模型会更频繁地自我检验,确认无误后再推进下一步。定价方面,Grok 4.6维持在每百万输入/输出Token 2美元/6美元,比Claude Opus 5和GPT-5.6 Sol低60%以上。
SpaceXAI推出Grok Bot测试版
8月11日,SpaceXAI推出Grok Bot早期测试版,既不是ChatGPT那样的聊天机器人,也不是WorkBuddy这样的AI办公应用,官方将其定位为「AI队友」。Grok Bot的本地界面类似微信,每个对话框就是一个有着特殊能力的Agent「AI队友」,用户通过对话框向不同「AI队友」发布工作任务。由于这些Agent都运行在云端专属电脑上,即使用户关闭本地设备也能继续执行任务。
智谱发布GLM-5.3,编程体感再提升50%
8月14日,智谱发布GLM-5.3,主要面向复杂编程、长程智能体和网络安全任务。在智谱内测中,GLM-5.3的编程体感较GLM-5.2提升50%。在从源代码出发识别并验证漏洞的CyberGym测试中,略高于智谱同时列出的Mythos 5(83.8)和GPT-5.6 Sol(83.6)。智谱称该模型在编程与智能体能力上接近Claude Fable 5。
此次升级没有更换GLM-5.2的基础模型,能力提升主要来自扩大后训练。智谱表示,由于模型的网络安全能力增长快于预期,智谱决定推迟公开权重,以降低模型被滥用于网络攻击的风险。
Sunday和Dyna先后发布基于头戴设备数据的机器人模型
8月11日,美国硅谷机器人公司Dyna Robotics发布具身智能大模型Dyna-2,训练团队表示: Dyna-2是一个世界动作模型(World Action Model),使用了超过100万小时的人类视频数据完成预训练。首次证明,不需要机器人数据,足量的人类数据就可以实现机器人跨本体的迁移,而且这种能力不会在后训练过程中损耗。
一个月前,另一家硅谷机器人公司Sunday Robotics发布的第二代具身模型ACT-2也采用了类似的数据策略,
荣耀发布全球首款机器人手机Robot Phone,起售价9999元
8月12日,荣耀发布全球首款机器人手机Robot Phone,官方称该产品将手机从传统触控工具迭代为具备感知与物理执行能力的智能终端,起售价为9999元。该机搭载行业最小4自由度机械云台。
AI交互是该机的主要差异点。产品首发YOYO Pro机器人交互模式,该方案由荣耀与阿里千问大模型联合完成终端适配,依托多模态识别能力,设备可通过手势、语音和声音感知联动云台,使摄像头随用户动作转向,适配自动追焦、智能构图、视频通话跟随等场景。
微信测试让AI代写朋友圈和点评
8月11日,腾讯确认,微信已灰度上线朋友圈AI辅助功能「AI帮写」和「AI点评」,这两项功能均处于小范围内测阶段,测试入口暂未开放主动申请。该功能由微信原生AI助手「小微」提供。
千问也开始收费,价格不到豆包的1/3
8月10日,阿里旗下AI应用千问App推出收费方案,「办公助理」会员套餐包括3档。起步档为高级会员:连续包月19元,连续包年200元。开通付费服务后,用户能通过千问实现产出网页文件、PPT文件、Word文件、代发邮件等功能,千问还会供应Skills为用户执行特定任务。
千问是继豆包之后第二家推出付费服务的中国头部AI应用。今年6月,豆包也推出了三档套餐。起步档为标准版:连续包月68元,连续包年688元;
腾讯、字节AI办公线下推广,地铁与写字楼成主要阵地
腾讯WorkBuddy与字节旗下TRAE Work围绕AI办公入口展开线下营销争夺。自5月以来,WorkBuddy的广告已从北京知春路、深圳高新园等地铁场景,延伸至写字楼、社区及家门口,并同步覆盖头部应用信息流。
字节的同类产品TRAE Work近期也加大线下曝光力度。在北京朝阳区一处住宅小区电梯内,TRAE Work广告替代了此前投放的WorkBuddy广告。
Claude挑战黎曼猜想失败,但提高了分数
8月11日,Anthropic在X发帖称,其尚未发布的Claude研究版尝试证明黎曼猜想未能成功,但模型将一项相关结论的已知下限从41.6%提高到了67.2%,刷新此前纪录。
ChatGPT取消免费版纯文本对话次数限制,周活用户破10亿
8月6日,OpenAI宣布取消ChatGPT免费版和Go版用户在纯文本对话中的次数限制。OpenAI表示,每周有10亿人使用ChatGPT,此次调整旨在进一步扩大AI工具的普及度。
Gemini月活破10亿,63%的用户直接用语音对话
8月11日,Google CEO桑达尔·皮查伊在社交平台X上宣布,Gemini独立应用的月活跃用户突破10亿,成为Google历史上增长最快的产品,也是公司第14款月活跃用户过10亿的产品。
Google官方博客同时公布了一批使用数据。语音正成为主要交互方式,63%的用户会直接通过语音与Gemini对话。此外每五次Gemini Live交互中就有一次超出纯语音范畴,用户通过实时摄像头或屏幕共享解决现实问题。
Ramp报告:最强模型卖不动,高性能溢价正在失效
8月12日,美国企业支出管理平台Ramp发布月度AI指数报告。在整体格局上,7月Anthropic采用率达43.5%,继续位列第一;OpenAI为39.7%,低于整体增速;xAI则占4%,创下为2025年7月以来最快增速。
在具体模型的使用上,Anthropic的旗舰模型Fable 5表现遇冷:发布一个月后,它仅占企业从Anthropic购买的Token总量的6%,占其在Anthropic模型上支出的11.4%。作为对比,OpenAI的旗舰模型GPT-5.6 Sol占该公司Token使用量的25%、支出的23%。Fable 5是目前性能最强的模型,但价格是GPT-5.6 Sol的两倍。Ramp首席经济学家Ara Kharazian认为,高性能模型将越来越难以维持高溢价。
腾讯AI投入吃光利润增长,高强度投入以今明两年为主
8月12日,腾讯发布2026年第二季度财报,当期营收2047.85亿元,同比增长11%、环比增长4%。利润端则受AI投入拖累:按国际财务报告准则计,公司归母净利润560.22亿元,同比仅增长0.7%。
本季财报的核心变量是AI驱动的高额资本开支,单季支出527.84亿元,同比增长176%,导致本季录得138亿元负自由现金流。腾讯在业绩公告中表示,本季大幅增加了算力采购并支付大额AI相关预付款,用于支持混元模型升级、WorkBuddy与CodeBuddy的推理需求、微信AI项目落地,以及满足外部客户对云服务持续增长的需求。若剔除算力采购的预付款项,自由现金流为正376亿元。
对此,腾讯总裁刘炽平回应称,本轮集中投入以今明两年为主,后续将依据收益动态控制规模。他同时表示,当前资本开支优先用于训练更高规格的混元大模型。