前沿能力与开放权重开始同场竞争
Qwen3.8-Max 以2.4T总参数、1M上下文亮相;GLM-5.3则在同一约744B基座上通过后训练继续提高编码表现。
AI Technology Intelligence Report
从全球模型竞争的三个新维度,到一位教学场景使用者借助AI完成工具开发:本报告关注的不只是模型变强,更是开发能力开始走向每个人。
01 / Executive Signals
8月不是单纯的“模型更大”。开源权重、实时速度、原生多模态与内容透明度,正在成为新的竞争坐标。
Qwen3.8-Max 以2.4T总参数、1M上下文亮相;GLM-5.3则在同一约744B基座上通过后训练继续提高编码表现。
GPT-5.6 Sol Ultrafast 官方预览最高可达14倍速度、约750 token/s。等待时间本身开始决定协作产品体验。
Seedance 2.5强化长叙事、参考与编辑,SeedRealtime强调音视频全双工。竞争重点正从单次输出转向连续、可控的完整工作流。
欧盟AI Act第50条相关义务自8月2日起适用;该日期前已投放的既有系统有过渡安排。
短期选型建议同时记录四项:能力、延迟、部署可控性、透明度合规。只看排行榜分数,已不足以支持真实业务决策。
02 / Technology Iteration
按“可影响产品与技术决策”的标准筛选,并纳入7月31日发布、在8月进入扩散应用的窗口边界事件。日期以官方发布或可验证公告为准。
2.4T总参数、1M上下文窗口;发布后按计划开放模型权重。它把超大规模基座能力与可控部署放到同一张选型表里。
V4-Pro并非8月首次出现;本月重点是0813版本更新及API分时定价。对大规模离线任务,调用时段成为成本优化手段。
沿用GLM-5约744B基座,官方称后训练使内部编码评测提升50%,CyberGym达84.5;权重计划后续开放。
在8月观察窗口前一天正式发布,并于8月持续进入即梦AI、豆包Pro等平台。单次可生成30秒音视频,支持多轮延长、多模态参考与时间戳级编辑,重点从“生成片段”转向“完成作品”。
面向音视频全双工交互,强调实时理解、连续感知与自然打断,更接近“在场的交互伙伴”。
面向流式识别与实时业务接入。对教育产品,延迟、热词与噪声鲁棒性比单次转写更关键。
与Cerebras合作的超高速推理预览,官方披露最高14倍速度、约750输出token/s;当前为有限预览。
在3.6发布三周后继续迭代,强调速度、效率与更低的入门价格。快速小步更新成为Flash系列的节奏。
xAI于8月11日发布面向开发协作场景的Grok Bot。原稿所写“8月22日”已更正。
Meta的Llama模型与工具持续扩展开放生态,其中Muse Glimmer 30B面向本地代理体验。
AI Act相关透明度义务进入适用期。并非“既有系统无过渡期”:8月2日前已投放系统可过渡至12月2日。
8月2日及之后发布的受支持模型从上线起标记;既有模型按过渡期推进。原稿“全模型同步实施”已收窄。
03 / Decision Matrix
把“新闻”压缩为可执行的判断:它改变了什么,以及下一步应关注什么。
表格可左右滑动查看完整内容
| 变化 | 代表事件 | 业务含义 | 建议动作 |
|---|---|---|---|
| 开源上限抬升 | Qwen3.8-Max、GLM-5.3 | 私有部署与前沿能力不再完全对立 | 增加开源权重POC,综合评估能力、成本与运维 |
| 速度产品化 | GPT-5.6 Sol Ultrafast | 延迟影响协作类产品留存与完成率 | 评测增加首token与完整响应时间 |
| 多模态走向工作流 | Seedance 2.5、SeedRealtime、Hy-ASR | 生成、理解和编辑开始进入完整内容流程 | 优先验证可控编辑、人工复核与下游交付 |
| 调用成本精细化 | DeepSeek峰谷定价 | 离线批处理可通过调度进一步降本 | 拆分实时/非实时任务,建立分时队列 |
| 透明度默认化 | 欧盟AI Act、Anthropic标记 | 内容标记与可追溯成为基础设施 | 预留来源元数据与披露界面 |
FROM SIGNAL TO EVERYONE BUILDS
本月的技术新闻说明AI能力越来越可用;更重要的变化是,自然语言、代码生成与本地分析能力,正在把开发能力交给每一个真正了解业务场景的人。
需求拆解、代码生成、DLL分析与调试,开始能通过自然语言协作完成。
通用工具止步于图片转LaTeX;教师知道真正的终点是希沃里的可编辑公式。
使用者借助AI理解本地希沃白板 DLL,并把格式映射、测试与交付逐步做出来。
AI迭代的意义,不只是让现有开发者做得更快,也让没有传统开发背景的人能够凭借场景经验,把问题做成工具、把输出接入工作流。
04 / EVERYONE CAN BUILD
公式工具的意义不只在于完成一次格式转换,而是验证一个变化:懂教学场景的人,可以借助AI完成需求拆解、代码生成、本地DLL分析、测试与交付,把自己的工作断点做成可用工具。
拖拽、粘贴或选择数学题截图。
提取题目文本与LaTeX公式。
检查歧义符号与结构。
转为可继续编辑的公式对象。
保留普通文本与数学表达式结构,减少在多个工具之间整理。
允许先修改LaTeX,再进入下游转换,避免黑盒错误。
通过符号映射与结构解析,转成可继续修改的公式。
Windows便携版无需复杂安装,适合小范围试用迭代。
桌面端负责图片导入、结果校正与复制;识别服务返回文本/LaTeX;开发过程中借助AI分析本地希沃白板 DLL,理解并建立LaTeX到希沃公式格式的映射。
识别质量受截图、版式和模型影响,复杂公式并非100%覆盖。当前定位是内部试用与小范围教学验证。
AI正在让开发从一种专业身份,变成解决问题的通用能力。关键不是会不会写代码,而是能否发现真实问题、定义清楚结果,并与AI一起把它做成可验证、可交付、可接入下一环节的工作流。
05 / Appendix
优先链接官方发布、产品文档与法规原文;二手信源仅用于补充官方页面未覆盖的信息。
速度、吞吐与有限预览说明
查看原文 GOOGLE · 官方发布时间、迭代节奏与定价信息
查看原文 ALIBABA CLOUD · 官方2.4T参数、1M上下文与开放计划
查看原文 DEEPSEEK · 官方用于校正首次发布时间线
查看原文 IT之家 · 二手补充补充分时价格与生效时间
查看原文 Z.AI · 官方基座关系、编码提升与开放计划
查看原文 BYTEDANCE SEED · 官方7月31日发布、30秒叙事、多模态参考与编辑能力
查看原文 BYTEDANCE SEED · 官方音视频全双工模型与交互方向
查看原文 腾讯云 · 官方实时语音识别能力与接入信息
查看原文 XAI · 官方核验8月11日正式发布日期
查看原文 META · 官方模型、工具与本地代理方向
查看原文 EUR-LEX · 法规原文第50条与既有系统过渡安排
查看原文 ANTHROPIC · 官方支持受支持模型的标记与过渡说明
查看原文 OPENROUTER · 数据使用排名不等同于能力排名
查看数据 上期报告本月版式与连续观察参照
查看报告实现方案、迭代、测试样例与已知限制;位于本地项目资料目录。
当前文件:v2.2.7,约86.3 MB。下载后直接运行;首次使用前建议核对文件名与版本。