AI Technology Intelligence Report

8月AI技术迭代及
人人都可以是开发者洞察

从全球模型竞争的三个新维度,到一位教学场景使用者借助AI完成工具开发:本报告关注的不只是模型变强,更是开发能力开始走向每个人。

智能研发部 余俊宏数据截止:2026-08-30资料依据:以官方公开信息为主

01 / Executive Signals

四个变化,值得调整判断框架

8月不是单纯的“模型更大”。开源权重、实时速度、原生多模态与内容透明度,正在成为新的竞争坐标。

01开源竞争

前沿能力与开放权重开始同场竞争

Qwen3.8-Max 以2.4T总参数、1M上下文亮相;GLM-5.3则在同一约744B基座上通过后训练继续提高编码表现。

02速度体验

推理速度从工程指标变成产品能力

GPT-5.6 Sol Ultrafast 官方预览最高可达14倍速度、约750 token/s。等待时间本身开始决定协作产品体验。

03多模态工作流

从“生成一次”走向持续创作与实时交互

Seedance 2.5强化长叙事、参考与编辑,SeedRealtime强调音视频全双工。竞争重点正从单次输出转向连续、可控的完整工作流。

04治理合规

内容来源标记进入产品默认项

欧盟AI Act第50条相关义务自8月2日起适用;该日期前已投放的既有系统有过渡安排。

管理判断

短期选型建议同时记录四项:能力、延迟、部署可控性、透明度合规。只看排行榜分数,已不足以支持真实业务决策。

02 / Technology Iteration

国内与国际 AI 技术迭代

按“可影响产品与技术决策”的标准筛选,并纳入7月31日发布、在8月进入扩散应用的窗口边界事件。日期以官方发布或可验证公告为准。

阿里云 / Qwen

Qwen3.8-Max

2.4T总参数、1M上下文窗口;发布后按计划开放模型权重。它把超大规模基座能力与可控部署放到同一张选型表里。

开放权重2.4T1M上下文
DeepSeek

V4-Pro 0813版本与峰谷定价

V4-Pro并非8月首次出现;本月重点是0813版本更新及API分时定价。对大规模离线任务,调用时段成为成本优化手段。

API分时定价版本更新
智谱 / Z.ai

GLM-5.3

沿用GLM-5约744B基座,官方称后训练使内部编码评测提升50%,CyberGym达84.5;权重计划后续开放。

编码增强约744B基座
字节跳动 / Seed · 窗口边界

Seedance 2.5

在8月观察窗口前一天正式发布,并于8月持续进入即梦AI、豆包Pro等平台。单次可生成30秒音视频,支持多轮延长、多模态参考与时间戳级编辑,重点从“生成片段”转向“完成作品”。

30秒叙事多模态参考可控编辑
字节跳动 / Seed

SeedRealtime

面向音视频全双工交互,强调实时理解、连续感知与自然打断,更接近“在场的交互伙伴”。

音视频全双工
腾讯云

Hy-ASR 实时语音识别

面向流式识别与实时业务接入。对教育产品,延迟、热词与噪声鲁棒性比单次转写更关键。

ASR流式识别
OpenAI

GPT-5.6 Sol Ultrafast 预览

与Cerebras合作的超高速推理预览,官方披露最高14倍速度、约750输出token/s;当前为有限预览。

超高速推理有限预览
Google

Gemini 3.7 Flash

在3.6发布三周后继续迭代,强调速度、效率与更低的入门价格。快速小步更新成为Flash系列的节奏。

高性价比快速迭代
xAI

Grok Bot

xAI于8月11日发布面向开发协作场景的Grok Bot。原稿所写“8月22日”已更正。

开发协作日期校正
Meta

Llama 生态覆盖本地代理

Meta的Llama模型与工具持续扩展开放生态,其中Muse Glimmer 30B面向本地代理体验。

本地代理开放生态
欧盟 / 行业

AI生成内容透明度义务适用

AI Act相关透明度义务进入适用期。并非“既有系统无过渡期”:8月2日前已投放系统可过渡至12月2日。

AI Act透明度
Anthropic

生成内容标记按模型批次推进

8月2日及之后发布的受支持模型从上线起标记;既有模型按过渡期推进。原稿“全模型同步实施”已收窄。

内容来源模型批次

03 / Decision Matrix

本月变化与业务含义

把“新闻”压缩为可执行的判断:它改变了什么,以及下一步应关注什么。

表格可左右滑动查看完整内容

变化代表事件业务含义建议动作
开源上限抬升Qwen3.8-Max、GLM-5.3私有部署与前沿能力不再完全对立增加开源权重POC,综合评估能力、成本与运维
速度产品化GPT-5.6 Sol Ultrafast延迟影响协作类产品留存与完成率评测增加首token与完整响应时间
多模态走向工作流Seedance 2.5、SeedRealtime、Hy-ASR生成、理解和编辑开始进入完整内容流程优先验证可控编辑、人工复核与下游交付
调用成本精细化DeepSeek峰谷定价离线批处理可通过调度进一步降本拆分实时/非实时任务,建立分时队列
透明度默认化欧盟AI Act、Anthropic标记内容标记与可追溯成为基础设施预留来源元数据与披露界面

FROM SIGNAL TO EVERYONE BUILDS

当开发门槛下降,最懂场景的人就能亲手补上断点

本月的技术新闻说明AI能力越来越可用;更重要的变化是,自然语言、代码生成与本地分析能力,正在把开发能力交给每一个真正了解业务场景的人。

01 / AI搭档

开发能力变得可调用

需求拆解、代码生成、DLL分析与调试,开始能通过自然语言协作完成。

02 / 场景专家

最懂问题的人定义工具

通用工具止步于图片转LaTeX;教师知道真正的终点是希沃里的可编辑公式。

03 / 人人开发

把经验做成可用工作流

使用者借助AI理解本地希沃白板 DLL,并把格式映射、测试与交付逐步做出来。

AI迭代的意义,不只是让现有开发者做得更快,也让没有传统开发背景的人能够凭借场景经验,把问题做成工具、把输出接入工作流。

04 / EVERYONE CAN BUILD

人人都可以是开发者:从教学痛点到可用工具

公式工具的意义不只在于完成一次格式转换,而是验证一个变化:懂教学场景的人,可以借助AI完成需求拆解、代码生成、本地DLL分析、测试与交付,把自己的工作断点做成可用工具。

AI公式识图工具操作界面
桌面版 v2.2.7 操作演示点击播放,查看从图片识别到复制希沃可编辑公式的完整流程
2种复制输出:LaTeX / 希沃可编辑公式
72个动态符号映射
97个解析器样例通过
2.2.7当前 Windows 便携版
STEP 01

导入图片

拖拽、粘贴或选择数学题截图。

STEP 02

AI识别

提取题目文本与LaTeX公式。

STEP 03

人工校正

检查歧义符号与结构。

STEP 04

复制到希沃

转为可继续编辑的公式对象。

01

题目与公式混合识别

保留普通文本与数学表达式结构,减少在多个工具之间整理。

02

识别结果可复核

允许先修改LaTeX,再进入下游转换,避免黑盒错误。

03

希沃可编辑公式输出

通过符号映射与结构解析,转成可继续修改的公式。

04

单文件便携交付

Windows便携版无需复杂安装,适合小范围试用迭代。

当前完成

  • 图片输入、AI识别、LaTeX编辑与复制形成闭环
  • 覆盖常见分式、根式、上下标与动态定界符
  • 解析器回归样例和便携版交付机制已建立

下一轮重点

  • 补齐复杂矩阵、分段函数与少见符号
  • 建立真实教学图片的分层评测集
  • 收集不同希沃版本的兼容性问题
查看实现结构与边界

实现结构

桌面端负责图片导入、结果校正与复制;识别服务返回文本/LaTeX;开发过程中借助AI分析本地希沃白板 DLL,理解并建立LaTeX到希沃公式格式的映射。

已知边界

识别质量受截图、版式和模型影响,复杂公式并非100%覆盖。当前定位是内部试用与小范围教学验证。

人人都可以是开发者

AI正在让开发从一种专业身份,变成解决问题的通用能力。关键不是会不会写代码,而是能否发现真实问题、定义清楚结果,并与AI一起把它做成可验证、可交付、可接入下一环节的工作流。

05 / Appendix

信源与软件下载

优先链接官方发布、产品文档与法规原文;二手信源仅用于补充官方页面未覆盖的信息。

AI 公式识图工具 · Windows 便携版

当前文件:v2.2.7,约86.3 MB。下载后直接运行;首次使用前建议核对文件名与版本。

下载便携版