蚂蚁集团旗下inclusionAI近日在Hugging Face、ModelScope与OpenRouter等平台放出Ling-3.0-flash,总参约124B、激活约5.1B,MIT许可;采用KDA与MLA交替架构及稀疏MoE,强调Agent闭环与长输入首Token延迟下降,面向生产环境复杂智能体工作流。
据TechCrunch报道,初创公司June于8月3日前后走出隐身,完成由Marc Benioff旗下Time Ventures领投的2000万美元种子前轮,Michael Dell、Aaron Levie、George Kurtz等参与,未披露估值;产品扫描企业系统并生成Agent落地路线图,降低对驻场FDE的依赖。
继发布并宣布8月3日零点开源后,MiniMax于8月3日正式放出H3权重(Hugging Face等渠道,Community License);H3-Omni-Transformer约33B,最高约15秒2K原生立体声音频视频;稀疏注意力与Context-IR等模块暂未开源;华为昇腾、摩尔线程等及AMD、Intel等同日适配,API约0.8元/秒(2K)。
8月3日阿里企业级Agent产品千问办公(QwenWork)开启公测,由QoderWork、MuleRun、悟空整合;网页版与PC客户端已开放,钉钉端入口将陆续上线;支持桌面/云端/企业协同Agent,接入含Qwen3.8在内的多档模型,订阅加积分制,并规划独立App与国际版。
8月3日阿里正式发布Qwen3.8-Max,总参数约2.4万亿、激活约950亿,支持约100万tokens上下文;API已上线阿里云百炼,权重计划下周发布并另有Qwen3.8-27B;公开基准含OSWorld-Verified约86.1、PaperBench约93.0,API定价约2/6美元每百万tokens。
微软在2026财年第四季度业绩沟通中强调构建与单一模型家族解耦的系统,使harness、上下文、记忆与行动空间分离,「每个模型都可替代」;Azure提供超11000个模型目录,多提供商客户约增5倍;Azure及其他云服务收入同比增43%,Azure全年收入首次超1000亿美元。
长三角(嘉兴)Token运营中心在浙江嘉兴正式启动,门户同步上线,具备统一API、Token计量、费用结算、政策抵扣与安全审计;可调用DeepSeek、阿里千问等100余款主流大模型,并按任务自动匹配成本较优模型;嘉兴有四个万卡级算力中心支撑,超20家伙伴签约入驻。
继7月31日DeepSeek宣布V4-Flash正式版API公测后,国家超算互联网上线DeepSeek-V4-Flash-0731的模型API与模型文件,支持官网一键接入;平台AI社区已汇集1700余款开源大模型,并称核心节点投运后形成十万卡级超智融合算力资源池。
OpenRouter最新一周AI大模型调用量榜单前五均为中国企业产品;小米MiMo-V2.5以单周约10.5万亿Tokens登顶并拿下周榜与月榜双第一,环比约增12%;DeepSeek占据第二与第五,腾讯混元Hy3单周环比增幅超999%。
自2026年8月2日起,欧盟《人工智能法》第50条透明度义务开始适用;交互式AI须告知用户、深度伪造须披露、合成内容须带机器可读标记;8月2日前已投放市场的生成式系统在机读标记上可宽限至12月2日,违规最高可罚1500万欧元或全球年营业额3%。