1.阿里发布Qwen3.8-Omni-Flash,百万Token输入低至0.8元
9月18日,阿里千问上线原生全模态模型Qwen3.8-Omni-Flash,可同时处理文字、图片、音频和视频,支持100万Token上下文。官方称,在30项评测中,该模型较上一代Qwen3.5-Omni-Plus平均提升超过26%;在长音视频理解任务中,OmniVideoBench准确率由63.4提升至67.8,Token消耗减少约45.7%。图文音视频输入价格低至每百万Token 0.8元。
模型支持最长一小时音视频分析,可完成说话人识别、转录、会议纪要、待办提取和风险分析,并能结合工具发送邮件、整理任务或编写代码。在内容生产场景中,它可完成歌曲结构分析、歌词生成、短剧翻译、角色配音、音轨重混和成片质检。配套的Qwen-MM-Plugins提供Video2Note和Omni Skill Creator,可将长视频整理成图文笔记,或从操作演示中提炼可复用的Agent技能。实时版支持边接收音视频边响应,并可结合空间声音与画面判断声源方向和距离。

2.智谱GLM-5.3-FlashX上线,更快更流畅
智谱宣布推出GLM-5.3-FlashX,API已正式开放,模型标识为“GLM-5.3-FlashX”。该模型此前曾以“Ox Alpha”名称与全球开发者见面,官方称其在GLM-5.3-Flash基础上,进一步优化了推理基础设施和服务性能,最高生成速度可达每秒200个Token。
智谱表示,GLM-5.3-Flash此前调用量持续增长。为应对企业和开发者不断增加的使用需求,智谱在10万张国产芯片提供的推理算力基础上,继续加大基础设施投入,并对推理流程进行优化。此次升级主要体现在响应速度和交互流畅度上,模型的定位和能力体系没有改变。
官方称,GLM-5.3-Flash长期保持同尺寸模型中的较高智能水平,并兼顾调用成本。GLM-5.3-FlashX目前已可通过智谱开放平台API调用,开发者也能在体验中心直接试用。

3.奥特曼称OpenAI存在“后Astra”内部模型
近日,在与Salesforce CEO马克·贝尼奥夫的对谈中,OpenAI CEO萨姆·奥特曼谈及公司内部模型进展。他表示,GPT-5.5的数学能力大致相当于普通数学教授,GPT-5.6可达到全球前1%至2%数学教授的水平;在Astra之后,OpenAI还有一款内部模型,已经能够处理顶尖数学家难以解决的问题。
奥特曼没有公布该模型的名称、测试结果或具体题目。OpenAI总裁Greg Brockman此前提到,公司在另一项“千禧年大奖难题”上取得进展,但同样没有公开具体内容。理论计算机科学家Scott Aaronson近日在个人博客中讨论AI快速发展对数学研究的冲击,称自己未来继续证明定理,可能更多是出于兴趣,而不是因为人类不可替代。

4.智谱拟融资超390亿港元,主要投向模型研发与算力建设

5.Gemini 4 Pro“偷跑”传闻流出,谷歌尚未确认
近日,模型竞技平台Arena新增一款名为“gemini-3.8-flash”的模型,引发开发者猜测,其可能是谷歌下一代旗舰Gemini 4 Pro的测试版本。部分用户分享了网页设计、SVG生成和代码任务的体验,称其速度与交互效果较好;网络流传的对比图还显示,该模型在DeepSWE、Terminal-Bench等项目中领先GPT-6 Astra和Claude Fable 5.1。
但目前没有证据证明“gemini-3.8-flash”就是Gemini 4 Pro,也没有公开评测能够支持“全面碾压”其它模型的说法。Arena官方更新记录只确认,9月2日将Gemini 3.8 Flash加入部分榜单;谷歌官方渠道尚未发布Gemini 4 Pro,关于谷歌已实现递归自我改进、模型拥有1000万Token上下文等说法,均来自网友爆料。

6.谷歌被曝测试数学推理模型,支持百万Token上下文
据X账号@lyraxana消息,谷歌正基于DeepThink V3构建一款内部实验模型,代号“Mathematica”,主要面向复杂符号运算和数学难题。API信息显示,该模型内部标识为“deepthink-mathematica-tf-raw-thoughts”,上下文窗口最高约100万Token,单次输出上限为6.5万Token。
网络泄露的配置中,其被标记为“UNSTABLE_EXPERIMENTAL”,并带有谷歌内部测试使用的“Teamfood”标签,显示它仍处于实验和员工测试阶段。谷歌尚未公开确认“Mathematica”的存在,也没有公布模型性能、开放时间或具体评测成绩。谷歌此前已推出面向国际数学奥林匹克竞赛的Gemini DeepThink模式,并于9月15日发布Gemini 3.8 Live及Live Extended Thinking。

7.Vidu上线Image 2.5,Fast与Pro分开满足速度和画质需求
Vidu近日上线全能Image 2.5图像生成模型,提供Fast和Pro两种模式。Fast主打快速出图,适合灵感试错、批量生成和需要频繁修改的场景;Pro则更强调画面细节和成图质量,适合海报、产品视觉、角色设定等对精度要求更高的任务。
从官方展示内容看,Image 2.5主要面向文字生图和视觉创作流程,用户可以根据提示词生成不同风格的图像。目前公开信息尚未披露两种模式的具体生成速度、分辨率、价格和基准测试成绩,最终差异仍需等待更多实测。

8.芒果推出全AIGC历史纪录片《台湾岛纪》
9月17日,芒果首部全面梳理中国台湾历史的AI学术纪录片《台湾岛纪》在湖南卫视、芒果TV开播。节目共5集,从三国时期孙权派人探寻夷洲讲起,讲到隋唐、宋元时期的交流与治理,再到郑成功收复台湾、清代统一、台湾建省以及1945年光复,梳理近1800年有文献记载的历史脉络。
《台湾岛纪》由湖南广播电视台、湖南快乐阳光等出品,芒果伯璟创制、芒果灵创提供技术支持。官方称,这是首部画面全部由AIGC生成的长篇纪录片。创作团队平均年龄约22至23岁,全片塑造116个历史人物形象、复原约486个场景。节目以古籍、论文和专家研究为基础,AI主要承担视觉呈现,不直接替代历史考证和内容审核。
节目于9月17日至24日每周一至周四19:30播出。湖南卫视称,首集播出后引发观众讨论,美兰德蓝鹰指数显示其融合传播指数位列全网热播纪录片前列。

欢迎分享、点赞、推荐一起研究AI







