![]()
![]()
编辑:前沿在线 编辑部
今日 AI 圈核心主线:国产大模型迎来新一轮开源爆发,腾讯混元 Hy4、千问 Qwen3.8-Flash-Next、智谱 GLM-5.3-Flash接连放出重磅成果,参数规模、上下文长度、多模态能力与性价比同步突破;金融大模型、整车智能体、具身智能融资同步推进,AI 向产业核心场景深度渗透。
海外谷歌发布长视频生成模型,英伟达单季营收指引首破千亿,OpenAI宣布下架 DALL・E,英国完成全球首例 AI 实时辅助脑外科手术,技术迭代、商业化落地与社会价值实现多线并进。
![]()
腾讯混元发布并开源 Hy4 preview 770B 参数上下文破 1M
腾讯混元正式发布并开源 Hy4 preview 大模型,参数规模达 770B,上下文窗口突破 100 万 Token,成为国内开源大模型中长上下文能力的标杆产品。
![]()
模型针对长文档理解、代码库全局分析、多轮复杂对话做深度优化,百万级上下文可一次性加载完整工程代码库、超长法律文书、多轮历史对话,同时保持推理稳定性与信息检索精度。
Hy4 的开源进一步丰富了国产大模型的开源生态,长上下文能力的突破为企业级复杂任务处理提供了更强的底层支撑,推动大模型在金融、法律、软件工程等长文本场景的规模化落地。
![]()
灵初智能完成过亿美元融资,头部产业资本加速商业化落地
近日,灵初智能完成新一轮过亿美元融资。本轮融资汇聚拓普集团、奇瑞控股旗下瑞丞基金、蓝思科技等头部产业资本,以及三七互娱、芜湖市投控集团、复星创富等机构,老股东华金资本持续超额追加投资。
![]()
继国家级资本布局后,头部产业资本的集体加码,进一步体现了国资体系与产业端对灵初智能技术路线及商业价值的双重认可,并推动公司形成“政策引导、产业落地、资本护航”的发展格局。
融资将用于具身智能技术研发,加速物流与先进制造场景的规模化落地。
![]()
谷歌发布Gemini Omni 1.1 Flash视频模型 4K直出最长40秒
谷歌正式发布 Gemini Omni 1.1 Flash 视频生成模型,原生支持 4K 分辨率直接输出,单段视频最长可达 40 秒,大幅拓展 AI 视频生成的时长与画质上限。
![]()
模型在时序一致性、动态场景稳定性、人物动作连贯性方面实现优化,长视频生成过程中画面漂移与角色崩坏问题显著改善,同时保持 Flash 系列的低延迟与高吞吐特性。
Gemini Omni 1.1 Flash 的发布推动 AI 视频从短视频片段向长内容生成演进,4K 40 秒的能力为影视制作、广告创意、内容创作提供了更专业的工具,视频 AIGC 进入准专业级生产阶段。
![]()
千问开源 Qwen3.8-Flash-Next 架构,轻量化多模态大模型实现效能突破
阿里千问正式开源 Qwen3.8-Flash-Next 全新架构,主打轻量化多模态能力,在保持高性能的同时实现推理效能重大突破。
![]()
新架构针对多模态任务做专项优化,图文理解、视觉推理、内容生成能力全面提升,同时大幅压缩计算开销与显存占用,在同等硬件条件下推理速度显著优于同级别模型。
Qwen3.8-Flash-Next 的开源为开发者提供了更高效的多模态模型选择,轻量化架构特别适配端侧与边缘部署场景,推动多模态 AI 从云端向更广泛的终端设备普及。
![]()
智谱开源 GLM-5.3-Flash 320B 原生多模态定价为 Opus 4.8 的 1/40
智谱 AI 正式开源 GLM-5.3-Flash 大模型,参数规模达 320B,原生支持多模态能力,API 定价仅为 Claude Opus 4.8 的四十分之一,性价比优势显著。
![]()
模型在图文理解、视觉推理、多模态生成等任务中表现接近国际旗舰水平,同时通过架构优化实现低成本推理,为企业与开发者提供高性价比的多模态大模型选择。
GLM-5.3-Flash 的开源与低价策略进一步拉高国产多模态模型的竞争力,大幅降低企业使用多模态 AI 的成本,推动多模态能力在更多行业场景规模化落地。
![]()
NVIDIA 季度营收指引达 1080 亿美元,首次突破单季千亿大关
英伟达发布最新季度财报指引,预计单季营收将达到 1080 亿美元,首次突破单季千亿美元大关,创下公司历史新高。
![]()
营收增长主要受 AI 数据中心 GPU 需求持续驱动,全球大模型训练与推理算力需求旺盛,英伟达在高端 AI 加速芯片市场占据主导地位,订单持续饱满。
单季营收破千亿标志着 AI 算力市场进入全新规模阶段,英伟达作为 AI 基础设施核心供应商的商业价值持续兑现,全球 AI 产业的算力投入仍在高速增长。
![]()
小鹏 Master Agent 整车大脑上车 语音靠边停车 L4 能力下放量产车
小鹏汽车正式宣布 Master Agent 整车智能大脑上车量产车型,实现通过语音指令触发靠边停车等 L4 级自动驾驶能力,将高阶自动驾驶功能下放至量产乘用车。
![]()
Master Agent 作为整车统一智能中枢,整合感知、决策、控制全链路,支持自然语言交互与复杂场景自主决策,语音靠边停车功能可在行驶中根据指令自动完成变道、减速、靠边停靠全流程。
L4 级能力下放量产车标志着智能驾驶技术从高端测试向大众消费市场普及,整车智能体架构推动汽车从传统交通工具向智能移动终端转型,高阶自动驾驶的商业化落地加速。
![]()
蚂蚁携手中金发布金融增强大模型 Ling-3.0-flash-Fin 下周开源
蚂蚁集团联合中金公司发布金融增强大模型 Ling-3.0-flash-Fin,专门针对金融行业场景做深度优化,模型将于下周正式开源。
![]()
模型在金融文档理解、数据分析、风险识别、投研辅助等方面针对性强化,适配银行、证券、资管等金融机构的业务需求,兼顾推理性能与行业专业度。
金融大模型的开源将降低金融机构 AI 落地的技术门槛,推动 AI 在风控、投研、客服等核心金融场景的规模化应用,为金融行业数字化转型提供更强的底层技术支撑。
![]()
OpenAI确认8月30日下架DALL・E ChatGPT官方绘图仅剩3天
OpenAI 正式确认将于 8 月 30 日下架 DALL・E 图像生成模型,ChatGPT 内置官方绘图功能仅剩 3 天使用期限,后续将由新一代图像生成模型替代。
![]()
DALL・E 作为 OpenAI 早期文生图代表产品,曾推动 AI 绘图领域的普及与发展,下架标志着 OpenAI 图像生成产品线的迭代更替,新一代模型将在画质、一致性、编辑能力上实现全面升级。
产品更替反映出 AIGC 图像领域的快速迭代,老模型退场为更先进的生成技术让路,OpenAI 在多模态赛道的产品布局持续优化升级。
![]()
英国公布全球首例 AI 实时辅助脑外科手术 AI 术中标记血管神经
英国医疗团队公布全球首例 AI 实时辅助脑外科手术案例,AI 系统在手术过程中实时识别并标记脑部血管与神经结构,为外科医生提供精准导航。
系统通过实时分析术中影像,自动区分重要血管、神经与病变组织,在手术视野中叠加可视化标记,帮助医生规避关键结构,降低手术风险,提升操作精准度。
全球首例 AI 实时辅助脑外科手术的成功,标志着 AI 在医疗高端手术场景的落地取得里程碑突破,AI 从影像诊断走向术中实时辅助,为精准外科手术开辟了全新技术路径。
![]()
![]()
前沿动态前沿大会
前沿人物
点「在看」,给前前加鸡腿
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.