![]()
—— ·要点速览· ——
1 、 Qwen-Image-3.0上线千问AI平台
2 、字节跳动发布音视频全双工大模型SeedRealtime
3、Liquid AI 发布 LFM2.5-2.6B 端侧小模型,支持智能手机本地运行
4、京东开源JoyAI-Video-Edit模型,支持实时互动编辑
5、最强多模态内容审核开源 AI 模型:Mistral 推出 Shieldstral,单张 16GB GPU 可运行
6、微盟WAI升级为“微盟星元”,开启AI原生经营系统内测
7、英伟达 Alpamayo 2 Super AI 开放商用:为自动驾驶汽车带来 360° 感知、高级驾驶决策
8、Sand.ai 发布全球首个千亿级开源 MoE 视频模型
9、DeepSeek重启融资,投前估值5000亿元
10、端侧AI概念震荡反弹,AI眼镜方向领涨
11、科创50指数收涨4.78% 半导体产业链集体爆发
更聚焦的科技行业交流群,捕捉每一条科技动态,诚挚邀请创业者、发烧友加入我们。微信扫码进群:
进群后,你有机会得到:
最新、最热的科技资讯;
最精准的行业资源对接;
论坛、沙龙、企业游学门票。
![]()
1、端侧多模态大模型技术研发商「Om AI联汇」完成数亿元股权投资,由前海母基金领投,杭州政府产业基金等跟投。
Om AI联汇是一家端侧多模态大模型技术研发商,专注于通过端侧多模态模型为各类终端设备赋予自主智能,加速实现高阶自主智能。公司在视觉多模态模型(VLM)领域拥有卓越的技术优势,尤其在视觉感知、空间记忆与决策执行方面领先业界。 凭借自主研发的全栈视觉多模态模型和智能体产品,联汇科技加速赋能千行百业,让每一个智能终端具备人类级的自主智能,服务覆盖无人机、机器人、AI PC、AIoT等领域。
2、MEMS芯片研发生产商「知芯传感」完成股权投资,由中芯聚源领投。
知芯传感是一家MEMS芯片研发生产商,致力于MEMS芯片研发、生产及销售,公司聚焦MEMS压力传感器、MEMS微镜两大方向,提供MEMS芯片相关产品及解决方案,广泛应用于汽车、工业、医疗、家电和消费电子等领域。
3、量子计算QPU核心基础设施提供商「无界量子」完成数千万元天使轮融资,由复旦科创领投,险峰K2VC、前海母基金、中赢创投跟投。
无界量子是一家面向未来容错量子计算的QPU核心基础设施提供商,聚焦中性原子量子计算领域,专注量子处理器及其核心器件的自主研发与系统集成,致力于服务全球量子计算科研组及商业整机客户。其产品主要面向量子计算科研与商业化整机应用场景。
4、多模态触觉传感及具身智能技术研发商「模量科技」完成股权投资,投资方为u益华资本。
模量科技是一家多模态触觉传感及具身智能技术研发商,专注于多模态触觉传感及具身智能工业机器人研发。其产品包括机器人触觉、工业压力分布检测、织物类柔性传感器以及柔性薄膜传感器等。产品广泛应用于机器人触觉、工业检测(新能源、3C 制造业)、消费电子以及医疗健康等领域。
5、商业运载火箭发射系统研发商「星际荣耀」完成10亿元E轮融资,投资方为义柏资本等。
星际荣耀是一家商业运载火箭发射系统研发商,聚焦商业航天领域,专注小型固体运载火箭及中大型可重复使用液氧甲烷运载火箭的自主研发与商业发射服务,致力于提供高品质、低成本、快响应的运载火箭系统性解决方案。公司主要产品或服务包括双曲线一号小型固体运载火箭、双曲线三号中大型可重复使用液氧甲烷运载火箭及商业卫星发射服务,主要应用于低轨互联网星座组网及商业卫星发射等场景。
![]()
1、Qwen-Image-3.0上线千问AI平台
8月5日消息,据阿里云消息,阿里巴巴千问图像生成模型Qwen-Image-3.0正式上线千问AI平台,面向所有用户全部开放。旗舰版Qwen-Image-3.0-Pro与标准版Qwen-Image-3.0-Standard同时开放API,文生图0.18元/张起。API已在千问AI平台上线,海外用户可通过Qwen Cloud接入。(阿里云)
2、字节跳动发布音视频全双工大模型SeedRealtime
8月5日消息, 字节跳动正式推出原生音视频全双工大模型SeedRealtime。SeedRealtime用统一架构原生融合音频、视频与文本,能在连续的多模态信息流上实时交互,带来“边看、边听、边说”的全新体验。端到端人工评测结果显示,相比级联模型,SeedRealtime的音视频对话节奏问题减少了一半——模型对说话时机的把握更加自然,“话未说完被抢断、话音已落却回应迟缓、或是被背景杂音与闲聊误触发”等卡壳现象显著减少;同时,单次对话能够完整、顺畅交流的概率也有明显提升。目前,SeedRealtime已在豆包App全量上线。(广角观察)
3、Liquid AI 发布 LFM2.5-2.6B 端侧小模型,支持智能手机本地运行
8月5日消息,人工智能初创企业 Liquid AI 当地时间昨日发布 LFM2.5-2.6B 开源智能体模型。仅 26 亿的参数使得 LFM2.5-2.6B非常适合在设备端本地部署,即使是智能手机也能运行;同时又足以支持规划、调用、多步骤处理的智能体工作流。
LFM2.5-2.6B 在 34T Token(词元)的数据集上进行预训练,并通过扩展现有分词器增强了对非拉丁字母语言的支持。Liquid AI 在 Hugging Face 平台上同时提供基础和后训练版本的该模型。
![]()
根据 Liquid AI 提供的数据,在与 gemma-4-E2B-it、gemma-4-E4B-it、Qwen3.5-4B、Qwen3.5-9B 等更大尺寸模型一道进行基准测试时,LFM2.5-2.6B 在所有指令执行项目和几乎所有工具使用项目中均领先,仅在 BFCLv4 测试中落后于 Qwen3.5-9B。
LFM2.5-2.6B 在智能体任务中全面优于两款 Gemma 模型,并与 Qwen 模型表现相近。在 STEM 领域,它在 AA Omniscience 测试中领先,仅在数学测试中落后于 Qwen3.5-9B。编程是唯一一个更大模型仍保持优势的领域。(IT之家)
4、京东开源JoyAI-Video-Edit模型,支持实时互动编辑
8月5日消息,京东宣布开源自研的实时流式视频编辑模型JoyAI-Video-Edit,用户可以一边观看视频,一边修改人物与场景,让视频创作从“先有素材再修改”变为可实时互动编辑。在流式实时视频编辑方向,JoyAI-Video-Edit对比当前业内代表性模型,各项指标全面领先,达到世界一流水平。 据悉,京东正在加速建设全球最大物理世界运营中心,并已经形成面向物理世界的JoyAI模型矩阵:JoyAI-Image-Edit让AI理解与编辑空间,JoyAI-Echo面向长音视频生成,JoyAI-VL-Interaction让AI持续观察并实时回应,JoyAI-Talker提供实时语音交互能力,JoyAI-RA面向机器人操控,形成覆盖语音、图像、视频、实时交互与具身智能的基础模型体系。JoyAI-Video-Edit进一步提升了实时视频编辑能力,并为具身智能大规模数据合成积累底层技术。(广角观察)
5、最强多模态内容审核开源 AI 模型:Mistral 推出 Shieldstral,单张 16GB GPU 可运行
8月5日消息,Mistral AI 昨日(8月4日)发布公告,宣布推出 Shieldstral 内容审核 AI 模型,总参数量为 3B(30 亿),采用开放权重,依据 Apache 2.0 许可证发布。
模型已上线 Hugging Face 平台,支持 12 种语言,可在单张 16GB GPU 上运行。Mistral 表示该模型在内容安全方面,性能媲美 7 倍规模的开放模型,并且在多模态内容审核领域实现 SOTA。
![]()
Mistral 指出,多数防护模型会把伤害类别体系固化在模型权重中。产品更换使用场景后,开发者通常需要重新训练模型。
Shieldstral 则把审核政策放入输入内容:操作者可以写入一个“是或否”问题,再提供评估场景和严格程度说明,模型随后从单个输出词元中生成经过校准的安全分数。(IT之家)
6、微盟WAI升级为“微盟星元”,开启AI原生经营系统内测
8月5日 消 息,近日,微盟宣布旗下AI产品WAI升级为“微盟星元”,定位AI原生智能经营系统,目前开启内测。新产品将交互从传统图形界面转向自然语言(LUI),商家通过对话即可完成数据查询、经营诊断、店铺搭建、内容创作等动作。微盟将服务数千零售品牌积累的行业经验拆解为标准化、可独立调用的Skill模块,由Agent完成任务拆解与能力调度,并打通微信、企业微信、飞书、钉钉等渠道。(35氪)
7、英伟达 Alpamayo 2 Super AI 开放商用:为自动驾驶汽车带来 360° 感知、高级驾驶决策
8月5日消息,英伟达(NVIDIA)昨日(8 月 4 日)发布博文,宣布面向自动驾驶汽车领域,推出开源 Alpamayo 2 Super 模型,现已开放商业使用,具备开放商业授权和领先的多任务自动驾驶推理能力。
英伟达在博文中指出,自动驾驶汽车面对的难点并非日常驾驶,最大挑战是罕见、复杂、难以预判的复杂路况。
英伟达表示,车辆不仅需要识别物体、预测运动,还需要理解场景、推理因果关系、选择正确动作,并把决策转化为安全、舒适的行驶路径。这一过程需要实时完成,同时要便于开发者检查、验证和信任。
英伟达针对上述自动驾驶场景,强化推出 Alpamayo 2 Super。英伟达称,该模型从 2 个方向推进自动驾驶生态:开放商用许可,以及面向自动驾驶的领先多任务能力。
开放商用许可方面,Alpamayo 2 Super 已在 Hugging Face 上架,并采用 OpenMDW-1.1 许可。该许可是 Linux Foundation 面向开放 AI 模型分发的宽松许可,覆盖微调、衍生模型和商业再分发。
![]()
自动驾驶开发者、汽车制造商、卡车制造商和供应商可基于自身数据、驾驶策略和部署方案改造 Alpamayo。
英伟达称,这种开放性让自动驾驶研究人员和企业保留对自身数据与基础设施的控制,也能保有通过专用模型和经验积累创造的价值。
英伟达表示,OpenMDW 许可现正覆盖整个 Alpamayo 模型系列,开发者可在无需额外许可的情况下将任一模型用于商业部署。
在多任务能力方面,在 Alpamayo 系列中,Alpamayo 2 Super 提供最高推理性能和驾驶性能,适用于多模态自动驾驶开发。
同时,Alpamayo 1.5 和 Alpamayo 1 提供成本更低的选项,适合云端开发和模型蒸馏。经过蒸馏的模型随后可针对量产车辆中的高效实时推理优化。
性能方面,Alpamayo 2 Super 在 LingoQA 自动驾驶推理基准中排名第 1;在 Lingo-Judge 测试中,Alpamayo 2 Super 领先 Qwen2.5-VL 72B 17.0 分,领先 Gemini 2.5 Pro 15.1 分。
Alpamayo 2 Super 基于 **NVIDIA Cosmos 3 Super Reasoner**(英伟达 Cosmos 3 超级推理模型)构建,并通过强化学习后训练。(IT之家)
8、Sand.ai 发布全球首个千亿级开源 MoE 视频模型
8月5日,「Sand.ai」正式发布并开源 MAGI-2 Preview。这是全球首个千亿级开源 MoE 视频生成模型,总参数约 114B,单次前向计算仅激活约 6B 参数。
开源地址:
https://github.com/SandAI-org/MAGI-2-preview
https://huggingface.co/sand-ai/MAGI-2-preview
![]()
凭借 6B 激活参数,MAGI-2 Preview 在 Artificial Analysis image to video 视频生成榜单排名第六。
按照当前 8 卡 H100 的月租金折算生成 10 秒 1080P 视频的推理成本约 0.5 元「蒸馏后模型」,每秒成本约为行业主流模型的十分之一。(源码资本)
![]()
1、DeepSeek重启融资,投前估值5000亿元
8月5日消息,多名交易人士透露,大模型公司DeepSeek重启了第二轮融资,本轮计划募资500亿元,投前估值约5000亿元,并计划将在8月下旬完成签约。DeepSeek在今年4月开启了首轮融资,并在6月完成交割,该轮融资金额500亿元,估值超过3500亿元,成为中国AI大模型史上首轮融资规模最大的公司。多位投资人提到,DeepSeek第二轮融资至少在7月中旬就已开启,但在7月底突然暂停,当时一些谈判候补名单上的投资人被告知签署融资协议的计划暂缓。(财经杂志)
2、端侧AI概念震荡反弹,AI眼镜方向领涨
8月5日消息 ,端侧AI概念震荡反弹,AI眼镜方向领涨,博通集成涨停,云天励飞、深科达、瑞芯微、翱捷科技、欧菲光等涨幅靠前。消息面上,根据WellsennXR,2025年全球AI眼镜出货量约846万台,预计2026年出货量有望达到1600万台(同比增加89%),2030年达到9000万台。(科股宝播报)
3、科创50指数收涨4.78% 半导体产业链集体爆发
8月5日消息 , 今日,科创50指数收涨4.78%。盘面上个股涨多跌少,仅1只个股跌幅大于4%。分行业来看,半导体产业链集体爆发,材料、设备方向领涨,中巨芯、正帆科技20CM涨停,有研硅涨超17%,中微公司、拓荆科技涨超12%,联瑞新材、中船特气等纷纷上涨。光通信、PCB板块走强,长盈通涨超13%,新锐股份、欧科亿涨超9%。物理AI概念表现活跃,埃科光电、索辰科技涨超13%,格灵深瞳、中望软件等跟涨。 (科创板日报 )
![]()
“美国 12.5%新301关税落地,从临时税变长期壁垒。”
更多干货分享敬请注我们的公众号与视频号~超多精彩对话内容等待您的解锁!
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.