![]()
—— ·要點速覽· ——
1 、 Qwen-Image-3.0上線千問AI平臺
2 、字節跳動發布音視頻全雙工大模型SeedRealtime
3、Liquid AI 發布 LFM2.5-2.6B 端側小模型,支持智能手機本地運行
4、京東開源JoyAI-Video-Edit模型,支持實時互動編輯
5、最強多模態內容審核開源 AI 模型:Mistral 推出 Shieldstral,單張 16GB GPU 可運行
6、微盟WAI升級為“微盟星元”,開啟AI原生經營系統內測
7、英偉達 Alpamayo 2 Super AI 開放商用:為自動駕駛汽車帶來 360° 感知、高級駕駛決策
8、Sand.ai 發布全球首個千億級開源 MoE 視頻模型
9、DeepSeek重啟融資,投前估值5000億元
10、端側AI概念震蕩反彈,AI眼鏡方向領漲
11、科創50指數收漲4.78% 半導體產業鏈集體爆發
更聚焦的科技行業交流群,捕捉每一條科技動態,誠摯邀請創業者、發燒友加入我們。微信掃碼進群:
進群后,你有機會得到:
最新、最熱的科技資訊;
最精準的行業資源對接;
論壇、沙龍、企業游學門票。
![]()
1、端側多模態大模型技術研發商「Om AI聯匯」完成數億元股權投資,由前海母基金領投,杭州政府產業基金等跟投。
Om AI聯匯是一家端側多模態大模型技術研發商,專注于通過端側多模態模型為各類終端設備賦予自主智能,加速實現高階自主智能。公司在視覺多模態模型(VLM)領域擁有卓越的技術優勢,尤其在視覺感知、空間記憶與決策執行方面領先業界。 憑借自主研發的全棧視覺多模態模型和智能體產品,聯匯科技加速賦能千行百業,讓每一個智能終端具備人類級的自主智能,服務覆蓋無人機、機器人、AI PC、AIoT等領域。
2、MEMS芯片研發生產商「知芯傳感」完成股權投資,由中芯聚源領投。
知芯傳感是一家MEMS芯片研發生產商,致力于MEMS芯片研發、生產及銷售,公司聚焦MEMS壓力傳感器、MEMS微鏡兩大方向,提供MEMS芯片相關產品及解決方案,廣泛應用于汽車、工業、醫療、家電和消費電子等領域。
3、量子計算QPU核心基礎設施提供商「無界量子」完成數千萬元天使輪融資,由復旦科創領投,險峰K2VC、前海母基金、中贏創投跟投。
無界量子是一家面向未來容錯量子計算的QPU核心基礎設施提供商,聚焦中性原子量子計算領域,專注量子處理器及其核心器件的自主研發與系統集成,致力于服務全球量子計算科研組及商業整機客戶。其產品主要面向量子計算科研與商業化整機應用場景。
4、多模態觸覺傳感及具身智能技術研發商「模量科技」完成股權投資,投資方為u益華資本。
模量科技是一家多模態觸覺傳感及具身智能技術研發商,專注于多模態觸覺傳感及具身智能工業機器人研發。其產品包括機器人觸覺、工業壓力分布檢測、織物類柔性傳感器以及柔性薄膜傳感器等。產品廣泛應用于機器人觸覺、工業檢測(新能源、3C 制造業)、消費電子以及醫療健康等領域。
5、商業運載火箭發射系統研發商「星際榮耀」完成10億元E輪融資,投資方為義柏資本等。
星際榮耀是一家商業運載火箭發射系統研發商,聚焦商業航天領域,專注小型固體運載火箭及中大型可重復使用液氧甲烷運載火箭的自主研發與商業發射服務,致力于提供高品質、低成本、快響應的運載火箭系統性解決方案。公司主要產品或服務包括雙曲線一號小型固體運載火箭、雙曲線三號中大型可重復使用液氧甲烷運載火箭及商業衛星發射服務,主要應用于低軌互聯網星座組網及商業衛星發射等場景。
![]()
1、Qwen-Image-3.0上線千問AI平臺
8月5日消息,據阿里云消息,阿里巴巴千問圖像生成模型Qwen-Image-3.0正式上線千問AI平臺,面向所有用戶全部開放。旗艦版Qwen-Image-3.0-Pro與標準版Qwen-Image-3.0-Standard同時開放API,文生圖0.18元/張起。API已在千問AI平臺上線,海外用戶可通過Qwen Cloud接入。(阿里云)
2、字節跳動發布音視頻全雙工大模型SeedRealtime
8月5日消息, 字節跳動正式推出原生音視頻全雙工大模型SeedRealtime。SeedRealtime用統一架構原生融合音頻、視頻與文本,能在連續的多模態信息流上實時交互,帶來“邊看、邊聽、邊說”的全新體驗。端到端人工評測結果顯示,相比級聯模型,SeedRealtime的音視頻對話節奏問題減少了一半——模型對說話時機的把握更加自然,“話未說完被搶斷、話音已落卻回應遲緩、或是被背景雜音與閑聊誤觸發”等卡殼現象顯著減少;同時,單次對話能夠完整、順暢交流的概率也有明顯提升。目前,SeedRealtime已在豆包App全量上線。(廣角觀察)
3、Liquid AI 發布 LFM2.5-2.6B 端側小模型,支持智能手機本地運行
8月5日消息,人工智能初創企業 Liquid AI 當地時間昨日發布 LFM2.5-2.6B 開源智能體模型。僅 26 億的參數使得 LFM2.5-2.6B非常適合在設備端本地部署,即使是智能手機也能運行;同時又足以支持規劃、調用、多步驟處理的智能體工作流。
LFM2.5-2.6B 在 34T Token(詞元)的數據集上進行預訓練,并通過擴展現有分詞器增強了對非拉丁字母語言的支持。Liquid AI 在 Hugging Face 平臺上同時提供基礎和后訓練版本的該模型。
![]()
根據 Liquid AI 提供的數據,在與 gemma-4-E2B-it、gemma-4-E4B-it、Qwen3.5-4B、Qwen3.5-9B 等更大尺寸模型一道進行基準測試時,LFM2.5-2.6B 在所有指令執行項目和幾乎所有工具使用項目中均領先,僅在 BFCLv4 測試中落后于 Qwen3.5-9B。
LFM2.5-2.6B 在智能體任務中全面優于兩款 Gemma 模型,并與 Qwen 模型表現相近。在 STEM 領域,它在 AA Omniscience 測試中領先,僅在數學測試中落后于 Qwen3.5-9B。編程是唯一一個更大模型仍保持優勢的領域。(IT之家)
4、京東開源JoyAI-Video-Edit模型,支持實時互動編輯
8月5日消息,京東宣布開源自研的實時流式視頻編輯模型JoyAI-Video-Edit,用戶可以一邊觀看視頻,一邊修改人物與場景,讓視頻創作從“先有素材再修改”變為可實時互動編輯。在流式實時視頻編輯方向,JoyAI-Video-Edit對比當前業內代表性模型,各項指標全面領先,達到世界一流水平。 據悉,京東正在加速建設全球最大物理世界運營中心,并已經形成面向物理世界的JoyAI模型矩陣:JoyAI-Image-Edit讓AI理解與編輯空間,JoyAI-Echo面向長音視頻生成,JoyAI-VL-Interaction讓AI持續觀察并實時回應,JoyAI-Talker提供實時語音交互能力,JoyAI-RA面向機器人操控,形成覆蓋語音、圖像、視頻、實時交互與具身智能的基礎模型體系。JoyAI-Video-Edit進一步提升了實時視頻編輯能力,并為具身智能大規模數據合成積累底層技術。(廣角觀察)
5、最強多模態內容審核開源 AI 模型:Mistral 推出 Shieldstral,單張 16GB GPU 可運行
8月5日消息,Mistral AI 昨日(8月4日)發布公告,宣布推出 Shieldstral 內容審核 AI 模型,總參數量為 3B(30 億),采用開放權重,依據 Apache 2.0 許可證發布。
模型已上線 Hugging Face 平臺,支持 12 種語言,可在單張 16GB GPU 上運行。Mistral 表示該模型在內容安全方面,性能媲美 7 倍規模的開放模型,并且在多模態內容審核領域實現 SOTA。
![]()
Mistral 指出,多數防護模型會把傷害類別體系固化在模型權重中。產品更換使用場景后,開發者通常需要重新訓練模型。
Shieldstral 則把審核政策放入輸入內容:操作者可以寫入一個“是或否”問題,再提供評估場景和嚴格程度說明,模型隨后從單個輸出詞元中生成經過校準的安全分數。(IT之家)
6、微盟WAI升級為“微盟星元”,開啟AI原生經營系統內測
8月5日 消 息,近日,微盟宣布旗下AI產品WAI升級為“微盟星元”,定位AI原生智能經營系統,目前開啟內測。新產品將交互從傳統圖形界面轉向自然語言(LUI),商家通過對話即可完成數據查詢、經營診斷、店鋪搭建、內容創作等動作。微盟將服務數千零售品牌積累的行業經驗拆解為標準化、可獨立調用的Skill模塊,由Agent完成任務拆解與能力調度,并打通微信、企業微信、飛書、釘釘等渠道。(35氪)
7、英偉達 Alpamayo 2 Super AI 開放商用:為自動駕駛汽車帶來 360° 感知、高級駕駛決策
8月5日消息,英偉達(NVIDIA)昨日(8 月 4 日)發布博文,宣布面向自動駕駛汽車領域,推出開源 Alpamayo 2 Super 模型,現已開放商業使用,具備開放商業授權和領先的多任務自動駕駛推理能力。
英偉達在博文中指出,自動駕駛汽車面對的難點并非日常駕駛,最大挑戰是罕見、復雜、難以預判的復雜路況。
英偉達表示,車輛不僅需要識別物體、預測運動,還需要理解場景、推理因果關系、選擇正確動作,并把決策轉化為安全、舒適的行駛路徑。這一過程需要實時完成,同時要便于開發者檢查、驗證和信任。
英偉達針對上述自動駕駛場景,強化推出 Alpamayo 2 Super。英偉達稱,該模型從 2 個方向推進自動駕駛生態:開放商用許可,以及面向自動駕駛的領先多任務能力。
開放商用許可方面,Alpamayo 2 Super 已在 Hugging Face 上架,并采用 OpenMDW-1.1 許可。該許可是 Linux Foundation 面向開放 AI 模型分發的寬松許可,覆蓋微調、衍生模型和商業再分發。
![]()
自動駕駛開發者、汽車制造商、卡車制造商和供應商可基于自身數據、駕駛策略和部署方案改造 Alpamayo。
英偉達稱,這種開放性讓自動駕駛研究人員和企業保留對自身數據與基礎設施的控制,也能保有通過專用模型和經驗積累創造的價值。
英偉達表示,OpenMDW 許可現正覆蓋整個 Alpamayo 模型系列,開發者可在無需額外許可的情況下將任一模型用于商業部署。
在多任務能力方面,在 Alpamayo 系列中,Alpamayo 2 Super 提供最高推理性能和駕駛性能,適用于多模態自動駕駛開發。
同時,Alpamayo 1.5 和 Alpamayo 1 提供成本更低的選項,適合云端開發和模型蒸餾。經過蒸餾的模型隨后可針對量產車輛中的高效實時推理優化。
性能方面,Alpamayo 2 Super 在 LingoQA 自動駕駛推理基準中排名第 1;在 Lingo-Judge 測試中,Alpamayo 2 Super 領先 Qwen2.5-VL 72B 17.0 分,領先 Gemini 2.5 Pro 15.1 分。
Alpamayo 2 Super 基于 **NVIDIA Cosmos 3 Super Reasoner**(英偉達 Cosmos 3 超級推理模型)構建,并通過強化學習后訓練。(IT之家)
8、Sand.ai 發布全球首個千億級開源 MoE 視頻模型
8月5日,「Sand.ai」正式發布并開源 MAGI-2 Preview。這是全球首個千億級開源 MoE 視頻生成模型,總參數約 114B,單次前向計算僅激活約 6B 參數。
開源地址:
https://github.com/SandAI-org/MAGI-2-preview
https://huggingface.co/sand-ai/MAGI-2-preview
![]()
憑借 6B 激活參數,MAGI-2 Preview 在 Artificial Analysis image to video 視頻生成榜單排名第六。
按照當前 8 卡 H100 的月租金折算生成 10 秒 1080P 視頻的推理成本約 0.5 元「蒸餾后模型」,每秒成本約為行業主流模型的十分之一。(源碼資本)
![]()
1、DeepSeek重啟融資,投前估值5000億元
8月5日消息,多名交易人士透露,大模型公司DeepSeek重啟了第二輪融資,本輪計劃募資500億元,投前估值約5000億元,并計劃將在8月下旬完成簽約。DeepSeek在今年4月開啟了首輪融資,并在6月完成交割,該輪融資金額500億元,估值超過3500億元,成為中國AI大模型史上首輪融資規模最大的公司。多位投資人提到,DeepSeek第二輪融資至少在7月中旬就已開啟,但在7月底突然暫停,當時一些談判候補名單上的投資人被告知簽署融資協議的計劃暫緩。(財經雜志)
2、端側AI概念震蕩反彈,AI眼鏡方向領漲
8月5日消息 ,端側AI概念震蕩反彈,AI眼鏡方向領漲,博通集成漲停,云天勵飛、深科達、瑞芯微、翱捷科技、歐菲光等漲幅靠前。消息面上,根據WellsennXR,2025年全球AI眼鏡出貨量約846萬臺,預計2026年出貨量有望達到1600萬臺(同比增加89%),2030年達到9000萬臺。(科股寶播報)
3、科創50指數收漲4.78% 半導體產業鏈集體爆發
8月5日消息 , 今日,科創50指數收漲4.78%。盤面上個股漲多跌少,僅1只個股跌幅大于4%。分行業來看,半導體產業鏈集體爆發,材料、設備方向領漲,中巨芯、正帆科技20CM漲停,有研硅漲超17%,中微公司、拓荊科技漲超12%,聯瑞新材、中船特氣等紛紛上漲。光通信、PCB板塊走強,長盈通漲超13%,新銳股份、歐科億漲超9%。物理AI概念表現活躍,埃科光電、索辰科技漲超13%,格靈深瞳、中望軟件等跟漲。 (科創板日報 )
![]()
“美國 12.5%新301關稅落地,從臨時稅變長期壁壘。”
更多干貨分享敬請注我們的公眾號與視頻號~超多精彩對話內容等待您的解鎖!
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.