AI 信息雷达
2026 年 9 月 26 日 · 周六
30 条 · 来自 54/55 个源 · 必看 10 / 值得看 20 / 其余 0 · AI 摘要(LongCat-2.0)
1 个源抓取失败
Google DeepMind
必看 10
-
音视频生成提速54倍!TurboT2VA:分布蒸馏与轨迹蒸馏的联合蒸馏方案 - 智源社区
TurboT2VA:分布蒸馏+轨迹蒸馏联合方案,音视频生成提速 54 倍。
蒸馏加速视频生成,对推理优化有参考价值。
-
OpenAI, Google and Anthropic to launch AI safety organisation by early 2027: Report - CNBC TV18
OpenAI、Google、Anthropic 计划 2027 年初联合推出 AI 安全组织 SAFA。
行业头部公司联合安全倡议,影响模型发布与合规格局。
-
ViRDM: Taming Representation Distribution Matching for Few-Step Causal Video Generation
ViRDM:将表示分布蒸馏用于少步因果视频生成,去掉 teacher-critic 栈。
少步视频生成蒸馏新方法,对加速推理有直接价值。
-
Visual Representation and History Modeling for Navigation World Models
研究导航世界模型的视觉表征与历史建模,用 flow-transformer 框架。
条件 flow-transformer 框架,对视频生成架构有参考。
-
AV-GRPO: Modality-Anchored Decoupling Diffusion Reinforcement Learning for Joint Audio-Video Generation
AV-GRPO:用模态解耦的扩散 RL 做联合音视频生成。
扩散模型 RL 后训练用于音视频生成,技术方向高度相关。
-
Accelerating Video Diffusion via Training-Free Trajectory Routing
TRACK:训练无关的轨迹感知路由,大小模型异构去噪加速视频扩散。
免训练加速视频扩散推理,对 GPU 推理优化有直接价值。
-
Training Object Permanence in World Models
WROP:用认知科学启发的数据集训练视频模型的物体永久性。
视频生成模型物理推理能力研究,方向相关。
-
Do World Models Make Better Robots? A Survey of Evaluation Benchmarks for Predictive Embodied Intelligence
综述论文:世界模型是否让机器人更好?系统梳理预测具身智能评测基准。
直接回答 world model 的闭环价值,对做生成式世界模型很有参考。
-
WanPE: Towards Cinematic Prompt Enhancement for Modern Text-to-Video Generation
WanPE:397B 参数 prompt 增强模型,用于文本到视频生成的电影级分镜规划。
直接面向视频生成 pipeline,prompt 增强可提升生成质量。
-
On the Diffusibility of High-Dimensional Latents
研究高维潜空间的可扩散性:RAE 微调降低有效维度,影响 flow matching 速度预测。
直接涉及扩散模型潜空间几何与 flow matching 训练,高度相关。
值得看 20
-
AI Video Generation Gets Human: A New Survey Maps the Field’s Biggest Hurdles - bioengineer.org
新综述梳理 AI 视频生成领域的核心障碍。
视频生成方向综述,可快速了解领域痛点。
-
Revealing the details of how OpenAI agents hacked Hugging Face
Hacker News 热帖:披露 OpenAI agent 如何入侵 Hugging Face 的细节。
涉及 agent 安全与 HF 平台,值得了解潜在风险。
-
Debugging LLM training in production is notoriously challenging. Join us at PyTorch Conference North America in San Jose
PyTorch 会议宣传:用 bitwise alignment 做 LLM 训练调试。
LLM 训练调试相关,但为会议营销。
-
Seedance 2.0 and Seedance 2.5: The latest innovations in AI video generation - London Daily News
Seedance 2.0 和 2.5 发布,推进 AI 视频生成。
字节视频生成模型新版本,关注竞争格局。
-
White House AI Model Review Impacts UK and US AI Access - The Cryptonomist
白宫 AI 模型审查影响英美 AI 模型访问权限。
政策面动态,可能影响模型获取与使用。
-
At PyTorch Conference North America, Maajid Khan from Fujitsu Research India will explore efficient MoE LLM inference us
PyTorch 会议:Fujitsu 分享 vLLM+OpenVINO 在 ARM 上的 MoE 推理。
MoE 推理优化,但与 GPU kernel 方向关联弱。
-
智谱创调整新低市值跌回3000亿港元 大模型赛道掀新一轮降价潮 - 新浪财经
智谱市值回落至 3000 亿港元,大模型赛道掀起新一轮降价潮。
国内模型公司价格战信号,影响算力需求格局。
-
AI Slowdown? OpenAI & Anthropic Launch Cheaper Models Days Later - Connect Gujarat -
报道称 OpenAI 与 Anthropic 在发布高价模型数天后又推出更便宜模型。
反映模型定价策略变化,值得关注行业动态。
-
Akamai’s $11.6B Deal With Anthropic Is Not a Cloud Contract – It Is an Equity Bet on the Model Layer - Yahoo Finance
Akamai 与 Anthropic 签署 116 亿美元交易,本质是对模型层的股权押注。
反映模型层商业格局变化,值得扫一眼。
-
DeltaWAM: Delta World Action Models for Bimanual Manipulation
DeltaWAM:用视觉 delta 与动作联合建模改进双手操作世界动作模型。
视频生成先验用于机器人控制,思路可借鉴。
-
HelloWorld: Towards Practical Applications of Generative Driving World Models
HelloWorld:2B 驾驶世界模型系统,支持多传感器与可控生成。
世界模型系统设计,但偏驾驶场景。
-
SplatLabel: Pseudo-Labelling through 4D Gaussian Splatting
SplatLabel:用 4D Gaussian Splatting 做伪标注,提取 LiDAR 分割。
4DGS 用于自动标注,与 3D 生成有一定关联。
-
ADATEX4D: adaptive texture capacity allocation for 4D gaussian splatting
AdaTex4D:4D Gaussian Splatting 的自适应纹理容量分配。
4DGS 纹理存储优化,对 3D 生成效率有参考价值。
-
Representation World Model: Learning States, Transition and Executable Plans in Representation
Representation World Model (RWM) 直接在表征空间学习状态、转移与可执行规划。
将规划融入表征几何,思路对生成式世界模型有借鉴价值。
-
NVIDIA OmniDreams: Real-Time Generative World Model for Closed-Loop Autonomous Vehicle Simulation
NVIDIA 发布 OmniDreams,面向闭环自动驾驶仿实时生成式世界模型。
NVIDIA 出品且聚焦生成式仿真,与生成模型方向相关。
-
Streaming-WAM: Action-Conditioned World-Action Model for Asynchronous Robot Manipulation
Streaming-WAM 将动作条件世界建模与异步机器人操控结合。
异步推理与动作条件预测思路对实时生成系统有启发。
-
Aim Short to Reach Far: Your Frozen World Model Can Plan Better Than You Think
Anchored Planning:用中间目标提升冻结世界模型的规划能力。
揭示 world model 规划局限并提出改进,对生成式规划有启发。
-
AD-WM: Action-Discriminative World Models for Counterfactual Model Predictive Control
AD-WM:面向反事实 MPC 的动作判别式联合嵌入世界模型。
显式建模动作区分度,对基于 world model 的控制系统有价值。
-
中国生数科技获2.9亿美元融资 推动模拟人类感知的「世界模型」 - CTIMES
生数科技获 2.9 亿美元融资,推动世界模型研发。
国内世界模型赛道大额融资,值得关注。
-
DeepSeek Harness 桌面预览版来了:Mac/Windows 双端下载与实测解析 - 积墨 AI
DeepSeek Harness 桌面预览版发布,支持 Mac/Windows 双端。
DeepSeek 生态工具更新,可关注推理侧工程实践。