AI 信息雷达
2026 年 9 月 22 日 · 周二
30 条 · 来自 55/55 个源 · 必看 10 / 值得看 20 / 其余 0 · AI 摘要(gemini-3.8-flash)
必看 10
-
浪潮信息发布元脑SD200 Ultra:单机承载2.8万亿参数Kimi K3 - 凤凰网科技
浪潮信息发布SD200 Ultra,单机承载2.8万亿参数Kimi K3。
超大参数模型单机推理/训练硬件架构,直关系统优化。
-
v0.30.0
vLLM 正式发布 v0.30.0 版本,包含构建流程及推理后端更新。
主流推理核心框架版本升级,直接影响推理部署实践。
-
Simplifying Model Serving Across Multiple GPUs with NVIDIA TensorRT Multi-Device Integration in NVIDIA Dynamo-Triton
NVIDIA 推出 Dynamo-Triton 多设备 TensorRT 集成,简化跨多 GPU 模型服务部署。
多卡推理加速与 Serving 核心基建,直接切合工作重点。
-
亚马逊AWS旗下Bedrock官宣接入Kimi K3模型|开源模型|闭源模型|编程|大模型|Token_手机新浪网 - 新浪财经
亚马逊AWS Bedrock官宣接入月之暗面Kimi K3模型并实行分成。
国产闭源大模型首次通过商业分成模式上线全球主流云。
-
Claude Opus 5.5 Leak Points to 20% Lower Prices and a Tuesday Launch - Pasquale Pillitteri
曝Claude Opus 5.5将于周二发布,API调用降价20%。
旗舰模型重磅更新传闻,关注其推理能力与定价。
-
4DGS-Fixer: Generative Sparse-View 4D Gaussian Splatting with Iterative Refinement Guided by Video Diffusion Priors
论文提出 4DGS-Fixer,结合视频扩散先验与迭代细化,解决稀疏视角 4DGS 几何初始化不足问题。
结合 4DGS 与扩散先验的动态重建,直接契合 3D/视频生成方向。
-
JEPA Guided Diffusion: Predictive Vision-Language Conditioning for Generative Traffic Forecasting
论文提出 JEPA 引导的扩散框架,解耦潜在动力学表征学习与视频扩散生成,大幅降低交通预测训练开销。
解耦 JEPA 与扩散视频生成的端到端优化思路,对生成模型系统设计极具参考价值。
-
CompAdapt: Adaptable Composite Motion Modeling for Physics-Consistent Text-to-Video Generation
论文提出 CompAdapt 框架,通过神经动力学复合运动建模提升 T2V 扩散模型的物理规律一致性与泛化性。
针对视频扩散模型物理一致性缺陷的架构改进,属视频生成前沿。
-
MT-WAM: Reorienting the One-Pass Predictive Representation Toward Action Generation
论文提出 MT-WAM,利用单次视频 DiT 前向抽取表征,并加入 2D 点轨迹与双流结构直接指导动作生成。
DiT 单次前向表征与动作结合,涉及 DiT 架构重构与高效推理。
-
ZYT-World: A Real-Time Controllable World Model for Closed-Loop Autonomous-Driving Simulation
论文发布 ZYT-World 实时闭环自动驾驶世界模型,统一生成 4 路鱼眼与 3 路针孔视角,兼顾低延迟与稳定性。
多相机高分辨率实时视频生成系统,低延迟闭环设计对推理与 Kernel 优化启发很大。
值得看 20
-
Jev introduces a new shape of LLM - System One, aka Decision Models
Simon Willison 讨论 TypeSafe AI 推出的 Jev,一种直接输出类型化概率决策的轻量模型。
探讨非自回归流式生成替代结构,对推理低延迟形态有启发。
-
TinyTorch is a free, open source curriculum where you build a working machine learning framework from scratch, tensors t
PyTorch官方推荐开源课程TinyTorch,教学用纯Python从零实现包含张量到Transformer的框架。
从底层张量到算子调度手写框架,可作为算子实现的教学参考。
-
TinyTorch: Don’t Just Import PyTorch. Build It.
PyTorch 官方博客推荐 TinyTorch,一个从张量底层动手自制 mini 框架的开源教学项目。
偏教育性质项目,但涉及纯底层张量与算子构建,适合扫一眼。
-
阶跃Step 5 Preview 升至全球开源前二|Kimi K3|阶跃星辰|模型评测|大模型|开源模型_手机新浪网 - 新浪财经
阶跃星辰Step 5 Preview在模型评测中升至全球开源第二名。
国内顶级开源大模型榜单进展,建议关注架构表现。
-
Yann LeCun Joins Cellular Intelligence Board: World Models Move From AI Theory to Parkinson's Research - The Eastern Herald
Yann LeCun 加入 Cellular Intelligence 董事会,推动世界模型从 AI 理论扩展至帕金森病等生物医学研究。
图灵奖得主最新行业任职,体现世界模型跨界应用方向。
-
Pruning LLMs Like a Physicist: Block Removal as an Ising Optimization Problem
HF 博客发文探讨将 LLM 模块剪枝建模为 Ising 物理优化问题。
模型压缩与轻量化思路,对推理加速有参考价值。
-
智谱被指未经用户允许上传数据 随后致歉并开源ZCode - 财新
智谱就未经允许上传数据致歉,并宣布开源编程助手ZCode。
官方开源代码助手ZCode,可关注其客户端实现。
-
Altum:蚂蚁集团新一代大模型训练数据处理系统设计与实践|QCon上海
蚂蚁集团在QCon分享新一代大模型训练数据处理系统Altum的架构与设计实践。
涉及大规模预训练数据流水线与分布式处理架构,具参考价值。
-
World Labs and AMI Labs Have $2.3 Billion to Rethink AI: Neither Will Say How It Makes Money - The Eastern Herald
World Labs 与 AMI Labs 共获 23 亿美元融资研发世界模型,但两家均未公布商业盈利路径。
关注头部世界模型创企资金与商业化动向,可泛读了解。
-
视频生成模型到底会不会“思考”?我们测了27个任务给出答案 - 科技行者
科技行者设计27个任务评测主流视频生成模型在物理规律认知与因果推理上的能力。
系统剖析视频生成模型的真实物理与推理极限,契合研究方向。
-
月之暗面发布Kimi Code Desktop桌面客户端 - 搜狐网
月之暗面正式推出桌面端编程软件Kimi Code Desktop。
了解国内头部大模型团队在AI Coding工程客户端的布局。
-
开环闭环双榜夺魁 千里智驾 WA-JEPA 重塑自动驾驶世界模型范式 - 搜狐网
千里智驾发布 WA-JEPA 自动驾驶世界模型范式,在开环与闭环双榜单夺得第一。
JEPA 架构在自动驾驶落地的评测表现,值得快速了解。
-
Skylark Labs brings on Giuseppe Loianno, a top robotics researcher, to build Almanac — a world model designed to Continuously Self-Learn - Mashable Benelux
Skylark Labs引入机器人学者Giuseppe Loianno,开发具备自学习能力的世界模型Almanac。
涉及世界模型与具身智能架构演进,值得关注其技术路径。
-
39个Day 0背后,沐曦股份如何把国产GPU生态做成一张网? - Jiemian.com
界面新闻报道国产GPU厂商沐曦股份在生态适配及Day 0支持方面的布局进展。
涉及国产GPU软硬件生态进展,适合作为算力背景了解。
-
WorldRoamBench: An Open-World Benchmark for Long-Horizon Stability of Interactive World Models
提出WorldRoamBench基准,从动作、视觉漂移、物理和记忆四个维度评测交互式世界模型的长程稳定性。
针对交互式世界模型长程生成与物理一致性的系统性基准,值得生成模型方向关注。
-
The Missing Temporal Link: Temporal Context Routing for Script-Driven Audio-Video Generation
提出时序上下文路由机制,解决剧本驱动音视频联合生成中镜头切换与台词对齐不准的问题。
音视频联合多模态生成中的时序对齐问题,对视频生成控制细节有参考价值。
-
Adaptive Rollout Truncation Based on Epistemic Uncertainty for Efficient Offline World Model Training
提出基于认知不确定性的自适应展开截断策略,优化离线世界模型的训练步长与计算开销。
涉及多步自回归展开的训练开销优化,对长序列时序模型训练效率有参考价值。
-
Sandwich-Residuals: Parameter-Efficient Test-time Adaptation of World Models
提出Sandwich-Residuals,冻结预训练世界模型并在预测器前后学习轻量残差实现在线测试时适应。
高效微调与测试时自适应结构设计,思路可借鉴到大模型参数高效推理。
-
是美国的4.7倍!中国AI大模型周调用量连续二十一周领跑:DeepSeek V4.1-Flash登顶,环比增长219% - 东方财富
国内AI周调用量持续领先,DeepSeek V4.1-Flash登顶且增219%。
高吞吐轻量推理模型调用激增,体现推理部署需求趋势。
-
数据到 4D 世界:世界模型如何重塑自动驾驶的训练场? - 汽车之家
汽车之家深度分析世界模型构建 4D 动态场景如何重塑自动驾驶闭环训练体系。
涉及 4D 生成与模拟器构建思路,可作为背景扫读。