AI 信息雷达
2026 年 10 月 3 日 · 周六
30 条 · 来自 55/55 个源 · 必看 10 / 值得看 20 / 其余 0 · AI 摘要(LongCat-2.0)
当天新发现 3 个活动,已归入 活动清单 →
必看 10
-
Building a High-Performance and Portable vLLM Linear Backend with Helion
PyTorch 博客:用 Helion 构建高性能可移植 vLLM linear 后端。
autotuned kernel DSL 直接优化 LLM 推理 linear 层,与 GPU kernel 工作高度相关。
-
A model guide for the GPT-6 family
OpenAI 发布 GPT-6 系列模型指南,覆盖模型选择、推理强度调优、工具编排与生产部署。
GPT-6 是最新一代模型,直接影响训练与推理选型。
-
李飞飞:当视频生成、NVIDIA都自称世界模型,我们需要一个分类法|OpenAI|Genie|Sora|强化学习|英伟达_手机新浪网 - 新浪财经
李飞飞谈视频生成与世界模型分类法,引发行业讨论。
权威观点,有助于厘清世界模型概念边界。
-
对标英伟达平台,DeepSeek开源华为昇腾全套基础设施组件 - 搜狐网
DeepSeek 开源华为昇腾全套基础设施组件,对标英伟达平台。
国产 GPU 训练栈重大进展,直接影响训练基础设施选型与优化方向。
-
DramaAgent: Agentic Storytelling Video Generation
DramaAgent 提出分层智能体长视频生成框架。
长视频叙事一致性是视频生成核心难题。
-
Ego2Act: Evaluating Goal-Directed Manipulation in Egocentric Video Generation
Ego2Act 评估第一人称视频生成中的目标导向操作。
视频生成作为世界模拟器的重要基准。
-
Token-Level Video Reinforcement Learning
TVRL 提出 Token 级视频强化学习方法。
细粒度视频生成优化,直接影响训练效率。
-
Generative Cinematographer: Composing Camera and Object Motion in 3D
GenCine 将单图提升为可编辑 3D 场景,联合控制相机路径和前景物体 3D 运动。
直接解决 3D+视频生成中相机与物体联合控制难题,对 3D 生成工作高度相关。
-
VideoWeaver: Evaluating and Evolving Skills for Agentic Long Video Generation
VideoWeaver 提出 agent 框架和 benchmark,动态组合技能并生成超长视频。
长视频生成的 agent 化方案,对视频生成系统工程落地有参考价值。
-
SAGA: Stable Acceleration Guidance for Autoregressive Video Generation
SAGA 提出训练无关的稳定加速 guidance,解决自回归视频生成的时序漂移问题。
直接针对自回归扩散视频生成的 flicker/jitter 问题,训练优化高度相关。
值得看 20
-
v0.31.0rc5: [Misc] Add Transformers version upper bound in requirements (#59614)
vLLM v0.31.0rc5 发布,限制 Transformers 版本上限。
依赖约束变更可能影响本地构建,需留意但非重大功能更新。
-
Modern AI workloads rely on specialized GPU kernels, and no single backend is optimal across every operator. At #PyTorch
PyTorchCon 预告:AMD 展示 FlyDSL 集成 TorchInductor 方案。
GPU kernel 编译器与 DSL 生态动态,与训练优化工作相关。
-
Helion, a PyTorch-native kernel DSL, powers a vLLM linear backend with per-shape autotuning. On Hopper, tuning plus hybr
PyTorch 发布 Helion 驱动 vLLM linear 后端,Hopper 上超越 CUTLASS 与 DeepGEMM。
与 e4120387dd9714a3 博客内容重复,社交转发。
-
AMD's $8.2B World Labs deal signals buy-over-build era for world models - Yahoo! Finance Canada
AMD 82 亿美元收购 World Labs,押注世界模型。
行业大事件,反映世界模型赛道升温。
-
From the creator of Redis; run LLM locally with ds4
Redis 作者发布 ds4,本地运行 LLM 的工具登上 HN。
本地 LLM 推理工具,与推理部署生态相关,值得扫一眼。
-
Today we're unveiling Trillium Labs, a new non-profit to foster the open science of frontier AI. We're building open pos
Nathan Lambert 发布 Trillium Labs 非营利组织,聚焦前沿 AI 开放科学。
开放 post-training 与 infra 研究,与训练优化方向有潜在关联。
-
The Four Horsemen of Agentic Coding
文章讨论 Agentic Coding 的四个核心要素登上 HN。
Agent 编码趋势与训练工作流工具化相关,可快速浏览。
-
Open-sourcing AstaBrief, the fast report-generation model in Asta
Hugging Face 开源 Asta 中的快速报告生成模型 AstaBrief。
开源模型,但非生成模型或训练基础设施方向。
-
The latest AI news we announced in September 2026
Google 发布 2026 年 9 月 AI 动态汇总视频。
月度动态合集,需快速扫是否有重大发布。
-
FTC Investigates OpenAI and Anthropic Over Consumer Risks From Advanced AI Models - gbhackers.com
FTC 调查 OpenAI 与 Anthropic 高级 AI 模型消费者风险。
监管动态可能影响模型发布节奏,需保持关注。
-
openJiuwen X-Router自演进模型路由技术首发,昇腾亲和,Agent越跑越省,实测减少50+%Token消耗
openJiuwen X-Router 自演进模型路由技术首发,昇腾亲和,实测减 50%+ Token。
模型路由与推理成本优化相关,但偏营销数据,可快速扫过。
-
腾讯、字节、Kimi,都开始往客户现场派人|OpenClaw|开源软件|字节跳动|腾讯云|深圳市_手机新浪网 - 新浪财经
腾讯、字节、Kimi 开始向客户现场派驻人员做交付。
国内大模型公司竞争与交付模式变化,反映行业趋势。
-
v0.31.0rc4
vLLM v0.31.0rc4 修复 HiSparse MTP acceptance collapse bug。
涉及 MTP 推理路径稳定性,对使用 vLLM 训练推理者值得关注。
-
AutoSynthData: Generating Training Data for Enterprise Agents
AutoSynthData:面向企业 Agent 的训练数据生成方案。
训练数据生成,与训练流程相关但非核心方向。
-
Memorizon: Training World Models Beyond Their Context Window
Memorizon 训练世界模型突破上下文窗口限制。
长序列训练方法,对视频生成有借鉴意义。
-
Soundwich: Video Generation with Layered and Controllable Audio
Soundwich 实现视频生成中多音轨独立可控。
音视频联合生成,训练无关框架。
-
Towards Subject Consistency over Dynamic Subject Sets in Video Generation
DynSC-Eval 提出动态主体集视频一致性评估。
视频生成评估方法,关注主体一致性。
-
PhysicsLENS: Diagnosing Physical Property Blindness in Video Generation Models
PhysicsLENS 诊断视频生成模型的物理属性盲区。
视频物理合理性评估,对世界模型很关键。
-
PickMoment: Continuous-Time Single-Image-to-Video via Learning Deblurring and Blur-to-Video
PickMoment 提出连续时间单图到视频生成方法。
图像到视频生成新思路,与 MeanFlow 类比。
-
Oneira: From Open-Ended Generation to Open-World Interaction in Video World Models
Oneira 实现视频世界模型中的开放世界交互。
视频生成世界模型的前沿探索。