AI 信息雷达
2026 年 9 月 18 日 · 周五
41 条 · 来自 28/28 个源 · 必看 9 / 值得看 12 / 其余 20 · AI 摘要(gemini-3.1-pro-preview)
必看 9
-
Anthropic Launches Claude Code Projects in Beta: Parallel Cloud Sessions That Keep Running After You Close Your Laptop - MarkTechPost
Anthropic 推出 Claude Code Projects 测试版,支持后台持续运行的并行云端会话。
涉及 AI 编程助手的基础设施升级,可能影响开发工作流,值得关注。
-
v0.30.0rc1: [Bugfix] Isolate supplemental FlashInfer BF16 autotuning (#57285)
vLLM 发布 v0.30.0rc1,修复并隔离了 FlashInfer BF16 的自动调优问题。
涉及主流推理框架的 kernel 级别修复(FlashInfer),直接关系到你的 GPU 优化工作。
-
通义千问重磅开源Qwen2.5,性能超越Llama - Sohu
阿里通义千问正式开源 Qwen2.5 大模型,宣称性能超越 Llama。
基础大模型重要开源,需关注其架构变化对推理和训练系统的影响。
-
智谱GLM公开国内大模型首个RSI实践:AI在十万卡国产集群上自建推理系统 - 21财经
智谱 GLM 公开递归自我改进实践,AI 在十万卡国产集群上自建推理系统。
涉及超大规模集群、国产算力及推理系统构建,与你的系统优化工作高度相关。
-
The Other Half of the Memory Wall: Serving 35B MoEs from SSD with Trained Routing Prediction
提出 Edge0 流式 MoE 推理引擎,通过训练路由预测实现从 SSD 高效服务 35B MoE 模型。
涉及大模型推理系统优化和内存墙问题,与你的性能优化工作直接相关。
-
Rethinking Critic Learning in PPO: Understanding and Mitigating Value Flattening
分析并缓解 LLM 强化学习 PPO 算法中 Critic 出现的“价值扁平化”系统性失效问题。
深入探讨 RLHF 训练稳定性和底层机制,对模型训练优化有直接帮助。
-
A Zeroth-Order Paradigm for LLM Preference Alignment
提出 ComPO,一种基于比较预言机的零阶 LLM 偏好对齐方法,无需直接优化可微损失。
零阶优化方法可能带来显存和计算效率的提升,与训练性能优化高度相关。
-
Zing-0.5: Toward Playable Worlds with Real-Time Joint Action and Text Control
推出 5B 自回归世界模型 Zing-0.5,支持通过键盘和文本实时控制生成的可玩世界。
涉及视频/3D生成和世界模型,与你关注的生成模型方向完全契合。
-
Register Tokens for Bounded-State Reasoning in Diffusion Language Models
在扩散语言模型中引入寄存器 token,实现清理上下文后仅依赖固定状态继续推理。
涉及扩散模型在文本生成的应用及状态压缩,对生成模型架构和推理优化有启发。
值得看 12
-
刚刚,Claude Code大重构!内部3万Agent管理技术免费开放
Claude Code 进行大重构,免费开放其内部 3 万 Agent 管理技术。
涉及 Agent 管理基础设施,可作为日常开发工具了解。
-
阶跃发布全新语音大模型 StepAudio 3系列:覆盖语音识别、生成、实时交互与音乐创作
阶跃星辰发布 StepAudio 3 系列语音大模型,支持语音生成与音乐创作。
涉及音频生成模型,作为生成模型领域的扩展值得扫一眼。
-
让仿真走到设计前端,第叁范式发布国内首款 GPU 原生跨尺度系统级电磁仿真软件
第叁范式发布国内首款 GPU 原生跨尺度系统级电磁仿真软件。
涉及 GPU 原生计算,可能对 GPU kernel 开发有启发。
-
边说话边推理、边聊天边调用工具,谷歌 Gemini 3.8 Live 要攻克语音 Agent 的沉默时刻
谷歌推出 Gemini 3.8 Live,优化语音 Agent 的实时推理与工具调用能力。
涉及多模态实时推理系统,可关注其延迟优化思路。
-
Anthropic tries to make Claude stickier with launch of Docs and Slides - Computerworld
Anthropic 为 Claude 推出 Docs 和 Slides 工具,增强用户粘性。
头部模型公司的重要产品更新,值得了解其应用生态布局。
-
Anthropic's Guide to Building Effective AI Agents: Key Design Principles - Analytics Insight
Anthropic 发布构建高效 AI 智能体的指南及关键设计原则。
官方发布的 Agent 设计原则,对理解上层应用架构有一定参考价值。
-
In-Context Robot Learning with VLM Agents
研究探讨商业视觉语言模型(如 GPT-6 Astra)在机器人上下文学习中的应用。
具身智能与VLM结合的研究,虽非核心方向但值得了解多模态应用。
-
PANORAMA: Panoptic Grounded Captioning via Mask Proposal Selection
提出 PanoCaps,通过掩码提议选择解决全景接地图像描述任务中的像素级对齐问题。
涉及视觉语言模型的像素级理解,对多模态生成有一定参考价值。
-
LimiX-2: A Contextual Mechanism Network Towards General Structured-Data Intelligence
推出 LimiX-2 模型,采用上下文机制网络范式处理结构化数据智能。
结构化数据的新模型架构,非生成模型核心方向,可简单扫一眼。
-
Confidence Comes from Experience: Experiential Confidence Estimation from Reasoning to Agents
提出 XConf 方法,结合模型积累的经验记录来评估语言模型输出的置信度。
提升模型可靠性的新思路,偏向推理策略,可作为扩展阅读。
-
EventEgoHands++: Event-based Egocentric 3D Hand Mesh Reconstruction with Real Dataset
提出基于事件相机的以自我为中心的 3D 手部网格重建方法,解决运动模糊问题。
涉及 3D 重建技术,但偏向特定传感器应用,可作为 3D 领域的补充阅读。
-
HypoEvolve: Genetic Algorithms Enable Multi-Agent LLMs to Discover Scientific Hypotheses
提出 HypoEvolve 框架,结合遗传算法与多智能体 LLM 协作来发现科学假设。
AI for Science 和多智能体协作的研究,非底层优化,可简单了解。
其余 20
-
智谱唐杰清华开课,爆改课程内容,让学生挑战大模型全链路实操! - blog.csdn.net
智谱唐杰在清华开设大模型课程,引入全链路实操内容。
课程教学动态,与 GPU 优化或生成模型前沿研究无关。
-
手握200亿仍融资400亿,智谱加速布局算力,商业模式重估能否赢得大模型竞赛? - blog.csdn.net
智谱加速算力布局并进行大额融资,引发对其商业模式的探讨。
纯商业与融资分析,不涉及具体技术实现。
-
PyTorch Day Japan 2026 Comes to Tokyo on December 10
PyTorch Day Japan 2026 将于 12 月 10 日在东京举行。
社区活动预告,无实质技术内容。
-
How To Write With An LLM
探讨如何使用 LLM 辅助写作,建议仅用于校对而非直接采纳其措辞。
个人关于 LLM 使用技巧的观点,与底层技术研发无关。
-
Making global data easier to explore
谷歌推出 UN System Data Commons Data 网页,简化全球数据探索。
泛泛的数据工具发布,与模型训练和底层优化无关。
-
Anthropic Tests Claude Money to Bring Bank Accounts Into Claude - Windows Report
Anthropic 测试 Claude Money,尝试将银行账户接入 Claude。
偏向金融科技的商业功能测试,与底层技术无关。
-
How a 27-year-old math geek at Anthropic made the world afraid of AI - The Times of India
报道 Anthropic 一位 27 岁数学极客对 AI 安全的影响。
人物八卦与泛泛讨论,无技术价值。
-
How Cooley is accelerating IPO work with ChatGPT
律所 Cooley 使用 ChatGPT 打造 GO Public 工具以加速 IPO 流程。
纯商业应用案例,与底层优化和生成模型研发无关,可跳过。
-
DoorDash、Airbnb都在用 中国大模型周调用量已近美国3倍 - 新浪财经
报道称中国大模型周调用量已接近美国的 3 倍,获多家国际企业使用。
宏观行业新闻,缺乏具体技术细节,可跳过。
-
国产AI出海再结硕果!徐汇企业MiniMax多款产品纳入新加坡国民AI技能培训计划 - 新浪网
MiniMax 多款产品被纳入新加坡国民 AI 技能培训计划。
商业出海与合作新闻,无技术价值。
-
Anthropic Merges Claude Chat and Cowork, Adds Docs and Slides Tools - Technology Org
Anthropic 合并 Claude Chat 与 Cowork,并添加 Docs 和 Slides 工具。
与前述 Anthropic 产品更新新闻重复,可跳过。
-
Kimi发布金融行业AI解决方案 已接入多家头部金融机构 - TradingView
Kimi 推出金融行业 AI 解决方案,已接入多家头部金融机构。
垂直行业落地新闻,不涉及底层技术或生成模型。
-
央企做了个通用Agent,直接杀进IDC实测前三!
中国电信推出通用 Agent TeleAgent,在 IDC 实测中排名前三。
偏应用层的 Agent 评测,与 GPU 优化和生成模型无关。
-
智谱 GLM 公开国内大模型首个递归自我改进实践:AI 在十万卡国产集群上自建推理系统 - 新浪财经
智谱 GLM 在十万卡国产集群上通过 AI 自建推理系统。
与前述智谱推理系统新闻重复,可跳过。
-
Anthropic runs company on Claude agents while urging AI speed control - CHOSUNBIZ - biz.chosun.com
Anthropic 在内部使用 Claude 智能体运营公司,同时呼吁控制 AI 发展速度。
行业八卦与政策呼吁,与技术研发无关。
-
AI调用量连续20周超美国,中国大模型靠什么抢市场? - Sohu
媒体探讨中国大模型 AI 调用量超越美国背后的市场策略。
宏观市场分析,缺乏技术深度。
-
Introducing Astra for Law
OpenAI 推出 Astra for Law,为律所提供定制工作流和机密数据控制。
垂直领域的商业产品发布,不涉及底层技术或生成模型研究。
-
国产大模型Kimi 下盘稳适合什么运动问世 美国AI巨头Anthropic被冲击:估值少了9000亿 - 体坛
媒体炒作 Kimi 问世对美国 AI 巨头 Anthropic 估值造成冲击。
明显的标题党和营销内容,无技术价值。
-
网络真钱赌钱_游戏资讯_DeepSeek工程师发长文引爆网络:不得不把才华埋葬在昨天 - 体坛
疑似博彩引流的垃圾新闻,借 DeepSeek 工程师名义炒作。
垃圾信息,直接跳过。
-
Gaze as Evidence for Common Grounding: A Cross-Corpus Analysis of MapTask and MUNDEX
跨语料库分析视线在协作任务中作为共同理解证据的作用。
偏向人机交互和认知科学,与底层系统和生成模型无关。