AI 信息雷达
2026 年 9 月 15 日 · 周二
40 条 · 来自 28/28 个源 · 必看 5 / 值得看 8 / 其余 27 · AI 摘要(gemini-3.1-pro-preview)
当天新发现 1 个活动,已归入 活动清单 →
必看 5
-
v12.9.8: Prepare cuda-bindings 12.9.8 release (#2814)
cuda-python 发布 12.9.8 版本,修复 Python 3.15 构建及 Numpy 安装问题。
CUDA Python 绑定的底层更新,直接影响 GPU kernel 开发和环境配置。
-
Accelerating Dropless MoE Training in JAX with NVIDIA Transformer Engine
NVIDIA 介绍如何使用 Transformer Engine 在 JAX 中加速无丢弃 MoE 模型的训练。
涉及 MoE 训练性能优化和底层系统,直接契合你的工作方向。
-
中国AI大模型调用量连续二十周领跑:DeepSeek V4.1 Flash上线三天升至第六,智谱GLM 5.3、MiniMax M3跌出榜单 - Sohu
国内大模型调用量榜单更新,DeepSeek V4.1 Flash上线三天升至第六。
榜单显著变化及新Flash模型上线,反映当前主流模型推理效率。
-
阿里云百炼上线DeepSeek-V4.1-Flash模型 - 品玩
阿里云百炼平台正式上线 DeepSeek-V4.1-Flash 模型。
头部开源模型的新版本上线,可能涉及推理优化和架构改进,值得关注。
-
智谱宣布约50亿美元融资,六成资金投向下一代GLM模型和算力基础设施 - 新浪财经
智谱宣布约50亿美元融资,60%将用于下一代GLM模型和算力基础设施。
巨额算力投资意味着更大规模的集群建设,直接关联训练系统与Infra。
值得看 8
-
智谱融资50亿美元,加码大模型研发 - 21财经
智谱完成 50 亿美元融资,将用于加码大模型研发。
国内头部模型公司的重大融资,反映行业算力投入趋势。
-
Industrial-Scale AI Model Distillation Attacks Targeting Anthropic Claude by Seven China-Based AI Labs: Incident Analysis and Mitigation Strategies - Rescana
报告称七家中国 AI 实验室对 Anthropic Claude 进行了工业级模型蒸馏攻击。
涉及模型蒸馏和安全攻防的行业事件,可作背景了解。
-
Palantir, Nvidia curb AI model use over data fears, The Information reports - Reuters
据报 Palantir 和 Nvidia 因数据隐私担忧限制了高级 AI 模型的使用。
行业动态,涉及数据安全对大厂模型使用的影响,值得了解。
-
Grok 4.7 and Grok 5: Elon Musk Shares Details on xAI’s Upcoming AI Models - LatestLY
马斯克分享了 xAI 即将推出的 Grok 4.7 和 Grok 5 模型的细节。
头部大模型的新一代规划,可能涉及算力规模和架构演进,值得关注。
-
Anthropic指控Kimi转发客户请求至Claude 用户资料去向引发争议 - 虎嗅网
Anthropic 指控 Kimi 将客户请求转发至 Claude,引发数据去向争议。
涉及国内大模型套壳/API调用的争议事件,可作行业八卦了解。
-
智谱2025上半年营收增长2736%但亏损扩大,Agent应用爆发驱动Token调用量涨40倍 - 虎嗅网
智谱2025上半年营收大增但亏损扩大,Agent爆发致Token调用量涨40倍。
Token调用量暴涨反映了推理侧的巨大压力,侧面印证推理优化的重要性。
-
DeepSeek下一波大模型被指即将问世:3万亿参数 性能超GPT-6 Astra - i.ifeng.com
传闻DeepSeek即将发布3万亿参数新模型,性能超GPT-6 Astra。
3万亿参数级别的训练对集群和并行策略要求极高,值得关注。
-
Omni-Streaming Thinking
论文提出 Omni-Streaming Thinking,解决流式全模态模型中过早跨模态承诺的问题。
涉及多模态模型的推理机制,对理解新架构有一定帮助。
其余 27
-
从 Trace 到规模化实时评估:面向生产流量的 Agent 可观测实践|QCon上海
QCon上海分享面向生产流量的Agent可观测性与实时评估实践。
偏向应用层Agent的工程监控,不涉及GPU或底层训练推理优化。
-
智谱融资50亿美元,加码大模型研发 - 新浪网
智谱完成 50 亿美元融资,加码大模型研发。
与前述智谱融资新闻重复。
-
大模型重压之下 - 北京商报
媒体评论大模型行业面临的重重压力。
泛泛的行业评论文章,无具体技术信息。
-
Watch astronaut Christina Koch and Google’s James Manyika discuss space, technology, and discovery.
宇航员 Christina Koch 与谷歌高管 James Manyika 探讨太空与科技。
泛泛的科技对谈,不涉及具体技术细节,可以跳过。
-
Anthropic Says Chinese AI Labs Secretly Used 190M Claude Exchanges - Memeburn
Anthropic 称中国 AI 实验室秘密使用了 1.9 亿次 Claude 交互数据。
与前述模型蒸馏攻击的新闻重复。
-
Orion Expands Anthropic Collaboration as Launch Partner for Claude for Financial Advisors - Business Wire
Orion 扩大与 Anthropic 的合作,推出面向财务顾问的 Claude 服务。
纯商业合作与金融应用落地,与底层技术无关。
-
DevFest is back
谷歌宣布 2026 年 DevFest 开发者大会回归。
开发者活动预告,无实质技术内容。
-
Nvidia, Palantir, and others restrict advanced AI model usage over privacy concerns, report claims — 'paranoia' rising over customer intellectual property - Tom's Hardware
Nvidia 和 Palantir 等公司因隐私担忧限制高级 AI 模型使用。
与前述 Nvidia 限制模型使用的新闻重复。
-
智谱股债双线再融资50亿美元 AI大模型资本竞赛进入深水区 - 观点网
智谱通过股债双线再融资 50 亿美元,AI 资本竞赛加剧。
与前述智谱融资新闻重复。
-
Anthropic prepares Claude Money feature for iOS app launch - Crypto Briefing
Anthropic 准备在 iOS 应用中推出 Claude Money 功能。
C端产品功能更新,不涉及底层或模型架构。
-
Pentagon shifts away from Anthropic models as Nvidia, Palantir, and Booz Allen raise AI concerns - Crypto Briefing
因 Nvidia 等公司提出 AI 担忧,五角大楼逐渐放弃使用 Anthropic 模型。
政策与行业动态,与前述隐私担忧新闻相关,技术价值低。
-
How Fyxer built an AI executive assistant people trust
Fyxer 利用 OpenAI 模型和微调技术构建了受用户信任的 AI 行政助手。
偏应用层面的营销案例,与底层优化和生成模型方向无关。
-
DeepSeek“推倒重来” - Sohu
媒体文章探讨 DeepSeek 的战略或架构调整。
标题党或泛泛的商业评论,缺乏实质技术干货。
-
393亿港元!智谱又融资了 - 新浪财经
智谱再次获得巨额融资。
与前述智谱融资新闻重复。
-
三个月价格腰斩,大模型的“聪明”正在贬值? - 潮起网
媒体讨论大模型API价格战导致价格腰斩的现象。
泛泛的商业与价格战讨论,不涉及底层技术。
-
是时候重新评估 MiniMax 了 - PANews
媒体发文呼吁重新评估大模型公司 MiniMax 的价值。
偏向投资和商业价值评估的文章,可跳过。
-
智谱要用50亿美元织一张网 - Sohu
媒体分析智谱 50 亿美元融资后的战略布局。
与前述融资事件相关的商业分析,技术价值低。
-
首届蚂蚁灵波具身大模型挑战赛正式启动
蚂蚁启动首届灵波具身大模型挑战赛,推广LingBot-VLA。
具身智能比赛,与底层算子优化或生成模型核心方向关联较弱。
-
Artificial intelligence debate explodes: From Anthropic warnings to Palantir optimism, what are tech bros... - Moneycontrol.com
媒体探讨从 Anthropic 的警告到 Palantir 的乐观态度引发的 AI 辩论。
泛泛的行业观点讨论,缺乏技术深度。
-
恒指涨,恒科跌,汽车、生物医药爆发;光通信、半导体、大模型下挫,智谱跌超9%,兆易创新跌超7% | 港股收盘 - 每日经济新闻
港股收盘大模型及半导体板块下挫,智谱跌超9%。
纯股市行情波动,与技术研发和性能优化无关。
-
曝DeepSeek来了位90后CFO - 华尔街见闻
传闻 DeepSeek 迎来一位 90 后首席财务官。
公司人事变动,与技术无关。
-
【中国新闻周刊】不差钱的DeepSeek,冲刺上市? - fj.chinanews.com.cn
媒体探讨资金充裕的 DeepSeek 是否正在冲刺上市。
资本市场传闻,不涉及技术细节。
-
DeepSeek灰度测试语音对话功能 App新增四种朗读音色 - 观点网
DeepSeek App 灰度测试语音对话功能,新增四种朗读音色。
C端应用层面的小功能更新,可跳过。
-
智谱完成约50亿美元融资:用于扩大算力供给等用途 - Pchome电脑之家
智谱完成约50亿美元融资用于扩大算力供给。
重复报道,已在另一条智谱融资新闻中说明。
-
港股大模型“双雄”齐重挫 智谱跌超10% MINIMAX跌超6% - 东方财富
港股大模型公司智谱和 MiniMax 股价遭遇重挫。
纯股市波动新闻,与技术研发无关。
-
Crypto Hack Fears Grow Around Anthropic’s Possible Claude Fable Release - Yellow.com
围绕 Anthropic 可能发布的 Claude Fable,加密货币黑客攻击的担忧加剧。
涉及加密货币安全的行业传闻,与你的技术方向无关。
-
WAIC现场,国产大模型集体“摸高” - 第一财经
WAIC大会现场国产大模型集体展示最新进展。
展会泛泛报道,缺乏具体的技术细节或硬核发布。