AI 信息雷达
2026 年 9 月 17 日 · 周四
103 条 · 来自 28/28 个源 · 必看 10 / 值得看 16 / 其余 77 · AI 摘要(gemini-3.1-pro-preview)
当天新发现 1 个活动,已归入 活动清单 →
必看 10
-
TensorRT Edge-LLM Completes the MLPerf Edge Agentic Benchmark 6.4x Faster on Jetson AGX Thor
TensorRT Edge-LLM 在 Jetson AGX Thor 上的 MLPerf 边缘智能体基准测试中速度提升 6.4 倍。
涉及 NVIDIA 的推理引擎优化和硬件性能基准,直接关联推理性能优化工作。
-
Open Research, Tooling & Optimization at PyTorch Conference North America 2026
2026 年北美 PyTorch 大会将重点展示编译器架构、跨硬件 Kernel DSL 等领域的开源研究与性能优化。
涉及编译器、Kernel DSL 和性能优化,直接关系到日常训练推理系统工作。
-
Low Precision Flash Attention 4: End-to-End Block-Scaled Attention for Blackwell
发布 FlashAttention-4,支持 MXFP8 前向和反向传播,在 Blackwell 架构上实现端到端块缩放注意力优化。
FlashAttention 最新低精度优化,针对 Blackwell 硬件,Kernel 优化必读。
-
Translating CUDA Tile Operations from Python to Rust Using Agentic AI
介绍使用 AI 智能体将 CUDA Tile 操作从 Python 翻译为 Rust,以构建安全的 GPU kernel。
直接涉及 GPU kernel 编写和 CUDA 优化,与核心工作高度相关。
-
DeepSeek工程师写下《不得不把才华埋葬在昨天》火出圈:亲手交付V4.1核心算子后预判,半年内AI将超越自己 - Sohu
DeepSeek工程师交付V4.1核心算子后发文,预判半年内AI写算子能力将超越自己。
涉及V4.1核心算子开发及AI自动生成kernel的趋势,与你的工作直接相关。
-
国金证券:DeepSeek V4.1 Flash发布 关注国产大模型与AI应用 - finance.sina.com.cn
国金证券研报关注 DeepSeek V4.1 Flash 模型的发布及应用。
DeepSeek 新模型发布可能涉及高效推理或训练架构,值得关注。
-
B站AI无限竞技场今日上线!全球百大AI模型同场竞技,GPT-6高居榜首
B站上线「AI无限竞技场」大模型测评榜单,GPT-6位居榜首。
榜单惊现GPT-6,需关注是否为OpenAI新模型灰度测试或重大榜单变化。
-
国金证券:DeepSeek V4.1 Flash发布 关注国产大模型与AI应用 - caiwennews.com
国金证券研报指出DeepSeek V4.1 Flash发布,提示关注国产大模型应用。
涉及DeepSeek新版本模型发布,可能包含推理性能优化,值得关注。
-
Modality-Autoregressive World-Action Models
提出 ModAR,首个在预测动作前自回归去噪多个未来模态的世界-动作模型。
涉及世界模型、多模态自回归和去噪机制,与视频生成架构高度相关。
-
VC-Attention: Value Smoothing and Softmax Casting for Low-bit Attention
提出 VC-Attention,通过 Value 平滑和 Softmax 转换解决 Diffusion Transformers 中低比特注意力的精度和速度瓶颈。
针对 Diffusion 模型的 Attention 算子进行低比特量化和 Kernel 优化,完美契合工作方向。
值得看 16
-
Mozilla 报告显示:中美AI 模型能力差距缩短至4.4 个月|Kimi K3|美国|月之暗面|闭源模型|开源模型_手机新浪网 - finance.sina.com.cn
Mozilla 报告指出中美 AI 模型能力差距已缩短至 4.4 个月。
宏观模型能力评估,可作为行业背景了解,无具体技术细节。
-
How to Use AI Agents to Prepare 3D Scenes for Simulation
介绍如何使用智能体 AI 工作流来准备和验证物理 AI 系统的数字孪生 3D 场景。
涉及 3D 场景处理和 AI Agent,与关注的 3D 生成方向有一定交叉,值得扫一眼。
-
Our framework for reporting model misalignment
OpenAI 分享了跟踪、调查和披露模型对齐失效的框架,并附带六份异常行为报告。
涉及模型对齐和安全评估框架,值得了解前沿安全标准。
-
通用能力不打折,空间具身智能断层领先!ZDTaichu5.0-9B国产开源,跻身全球多模态第一梯队
ZDTaichu5.0-9B多模态模型开源,在空间具身智能测试中表现优异。
涉及多模态与具身智能模型开源,可简单了解其架构。
-
DeepSeek工程师长文爆火出圈,本人回应:并非表达失业焦虑 - 新浪财经
DeepSeek 算子负责人刘胜与发表长文引发热议,本人回应并非表达失业焦虑。
涉及底层算子开发者的心路历程与行业趋势探讨,值得同行一读。
-
智谱加码大模型Scaling 投入300亿元算力 瞄准训练与推理 - Sohu
智谱投入300亿元算力加码大模型Scaling,重点瞄准训练与推理。
涉及大规模算力投入与训练推理方向,可关注行业算力规模。
-
智谱称Co-work商业化快于预期 GLM-5.3发布1个月订单超10亿元 - 观点网
智谱透露 GLM-5.3 发布一个月订单超 10 亿元,Co-work 商业化超预期。
提及 GLM-5.3 的商业落地情况,可作为国产模型进展的背景了解。
-
DeepSeek工程师长文爆火出圈,本人回应:并非表达失业焦虑 - finance.sina.com.cn
DeepSeek算子工程师回应其爆火长文,澄清并非表达失业焦虑。
涉及算子开发者的职业思考与技术演进,作为同行可扫一眼。
-
ActionPiece: Rethinking Action Tokenization for Autoregressive Vision-Language-Action Models
提出物理秩一致性(PRC)指标,重新思考自回归视觉-语言-动作模型中的动作分词保真度。
涉及多模态模型的 Tokenization 改进,对生成模型架构有一定参考价值。
-
Agora: Git as Shared Memory for Collective AutoResearch
提出 Agora,将 Git 作为自主研究智能体的共享内存,记录研究过程的 DAG 以避免重复搜索。
创新的 AI Agent 协作与记忆机制,对自动化研究有启发。
-
ScienceIDE: Turning World's Scientific Codebase into Agent Learnable Environments
推出 ScienceIDE,将科学代码库转化为科学智能体可编程、可学习的执行环境。
科学计算与 AI Agent 结合的基础设施,值得关注其环境构建思路。
-
能听会说,还能推理执行,阶跃星辰发布新一代语音大模型StepAudio 3系列 - finance.sina.com.cn
阶跃星辰发布新一代语音大模型StepAudio 3系列,具备听、说及推理执行能力。
语音大模型发布,非视觉生成或底层优化核心方向,可简单了解。
-
FLAT: Resampling Image and Text into 1D Flexible-Length Aligned Transmodal Tokens for Retrieval and Generation
提出 FLAT 框架,将图像和文本重采样为一维灵活长度对齐的跨模态 Token,用于联合检索和生成。
涉及多模态表征学习和生成模型的底层架构改进,对生成模型研究有参考价值。
-
ModularRSI: Modular and Generalizable Recursive Harness Self-Improvement
提出 ModularRSI,通过模块化和可泛化的递归自我改进机制提升智能体在长视野任务中的表现。
探讨 Agent 的自我进化机制,属于前沿研究,可扫一眼。
-
HarnessVLN: Unifying Training-Free Embodied Navigation through an Agent Harness
提出 HarnessVLN,一个免训练的具身导航框架,通过统一的工具接口协调多模态大模型的感知与导航。
具身智能和多模态模型的结合,涉及空间推理,与 3D 领域有一定关联。
-
Enabling Creative Exploration for Vibe Design Agents
论文提出一种推理架构,将设计方向作为显式中间决策,帮助 Vibe 设计 Agent 探索连贯的替代方案。
涉及生成模型在设计领域的推理架构改进,对生成控制有一定参考价值。
其余 77
-
vivo 把 Agent 做进操作系统:6000 多项原子技能开放调用,AgentOS 预览版亮相
vivo发布AgentOS预览版,将Agent集成进操作系统并开放6000多项技能调用。
偏向端侧应用与操作系统集成,与底层训练和生成模型无关。
-
【网经社AI科普】智谱清言:基于GLM-4的国产全能型高安全大模型 - Sohu
网经社科普基于 GLM-4 的智谱清言大模型。
面向大众的科普文章,无深度技术价值。
-
Anthropic merges Claude chat and Cowork features into one interface: Here’s what it means for users - The Times of India
Anthropic 将 Claude 聊天和 Cowork 功能合并到一个界面中。
产品 UI/UX 更新,与底层技术无关。
-
MicrosoftAI CEO flags Anthropic's AI development model, says it will make alignment difficult - Times of Oman
微软 AI CEO 称 Anthropic 的 AI 开发模式将使对齐变得困难。
重复的行业观点讨论,无技术价值。
-
“试图提取、蒸馏AI模型”…美政府对中企“抄袭”亮黄牌 - 朝鮮日報中文版
美政府警告中国企业试图提取和蒸馏美国 AI 模型。
政策与地缘政治新闻,不涉及具体的蒸馏技术细节。
-
AI调用量连续20周超美国,中国大模型靠什么抢市场? - 手机新浪网
报道探讨中国大模型 AI 调用量连续 20 周超过美国的原因。
市场营销与商业分析,与底层技术无关。
-
Microsoft AI CEO Mustafa Suleyman just told everyone who thinks that AI can have feelings: AI Agents do n - The Times of India
微软 AI CEO Mustafa Suleyman 表示 AI 智能体没有感情。
个人观点与哲学讨论,与工程优化无关。
-
网易有道周枫:AI能力竞争,正在进入「Model + Agent + Workflow」时代,网易有道AI Open Day展示AI时代“有道解法”
网易有道周枫在AI Open Day上表示AI竞争进入Model+Agent+Workflow时代。
偏向应用层的宏观讨论,与底层优化和生成模型无关。
-
Mozilla has partnered with AI company Mistral AI to expand Firefox's AI capabilities. - GIGAZINE
Mozilla 与 Mistral AI 合作扩展 Firefox 的 AI 功能。
浏览器产品集成,不涉及底层优化或生成模型。
-
Novo Nordisk teams up with Anthropic in race to speed up drug development - 디지털투데이
诺和诺德与 Anthropic 合作加速药物研发。
医药领域的商业应用,非底层技术。
-
智谱:年末年度经常性收入指引上调至30亿美元,算力规模初具雏形 - thepaper.cn
智谱上调年末 ARR 指引至 30 亿美元,算力规模初具雏形。
重复的财务新闻,算力部分缺乏具体技术指标。
-
智谱大举融资近400亿 市值已蒸发近万亿 - 东方财富
智谱近期大举融资近400亿元,但市值出现大幅缩水。
纯资本市场动态,不涉及技术细节。
-
Anthropic and OpenAI Propose Independent Evaluators to Ensure AI Safety - zamin.uz
Anthropic 和 OpenAI 提议设立独立评估机构以确保 AI 安全。
AI 安全政策倡议,不涉及训练优化或生成模型。
-
Anthropic and OpenAI want to embed safety evaluators. Will they really be independent? - TechCrunch
质疑 Anthropic 和 OpenAI 嵌入独立安全评估员的实际独立性。
重复的 AI 监管与安全政策讨论,可跳过。
-
Microsoft AI Chief Challenges Anthropic's Training Methods and Calls for Unified AI Oversight - inkorr.com
微软AI主管Mustafa Suleyman批评Anthropic的训练方法,并呼吁统一的AI监管。
行业高管的泛泛观点,与底层技术和性能优化无关,可跳过。
-
Microsoft AI chief warns against Anthropic model training – FRCN HQ - FRCN HQ
微软 AI 负责人警告 Anthropic 的模型训练方式。
重复的行业口水战报道。
-
Agent 的经济账,不能只算 Token——阿里用 Qoder Cloud Agents 给出答案
阿里推出Qoder Cloud Agents,探讨Agent应用中的经济成本问题。
偏向Agent应用的商业成本讨论,与底层优化无关。
-
Mozilla Partners With Mistral To Bring Mistral Small 4 To Firefox Smart Window Beta - Pulse 2.0
Mozilla 与 Mistral 合作,将 Mistral Small 4 引入 Firefox 智能窗口测试版。
浏览器集成 AI 模型的商业合作,可跳过。
-
大模型第一股,业绩利好! - 新浪财经
某“大模型第一股”发布利好业绩报告。
股市与财报新闻,不涉及底层技术。
-
Anthropic Launches Claude For Advisors With Schwab And BlackRock - Forbes
Anthropic 联合嘉信理财和贝莱德推出面向财务顾问的 Claude 版本。
金融领域的商业合作与产品发布,不涉及底层技术。
-
Helping older adults use AI in everyday life
OpenAI 与 AARP 合作,在 10 个美国城市为老年人提供免费的 ChatGPT 研讨会。
针对老年人的 AI 普及活动,与底层技术和性能优化无关,可跳过。
-
Anthropic's Approach Encouraging AI To Believe It's Conscious Could Be Disastrous For Humanity: Microsoft AI CEO Mustafa Suleyman - OfficeChai
微软 AI CEO 批评 Anthropic 鼓励 AI 相信自己有意识的做法。
重复的微软高管批评 Anthropic 的观点。
-
智谱将年末ARR指引上调25% 大模型投资逻辑“向实” - 央广财经
智谱将年末年度经常性收入(ARR)指引上调 25%。
纯财务与商业营收数据。
-
Microsoft AI CEO criticises Anthropic over model ‘rights’ - AI News
微软 AI CEO 批评 Anthropic 关于模型“权利”的观点。
行业口水战,与技术研发无关。
-
智谱高管解读50亿美元融资:有信心年末ARR指引上调至30亿美元 - 财富号
智谱高管解读融资并重申上调年末 ARR 指引至 30 亿美元。
重复的融资与财务新闻。
-
Anthropic, OpenAI proposed new 'neutral' AI watchdogs. Why you should worry about the idea - CNBC
探讨 Anthropic 和 OpenAI 提议设立“中立”AI 监管机构可能带来的隐患。
行业政策与监管讨论,与技术研发无关。
-
大模型第一股,业绩利好! - finance.sina.com.cn
某“大模型第一股”发布利好业绩报告。
股市与财务新闻,与技术无关。
-
TotalEnergies, Mistral Ink €100M AI Deal for Oil & Gas Exploration - News and Statistics - indexbox.io
TotalEnergies 与 Mistral 签署 1 亿欧元 AI 合作协议用于油气勘探。
纯商业合作,与底层技术和生成模型无关。
-
Reimagining advertising with AI
OpenAI 推出 AI 驱动的广告新体验,包括赞助智能体及与 HubSpot 和 Shopify 的集成。
商业广告产品发布,不涉及底层模型或基础设施,可跳过。
-
智谱高管:算力瓶颈缓解,ARR指引上调至30亿美元 - 微博
智谱高管表示算力瓶颈缓解,并上调年度经常性收入指引至30亿美元。
偏向公司财务与商业指引,与底层技术无关。
-
How to connect AI usage to business value
介绍如何通过 ChatGPT Work 和 Codex 分析工具将 AI 使用情况与业务价值联系起来。
偏向企业管理和商业价值分析,与技术研发无关。
-
腾讯控股盘中涨超3% 富瑞给予“买入”评级 - finance.sina.com.cn
腾讯控股股价上涨,获富瑞“买入”评级。
纯股市动态。
-
大模型第一股,业绩利好! - 新浪财经
报道国内“大模型第一股”智谱业绩利好,营收预期上调。
重复报道智谱的财务利好消息,可跳过。
-
智谱再融335亿元,AI公司上市后融资成常态 - 虎嗅网
智谱再次融资335亿元,反映AI公司上市后融资常态化。
纯资本运作与融资新闻,与技术无关。
-
DeepSeek刘胜与:AI发展加速,亲手写算子时光将逝,减速共识是骗局? - blog.csdn.net
DeepSeek刘胜与发文探讨AI加速发展下算子手写时代的消亡。
重复报道算子工程师长文事件。
-
How workers are unlocking new ways of working
OpenAI 经济研究展示了员工如何超越传统角色使用 AI 以及哪些新活动成为常规工作。
经济与社会学研究,与底层技术和模型优化无关。
-
AI大模型工场2026 AI产业生态大会今日举办,大咖同台共探智能生长与产业共生
AI大模型工场举办2026 AI产业生态大会,探讨智能生长与产业共生。
泛泛的行业会议通稿,无具体技术细节。
-
智谱分析师交流会:年末ARR指引上调25%至30亿美元,云厂商分成收入10月起确认 - 华尔街见闻
智谱分析师交流会确认上调年末 ARR 指引及云厂商分成计划。
重复的财务与商业模式新闻。
-
阶跃星辰姜大昕:金融垂类大模型正从单点应用走向金融AI基础设施共建 - finance.sina.com.cn
阶跃星辰姜大昕表示,金融垂类大模型正从单点应用走向金融AI基础设施共建。
偏金融行业应用与宏观讨论,与底层优化和生成模型无关,可跳过。
-
协同办公进入Agent时代,飞书+豆包工作跑在了最前面
飞书结合豆包大模型推出 AI 协同办公功能,推动办公进入 Agent 时代。
纯应用层产品宣传,与底层技术无关。
-
「AI新世代」AI减速论升温!智谱、MiniMax接连补粮草股价大跌,大模型投资逻辑变了? - finance.sina.com.cn
探讨 AI 发展减速论及智谱、MiniMax 融资对大模型投资逻辑的影响。
资本市场分析,不涉及底层技术或模型架构。
-
国内AI原生公司观察:联想集团业务重构与MiniMax模型研发 - t.cj.sina.cn
媒体观察联想集团业务重构与MiniMax的模型研发进展。
偏向公司商业观察,缺乏具体技术细节。
-
DeepSeek算子负责人长文引爆网络,《我不得不把才华埋葬在昨天》是在反击Anthropic吗 - 手机新浪网
DeepSeek算子负责人长文引发网络热议,被猜测是否在反击Anthropic。
重复报道算子工程师长文事件,看前一篇即可。
-
清华稳准智能联合发布LimiX-2,结构化数据基础模型登顶国际评测榜单
清华与稳准智能联合发布400M参数的结构化数据基础模型LimiX-2。
针对结构化数据的小参数模型,与生成模型或底层优化关系不大。
-
DeepSeek:主打数学与代码能力的开源大模型 - ChemNet News
媒体科普DeepSeek主打数学与代码能力的开源大模型特性。
泛泛的科普文章,缺乏最新技术增量。
-
Anthropic will open its Singapore office in October, chasing OpenAI for Southeast Asia's AI market - Fortune
Anthropic 将于 10 月在新加坡开设办事处,进军东南亚市场。
公司扩张新闻,与技术无关。
-
港股异动 | 智谱(02513)午后涨超12% 机构看好其GLM系列模型能力迭代及ARR增长 - 凤凰网
智谱港股大涨超 12%,机构看好其 GLM 模型迭代及 ARR 增长。
股市动态,可跳过。
-
吉祥三公游戏手机版下载_游戏资讯_国产大模型爆发组团狙击美国AI 又有史诗级plus提升 - 体坛加
游戏资讯网站发布的关于国产大模型爆发的营销水文。
垃圾营销内容,毫无技术价值。
-
Tanium tests Anthropic AI for code vulnerabilities - SecurityBrief Australia
Tanium 测试使用 Anthropic AI 检测代码漏洞。
下游安全应用,与模型训练和优化无关。
-
Greens slam Anthropic-Queensland data centre agreement - The West Australian
绿党抨击 Anthropic 与昆士兰州的数据中心协议。
环保与基础设施政策争议,无技术细节。
-
智谱、MiniMax,大砍销售开支 - thepaper.cn
智谱和MiniMax等国内大模型公司大幅削减销售开支。
纯商业运营动态,与技术研发无关。
-
Anthropic opening S'pore office in Oct. 2026 - Mothership
Anthropic 将于 2026 年 10 月在新加坡开设办事处。
重复的公司扩张新闻。
-
DeepSeek工程师长文爆火出圈,本人回应:并非表达失业焦虑 - Sohu
DeepSeek工程师回应长文爆火,澄清并非表达失业焦虑。
重复报道,已在最权威条目中标记。
-
A社“AI末日”资本黑手被揪出,炒作焦虑为IPO圈钱!难怪仇视DeepSeek开源 - 新浪网
媒体指责某公司炒作AI焦虑以圈钱,并仇视DeepSeek开源。
行业八卦和情绪化报道,无技术参考价值。
-
《股市简讯》中国AI大模型商智谱反弹5.3%,上日获港股通净买入逾7亿港元 - TradingView
智谱在股市反弹,获港股通净买入。
纯股市动态,与技术研发无关。
-
【网经社AI科普】DeepSeek:主打数学与代码能力的开源大模型 - Sohu
网经社科普DeepSeek主打数学与代码能力的特性。
重复的科普文章,无技术增量。
-
国金证券:DeepSeek V4.1 Flash发布 关注国产大模型与AI应用 - Sohu
券商研报关注DeepSeek V4.1 Flash发布及国产大模型应用。
重复的模型发布报道。
-
A社“AI末日”资本黑手被揪出,炒作焦虑为IPO圈钱!难怪仇视DeepSeek开源 - finance.sina.com.cn
媒体指责Anthropic炒作AI末日焦虑以圈钱,并仇视DeepSeek开源。
偏向行业八卦与情绪化营销文章,无技术价值。
-
DeepSeek工程师也有AI焦虑:不至于失业,但必须转业 - Sohu
DeepSeek工程师发文谈及AI发展带来的职业焦虑与转业思考。
重复报道算子工程师长文事件。
-
Anthropic to open Singapore office in October, sees it as a ‘standout market’ for Claude - The Business Times
Anthropic 计划 10 月在新加坡开设办事处。
重复的公司扩张新闻。
-
Mark Zuckerberg Takes Aim at Anthropic in Debate Over A.I. Slowdown - The New York Times
扎克伯格在 AI 发展放缓的辩论中将矛头指向 Anthropic。
科技巨头间的政策与发展理念辩论,无技术干货。
-
9778VNSR威尼斯人官网_体育_取次硅谷懒回顾,半缘DeepSeek半缘Kimi - 体坛加
体育博彩网站发布的关于DeepSeek和Kimi的营销水文。
垃圾营销内容,毫无技术价值。
-
ProgramDistill: From Interactive Web Apps to Verifiable Reference-Guided SWE Tasks
提出 ProgramDistill 基准,通过与功能完整的参考应用交互来评估代码智能体。
软件工程 Agent 的评估基准,偏向 Web 开发,与底层优化无关。
-
国产大模型Kimi 凯发K8官网怎么注册问世 美国AI巨头Anthropic被冲击:估值少了9000亿 - 体坛加
媒体炒作Kimi问世对Anthropic估值的冲击。
媒体炒作与情绪化报道,无技术参考价值。
-
博九BET9_游戏资讯_国产大模型爆发组团狙击美国AI 又有史诗级plus提升 - 体坛加
游戏资讯网站发布的关于国产大模型的营销水文。
垃圾营销内容,毫无技术价值。
-
DeepSeek工程师发文引热议,算子天才也在思考“转业” - 36氪
DeepSeek算子工程师发文引发热议,探讨技术发展下的职业转型。
重复报道算子工程师长文事件。
-
港股大模型双雄大跌,新融资与海外巨头“减速”信号冲击 - 第一财经
港股大模型公司股价大跌,受新融资及海外巨头减速信号影响。
股市与宏观行业分析,无技术干货。
-
Claude for Financial Advisors Debuts With BlackRock, Schwab; Client Data Stays on Custodian Servers - Tech Times
面向财务顾问的 Claude 发布,与贝莱德、嘉信理财合作。
金融领域的垂直应用发布,非底层技术。
-
DeepSeek算子负责人:《我不得不把才华埋葬在昨天》 - tech.ifeng.com
DeepSeek算子负责人发表长文《我不得不把才华埋葬在昨天》。
重复报道算子工程师长文事件。
-
Digest: Omnicom Eyes New Pricing Model; Anthropic Forecasts Second Straight Quarter of Profit - exchangewire.com
Anthropic 预测将实现连续第二个季度的盈利。
财务预测,不涉及模型技术。
-
智谱融资50亿美元,加码大模型研发 - 新浪财经
智谱完成 50 亿美元融资,将用于加码大模型研发。
巨额融资新闻,但无具体技术细节。
-
刚写完V4.1主算子就要“转业”?DeepSeek资深算子工程师深夜独白 - tech.ifeng.com
DeepSeek资深算子工程师发文,感叹AI发展加速导致手写算子时代可能终结。
重复报道,已在最权威条目中标记。
-
EvolveTrade: Experience-Driven Policy Refinement for Self-Evolving LLM Trading Agents
提出 EvolveTrade 框架,通过经验驱动策略改进自我进化的 LLM 交易智能体。
金融交易领域的 Agent 应用,与底层优化和生成模型无关。
-
AI for Games in the Foundation Model Era
综述基础模型时代 AI 在游戏生命周期中的应用,涵盖玩家建模、游戏设计和运行时生成。
游戏 AI 的综述文章,偏向应用层,可跳过。
-
ScienceBuddy: Recursive-in-Recursive Self-Improvement for Interactive Scientific Agents
发布 ScienceBuddy,一个通过递归自我改进机制不断提升的交互式科学研究智能体工作区。
科学研究 Agent 的应用,与底层系统和生成模型关系不大。
-
Mind2Dialogue: Training Human-Aware Language Models by Simulating User Mental States
提出 Mind2Dialogue 框架,通过模拟用户心理状态来训练具备人类意识的语言模型。
偏向对话模型的人机交互和心理学模拟,与底层优化无关。
-
Another Blueprint In The Wall: How to Ask Frontier AI Like a Kid?
研究发现,使用特定受众框架(如对小孩说话)提示前沿模型,会使其回复收敛于特定的架构模式。
偏向 Prompt Engineering 的行为学研究,与底层性能优化无关。