Pai 的 AI 雷达

今日必看

今天这份简报把代理工具、知识接入和创作/开发工作流的可用能力,与 GitHub Copilot 模型退役、SecurityAdvisory GraphQL 字段增加、GPT-6/Blackwell/DGX Spark 更新及隐私安全研究放在一起;阅读时可先按“能否形成一个可执行步骤”筛选工具,再把平台变更当作接口与兼容性约束,把硬件和研究当作部署、评测与安全判断的依据。

日期
2026/10/03
今日条目
491
#01

GitHub Copilot 部分模型退役并给出替代

As of today, October 2, 2026, we have deprecated the following models across all GitHub Copilot experiences (including Copilot Chat, inline edits, ask and agent modes, and code completions). Model Deprecation date Suggested alternative Gemini 3.5 Flash 2026-10-02 Gemini 3.8 Flash

推荐理由这项通知可用于指导在GitHub Copilot各体验(包括代码补全、对话、行内编辑及智能体模式)中及时完成模型迁移,将已退役的Gemini 3.5 Flash平滑替换为推荐的Gemini 3.8 Flash,以避免配置失效并确保代码开发辅助功能的正常稳定运行。
Agent与工具GitHub Changelog
#02

SecurityAdvisory GraphQL 增加五个字段

You can now read more of the GitHub Advisory Database directly from the GraphQL API without falling back to the REST API. The SecurityAdvisory object gained five new fields: cveId : The advisory’s CVE identifier. sourceCodeLocation : A link to the affected source code relevant to

推荐理由通过新增的字段,可以在使用 GraphQL API 查询 GitHub 安全公告数据库时,直接获取漏洞的 CVE 编号及受影响源代码位置等关键信息,无需再回退调用 REST API,从而在统一接口下更高效地进行安全漏洞检索、依赖风险排查与相关代码定位。
产品接入GitHub Changelog
#07

DGX Spark 推出 64GB 版本

NVIDIA 宣布 DGX Spark 推出 64GB 统一内存新配置,10 月 23 日起由 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 发售,起步价 $4,999,支持最高 1000 亿参数模型在端侧运行。

推荐理由这款配备 64GB 统一内存的 DGX Spark 可以直接在端侧本地部署并流畅运行最高达 1000 亿参数的超大规模 AI 模型,用于开展复杂的大语言模型本地推理、生成式算法研发以及离线数据计算,无需依赖云端服务器即可完成高负载的端侧智能处理。
模型与评测硬件边缘AIHOT public items
#08

Chatham 用 Codex 与 GPT-5.6 重做交易校验

Chatham Financial uses Codex and GPT-5.6 to build technology and redesign workflows, cutting trade validation from 30 minutes to under 4.

推荐理由该方案能借助 Codex 与 GPT-5.6 构建专用工具并重塑业务流程,将原本长达30分钟的交易校验环节压缩至4分钟以内,用于全面加速金融交易的审核与确认流程,大幅提升整体运营效率并降低时间成本。
模型与评测OpenAI News
#09

Blackwell 加速 GPT-6 Astra Ultrafast

GPT-6 Astra Ultrafast 现已在 OpenAI API 及符合条件的 ChatGPT Work 和 Codex 用户中可用,运行在 NVIDIA Blackwell GPU 上。

推荐理由依托 NVIDIA Blackwell GPU 的硬件加速,该服务能在 OpenAI API、ChatGPT Work 与 Codex 环境下提供极速交互体验,不仅可用于实时编写并调试软件代码,还能深度辅助企业日常办公与协作,并为各类第三方系统接入提供高并发、超低延迟的智能模型推理支持。
模型与评测AIHOT public items
#13

A Living Benchmark for Information Retrieval from Electronic Health Records

arXiv:2609.30205v2 Announce Type: replace Abstract: Large language model (LLM)-based clinical assistants are increasingly being integrated into electronic health record (EHR) systems, transforming how clinicians retrieve and synthesize information from patient records. Their safe

推荐理由该动态基准可用于持续评测和衡量接入电子健康档案系统的大语言模型临床助手,检验其协助临床医生从患者病历中检索与综合关键信息的实际能力与效能,从而助力临床辅助技术的迭代升级。
模型与评测生信医疗arXiv cs.AI 官方
#14

A rubric landscape for evaluating clinical reasoning in large language models: what exists, what is missing, and what needs to be combined

arXiv:2610.01938v1 Announce Type: cross Abstract: Exam-style accuracy does not establish whether large language models (LLMs) reason well over clinical records. We define clinical reasoning as integrating and updating evidence across time and sources to form, revise and justify a

推荐理由该研究构建的评估标准图景可用于突破应试准确率的局限,全面考查大语言模型在临床病历分析中跨越时间与多源信息整合并更新证据的过程,以此评估模型形成、修正和论证临床决策的深度推理能力。
模型与评测生信医疗arXiv cs.AI 官方
#15

Build Applications on NVIDIA BlueField Faster with NVIDIA DOCA Agent Skills

AI agents are becoming a standard part of development workflows, but general-purpose agents weren’t built with specialized infrastructure software such as NVIDIA DOCA in mind. Without domain-specific knowledge, agents may fall back on guesswork. This is an issue in infrastructure

推荐理由它能为通用 AI 智能体提供 NVIDIA DOCA 专属的专业领域知识支持,消除其在基础设施软件开发中因缺乏专业认知而产生的盲目猜测,从而显著加速并高质量地在 NVIDIA BlueField 上构建应用程序。
Agent与工具NVIDIA Developer GenAI
#16

How Much of a Harness Does a Strong Agent Need for Autonomous ML Engineering?

Recent autonomous machine learning engineering (MLE) agents have made significant progress on public leaderboards. Often motivated by progress stagnation over long-horizon cycles and limited Large Language Model (LLM) primitives, modern MLE agents are deployed on top of increasin

推荐理由该成果可用于自动化开展机器学习工程流程,通过探索强智能体对外部框架支持的依赖程度,有效缓解长周期循环中常见的进度停滞问题,进而提升大语言模型在公开排行榜等复杂场景下的自主工程研发与落地能力。
Agent与工具Apple ML Research
#17

Inside-Out AI: Rebuilding Airbnb Behind the Scenes and Across the Guest Experience

Prior to joining Airbnb as CTO in January, Ahmad Al-Dahle was head of generative AI at Meta and led the launch of its open source Llama models over 2023-2025. Now Al-Dahle is in charge of turning Airbnb into an “AI-native company”. What that means in practice is using AI internal

推荐理由该内容可用于深入了解前Meta生成式AI负责人兼Llama主导者Ahmad Al-Dahle出任Airbnb首席技术官后,如何从企业内部运作到房客端体验全面重塑业务,并参考其将大型成熟平台打造为AI原生企业的战略路径与落地实践。
创作成片Latent Space
#18

和 Opus 5.5 同题交卷,MiniMax M3.1 让 Flash 开始超纲了

中秋刚过,国庆又到,AI 圈却没有跟着放假。 新模型依然一个接一个地上线。旗舰模型忙着刷新能力上限,主打速度和性价比的模型则在争夺用户的日常工作。不过,随着后者的能力不断提升,两者之间的分工也开始变得模糊。 过去需要请出旗舰模型的任务,如今交给一个名字里带着 Flash 的模型,究竟能做到什么程度?前端创作是一个很直观的观察窗口,配色、排版、动画和交互做得怎么样,把作品放在一起就能看出差别。 上个月,Anthropic 推出了 Claude Opus 5.5。我们在 X 上看到,有人用它做动态作品集,有人让它画水墨动画。这些由代码做出来的作品,已经有了各

推荐理由你可以用它直接进行前端视觉与交互创作,通过代码输出兼顾出色配色、排版与细腻交互的动态作品集,甚至生成极具表现力的水墨动画,以更高的速度和性价比搞定过去需要旗舰模型才能做到的日常设计与页面开发工作。
创作成片爱范儿
#19

Expanding AI Storage Access with NVIDIA cuObject and the NVIDIA SCADA Server SDK

AI infrastructure engineers, storage developers, and cloud service providers need fast and secure access to high-capacity file and object storage to support AI workloads. AI workloads increasingly require high-speed data access for training, fine-tuning, inference context, tool c

推荐理由该技术可为海量文件与对象存储提供高速且安全的数据访问支持,高效赋能模型训练、参数微调、推理上下文读取及工具调用等各类 AI 业务场景,大幅提升数据交互吞吐效率并保障底层存储访问的安全稳定。
模型与评测NVIDIA Developer GenAI
#20

AI music maker Suno now generates spoken words

Suno is branching out from the world of AI music, launching a new feature that generates spoken voices based on scripts or prompted descriptions. Speech is now available in public beta across Suno's web and mobile platforms, and allows you to simultaneously generate voiceovers an

推荐理由用户可以通过输入脚本或提示词描述来生成逼真的人声对白与画外音,并能同时完成配音与音乐的同步生成,从而快速制作视频解说、有声读物、播客旁白以及融合了语音与音乐的各类多媒体音频内容。
创作成片The Verge AI
#21

Suno 推出 Speech beta:语音与背景音乐一体生成

Suno 推出 Speech beta,称其为首个能把语音与原创背景音乐作为一条完整曲目生成的音频模型。用户输入文字并描述想要的声音和音乐风格即可创作,beta 已向所有用户开放,官方提示仍存在口音漂移、停顿过重等问题并将持续改进。

推荐理由它能够让用户仅通过输入文字内容并描述所需的声音与音乐风格,就直接将语音与原创背景音乐一体化合成为一条完整的音频曲目,实现无需额外配乐混音的一站式有声内容生成与创作。
创作成片AIHOT public items
#22

Academia is for Ambition — Alex Zhang, MIT

Last call for regular tickets for AI Engineer NYC ! As an exclusive for Latent Space subscribers, the first 30 of you can take a 30% off code if it helps - for new tickets only, no refunds! See you in 2 weeks! While we tend to cover industry on the pod, every so often we celebrat

推荐理由借助该内容不仅能领取前三十名专属的七折优惠码用于抢购 AI Engineer NYC 大会的常规门票,还可以收听本期播客中麻省理工学院 Alex Zhang 关于学术雄心与前沿探索的深度访谈,进而了解学术界与人工智能产业前沿碰撞的最新动态。
创作成片Latent Space
#24

The Dot and the Swarm

I generally think I have done a good job anticipating the direction and pace of AI over the few years I have been writing this Substack, but I think I recently got something fairly large wrong. In the last year I have been posting about how I suspected that humans would have to a

推荐理由本文通过作者对自己此前预判人工智能发展节奏与方向的深度复盘和纠偏,能够用于启发对人与AI协作关系的重新审视,并作为洞察前沿科技演进态势、校准未来预判思路的重要参考。
创作成片One Useful Thing
#25

The Battle to Be Your Personal AI Agent Is Here

OpenAI's Dots and Meta's Muse are vying to be your AI agent of choice. I've tried both—and I suspect you will too.

推荐理由作为专属的个人智能助手,这类工具可以充当全天候的私人数字管家,不仅能深度理解你的个性化习惯与指令,帮你梳理杂乱信息、安排日程计划,还能自动接管生活与工作中的繁杂琐事,提供贴合你个人需求的陪伴与高效协同。
个人助理Wired AI
#26

华为 Mate 90 系列发布:最强 Mate来了,5999 起即日开售

集齐龙珠的过程,不可谓不漫长。 在刚刚结束的华为 Mate 90 系列发布会上,我们终于见到了 2026 年高端机市场的最后一块拼图。 本次发布会上,华为一口气发布了 Mate 90、Mate 90 Pro、Mate 90 Pro Max、Mate 90 RS 非凡大师四款旗舰手机,以及若干耳机和手表等一系列新品。 并且截至今日, 鸿蒙 6 与鸿蒙 7 终端设备数量已经突破了 9000 万, 突破一亿大关指日可待。在今年一系列新形态设备的促进下,市场对于鸿蒙生态的认可度也在与日俱增: 不过由于 Mate 90 系列新机在发布会前已经在华为门店展出,发布会

推荐理由华为Mate 90系列旗舰手机能用来深度体验鸿蒙6与鸿蒙7的多端互联生态,与发布会同步亮相的耳机、手表等新品协同联动,全面满足高端机日常通讯、智慧办公与前沿数字生活的多样化使用需求。
开发与开源爱范儿