公众号

今日必看

今天公众号:Codex这个省额度的开关(模型发布),TapNow这套全能创作系统(改变我的了创作流程~~)。并行还有 2分钟到20秒!AI Agent让工单处、小米版 Codex,干活有点猛啊、把经典编剧剧作喂给 AI!这个开源项目让 AI。只收你批准过的博主;推荐理由写能拿来干什么。

日期
2026/09/12
今日条目
62
#52

AQR白皮书:学术 Alpha 如何变成真实 Alpha

学术 Alpha 只能证明某类收益具有可研究的历史证据和经济来源,无法直接证明一项产品具备可交易、可扩展的成本后收益。实际 Alpha 形成于后续实施:管理人需要从因子动物园中筛除过拟合与重复信号,修正数据时点,控制意外风险暴露,并在借券、滑点和市场冲击

推荐理由学术 Alpha 只能证明某类收益具有可研究的历史证据和经济来源,无法直接证明一项产品具备可交易、可扩展的成本后收益。对照自己的管线,看有没有能直接拿走的做法或约束。
模型与评测行业观察QuantML
#55

自动承接约 14 分钟,人工样本约 2 小时 35 分钟:一次 FDE 式业务交付复盘

企业真正缺的,往往不是又一个 AI 工具,而是有人进入现场,把业务真正跑顺。这次我会用一个历时四周、经历五个版本、覆盖 397 条真实客户旅程的案例,复盘 FDE 如何识别真问题、持续校准方案,并把“功能完成”交付成可运行、可恢复、可验证的业务结果。

推荐理由企业真正缺的,往往不是又一个 AI 工具,而是有人进入现场,把业务真正跑顺。对照自己的管线,看有没有能直接拿走的做法或约束。
模型与评测大铭本铭
#58

基于阿里云 AgentLoop 的 DeepSeek Harness 评测实践

本文依托阿里云 AgentLoop 平台,以 terminal-bench 2.1 子集任务为载体,评测开源 Agent 框架 DeepSeek Harness,构建完成度、红线、过程三维确定性评估器,实现可复现、可归因的细粒度评测。

推荐理由本文依托阿里云 AgentLoop 平台,以 terminal-bench 2.1 子集任务为载体,评测开源 Agent 框架 DeepSeek Harness,构建完成度、红线。搭助手或自动化原型时,值得对照交互和工具边界。
Agent与工具阿里云云原生
#60

AI Agent 的上下文腐烂,该怎么破?

本文聚焦 AI Agents 上下文工程技术,揭秘了从静态提示词工程到动态上下文工程的进化逻辑,还拆解了 Manus 应对上下文腐烂的核心技术与简化至上的实践原则。

推荐理由本文聚焦 AI Agents 上下文工程技术,揭秘了从静态提示词工程到动态上下文工程的进化逻辑,还拆解了 Manus 应对上下文腐烂的核心技术与简化至上的实践原则。搭助手或自动化原型时,值得对照交互和工具边界。
Agent与工具CraftWarmAI
#62

当Agent成为世界的主体,市场、公司、组织这些协调机制会变成什么,以及人的位置

一篇关于机制的长文。当世界的行为主体从人扩展到 Agent,市场、公司、组织这些协调机制会变成什么;以及十年后,在一个以 Agent 为主要行为主体的世界里,人,究竟站在哪个位置。全文十三节,约一万六千字。

推荐理由当Agent成为世界的主体,市场、公司、组织这些协调机制会变成什么,以及人的位置 值得对照原文看具体能力与约束。搭助手或自动化原型时,值得对照交互和工具边界。
模型与评测Nature布路灵