公众号

今日必看

今天公众号:Codex这个省额度的开关(模型发布),TapNow这套全能创作系统(改变我的了创作流程~~)。并行还有 2分钟到20秒!AI Agent让工单处、小米版 Codex,干活有点猛啊、把经典编剧剧作喂给 AI!这个开源项目让 AI。只收你批准过的博主;推荐理由写能拿来干什么。

日期
2026/09/12
今日条目
62
#01

Codex这个省额度的开关,先别急着开\n\n最近你可能刷到过一个省额度技巧,改一下Codex的配置,就能大幅降低GPT-6的消耗。\n\n天天盯着剩余额度的人,看到这个很难不心动。但先别急,已经有推荐过它的使用者,继续测试后又回来劝大家关掉了。\n\n有人反馈,用量是降了,可聊得越久,越容易忘事。前面交代的要求、已经讨论好的方案,跑着跑着就接不上了,还得重

推荐理由GPT-6 值得对照原文看具体能力与约束。评估要不要嵌进现有工作流时,可看能力和接口细节。
产品接入金先森是朝鲜族阿
#06

DeepSeek-V4.1-Flash 开源:552B MoE,非对称模型结构,大幅减少KV Cache 缓存大小

DeepSeek 开源 DeepSeek-V4.1-Flash:552B MoE 多模态模型,采用非对称架构大幅降低 KV Cache 至前代 1/4,支持百万级上下文与原生图文输入。

推荐理由DeepSeek 开源 DeepSeek-V4.1-Flash:552B MoE 多模态模型,采用非对称架构大幅降低 KV Cache 至前代 1/4,支持百万级上下文与原生图文输入。对照自己的管线,看有没有能直接拿走的做法或约束。
模型与评测魔搭ModelScope社区
#08

Grok Bot产品负责人:只用几个人,如何在30天内做出Grok Bot?丨Lenny

从几个人的内部原型,到亲自带两三百名用户上手:Roman Ugarte分享Grok Bot的产品取舍,以及为什么任务最后的10%决定用户敢不敢放手。

推荐理由从几个人的内部原型,到亲自带两三百名用户上手:Roman Ugarte分享Grok Bot的产品取舍,以及为什么任务最后的10%决定用户敢不敢放手。对照自己的管线,看有没有能直接拿走的做法或约束。
个人助理晚点再听LaterCast
#11

Agent 安全也能自进化?SafeEvolve 让 Harness 与 Policy 从安全经验中共同进化

SafeEvolve探索了一种新的Agent安全范式:安全机制不再只是部署前配置的一组静态规则,模型也不再只是一次性完成安全训练。Harness与Policy可以从真实执行经验中共同学习,并持续改进Agent在复杂环境中的安全行为。

推荐理由SafeEvolve探索了一种新的Agent安全范式:安全机制不再只是部署前配置的一组静态规则,模型也不再只是一次性完成安全训练。搭助手或自动化原型时,值得对照交互和工具边界。
Agent与工具青稞AI
#13

告别 VMware 后的终极拼图:开源 vCenter 替代方案 ProxCenter 深度剖析

面对 VMware 迁移潮与多集群 PVE 缺乏统一控制面、全局 DRS 调度的痛点,开源项目 ProxCenter 提供了 Agentless 的集中管理方案。本文深度解析其跨平台增量热迁移、Go 编排器自动化调度与三节点高可用架构实践。

推荐理由面对 VMware 迁移潮与多集群 PVE 缺乏统一控制面、全局 DRS 调度的痛点,开源项目 ProxCenter 提供了 Agentless 的集中管理方案。搭助手或自动化原型时,值得对照交互和工具边界。
Agent与工具知识发电机
#14

AI 做的页面不够高级,问题到底出在哪?先做个眯眼测试

被 AI 页面丑到抓狂,第一反应是换配色。但你眯起眼看一眼就知道:真正的问题是眼睛没地方停。这篇讲清楚层级怎么会丢、五条能上手的像素法则,还有一道你自己就能判的题。

推荐理由被 AI 页面丑到抓狂,第一反应是换配色。对照自己的管线,看有没有能直接拿走的做法或约束。
模型与评测极客精益
#19

6 个轻量级 CLI 工具:让开发工作告别臃肿软件

本文介绍 jq、fzf、tmux、entr、bat、ripgrep 等轻量级 CLI 工具,如何替代臃肿 GUI 软件,提升开发效率与专注力。

推荐理由本文介绍 jq、fzf、tmux、entr、bat、ripgrep 等轻量级 CLI 工具,如何替代臃肿 GUI 软件,提升开发效率与专注力。对照自己的管线,看有没有能直接拿走的做法或约束。
模型与评测AI大模型观察站
#21

近2w颗star!浏览器里直接跑大模型的高性能推理引擎

WebLLM 是浏览器内高性能 LLM 推理引擎,用 WebGPU 本地加速,无需服务器,兼容 OpenAI API,支持流式输出、JSON 模式与多种开源模型,可经 npm/CDN 接入,亦可自定义模型。

推荐理由WebLLM 是浏览器内高性能 LLM 推理引擎,用 WebGPU 本地加速,无需服务器,兼容 OpenAI API,支持流式输出、JSON 模式与多种开源模型,可经 npm/CDN 接入。评估要不要嵌进现有工作流时,可看能力和接口细节。
模型与评测GitHubStore