X 热议

AI 早报

分类页是滚动库存,每页 24 条。首页只放当天精选。

总收录
486
当前类目
143
当前批次
2026/09/03

模型

#73

Fable 5.1が出て話題になったと思ったら、Gemini 3.8 Flashに話題を持って行かれて、明日にはGPT-6 Astraが全部持っていくだろうって感じ?

Fable 5.1が出て話題になったと思ったら、Gemini 3.8 Flashに話題を持って行かれて、明日にはGPT-6 Astraが全部持っていくだろうって感じ? 忙しい1週間だなあ…

推荐理由@Pai200777 关注的 @AILogDev 今日发帖。
模型与工程关注 @AILogDev
#75

实测可减少 Claude Fable 5.1 "claudese" 文风的提示词

Elvis Saravia 分享一条经他实测有效的提示词,用于减少 Claude Fable 5.1 的 "claudese" 文风。提示词来自 Claude 官方文档的 writing density 部分,通过定义 mannered prose 反模式来让文风更直接,官方也给出了简短版本 "Please remove all mannered prose.",建议加入用户消息或系统提示词。原文链接:https://platform…

推荐理由AIHOT 公共池原文。
模型与工程X:Elvis Saravia (@omarsar0, DAIR.AI)
#78

阿里云架构师谈 Qwen3.8-Max 为团队带来的变化

阿里云解决方案架构师 Joey Huang 在视频中介绍 Qwen3.8-Max 为其团队带来的变化:团队不再人工分派工单,早晨醒来可看到自动生成的摘要,说明哪些已上线、哪些在评审、哪些需要本人处理。他表示因此能把时间重新投入产品、客户和架构,并附上了 Qwen Cloud 与 Model Studio 的试用及 API 入口链接。

推荐理由AIHOT 公共池原文。
模型与工程X:阿里云 / Alibaba Cloud (@alibaba_cloud)
#79

巨大惊喜! gpt-6-astra 疑似已悄悄部署到 OpenAI API 服务器!本周或正式上线!

巨大惊喜! gpt-6-astra 疑似已悄悄部署到 OpenAI API 服务器!本周或正式上线! 网友实测验证:请求 gpt-5.7-astra 等不存在的模型返回 400(真没有);而 gpt-6-astra 返回 404——按以往经验,这说明已部署、只是还没发布。

推荐理由@Pai200777 关注的 @LinearUncle 今日发帖。
模型与工程关注 @LinearUncle
#82

阿里云解决方案架构师谈 Qwen3.8-Max 为团队带来的改变

阿里云发布对内部解决方案架构师 Joey Huang 的访谈视频,他介绍团队使用 Qwen3.8-Max 后不再逐一分派工单,可留下积压任务,次日早上自动收到已完成、待评审和需人工查看内容的汇总。他表示因此能把时间投入产品、客户和架构。文中附有 Qwen Cloud 和 Model Studio 的试用及 API 入口链接。

推荐理由AIHOT 公共池原文。
模型与工程X:阿里云 / Alibaba Cloud (@alibaba_cloud)
#85

学大模型最怕的不是难,而是看懂了却不会写。

学大模型最怕的不是难,而是看懂了却不会写。 如果你也经常卡在“第一行代码怎么写”,可以看看这本《Hands-On Large Language Models》。 全书 12 章,从 Token、Embedding、Transformer,一路讲到 Prompt、语义搜索、RAG、多模态和模型微调。每章都有配套代码,可以直接用 Colab 跑起来。 少一点纯理论,多一点直接上手。 想系统入门 LLM 开发的,可以收藏这份资料。 🔗

推荐理由@Pai200777 关注的 @bkdgiffug 今日发帖。
模型与工程关注 @bkdgiffug
#86

今天是值得庆祝的一天!

今天是值得庆祝的一天! Claude 手机1:1终端的适配终于丝滑了… 其实早就实现了,纯白板模式5G蜂窝网络,上下文历史翻阅时候,每一次都是走5G网络,相当于手机操作,同步电脑,电脑的终端进行重画,再来回,导致有点卡顿的感觉…是我自己觉得这个问题必须解决,不然我很不爽,结果好家伙…就这么一个问题远比我想象的难度大! 原本想做一个独立通用的真彩渲染适配所有模型‘图3’后来我发现不对,如果只是实现目的的确可以但那只是玩具/工具,但什么

推荐理由@Pai200777 关注的 @MrAKHuang 今日发帖。
模型与工程关注 @MrAKHuang
#89

SemiAnalysis 批评 Nemotron3 Ultra 表现不佳,称中国模型更优

SemiAnalysis 发文称 NVIDIA Research 产出过 LatentMoE(用于 Kimi K3)和 GatedDeltaNets(用于 Qwen)等优秀研究,但在端到端前沿训练上,NVIDIA 的官僚文化导致 Nemotron3 Ultra 表现尴尬。Nemotron3 Ultra 总参数 550B(55B 激活),被包括 Qwen3.8 27B(参数量约少 20 倍)在内的中国模型全面超越。

推荐理由AIHOT 公共池原文。
模型与工程X:SemiAnalysis (@SemiAnalysis_)
#90

Gemini 3.8 Flash发布了,竟然还有部分评分超过了Opus 5,等我实际试试代码能力如何。Gemini用来日常写作、总结内容还是相当不错的,有人味儿、很少AI味儿。

Gemini 3.8 Flash发布了,竟然还有部分评分超过了Opus 5,等我实际试试代码能力如何。Gemini用来日常写作、总结内容还是相当不错的,有人味儿、很少AI味儿。

推荐理由@Pai200777 关注的 @Gorden_Sun 今日发帖。
模型与工程关注 @Gorden_Sun
#96

Ethan Mollick 引述法律备忘录案例,指出廉价低推理模型在法律基准上表现不佳

Ethan Mollick 引述 Prinz 对 AI 系统的法律基准测试结果,称最新模型表现很好,但更便宜、低推理能力的模型表现不佳,并追问如何让厂商有动力提供好的模型。其引用的律师案例显示,一份由法律部门大量借助 AI 完成的备忘录格式精美,却在监管审批判断上得出完全错误的结论,还遗漏了两条导致交易被法律禁止的原因。

推荐理由AIHOT 公共池原文。
模型与工程X:Ethan Mollick (@emollick)