Fable 5.1が出て話題になったと思ったら、Gemini 3.8 Flashに話題を持って行かれて、明日にはGPT-6 Astraが全部持っていくだろうって感じ?
Fable 5.1が出て話題になったと思ったら、Gemini 3.8 Flashに話題を持って行かれて、明日にはGPT-6 Astraが全部持っていくだろうって感じ? 忙しい1週間だなあ…
X 热议
分类页是滚动库存,每页 24 条。首页只放当天精选。
Fable 5.1が出て話題になったと思ったら、Gemini 3.8 Flashに話題を持って行かれて、明日にはGPT-6 Astraが全部持っていくだろうって感じ? 忙しい1週間だなあ…
Ethan Mollick 公开一段用于 Fable 5.1 的提示词,要求生成《伊利亚特》船目(Catalog of Ships)的可探索 3D 船只地图,结合真实图像与考古数据,并用智能体测试和修订,成品见 https://homer-catalogue-of-ships.netlify.app/。
Elvis Saravia 分享一条经他实测有效的提示词,用于减少 Claude Fable 5.1 的 "claudese" 文风。提示词来自 Claude 官方文档的 writing density 部分,通过定义 mannered prose 反模式来让文风更直接,官方也给出了简短版本 "Please remove all mannered prose.",建议加入用户消息或系统提示词。原文链接:https://platform…
Dex Horthy 公布 slopcode bench 全前沿模型评测进行中的逐项进度
哈哈哈,我们家算力舱只需要一台就可以跑 Qwen 3.8 Flash Next, 102 TPS的速度 ;)
阿里云解决方案架构师 Joey Huang 在视频中介绍 Qwen3.8-Max 为其团队带来的变化:团队不再人工分派工单,早晨醒来可看到自动生成的摘要,说明哪些已上线、哪些在评审、哪些需要本人处理。他表示因此能把时间重新投入产品、客户和架构,并附上了 Qwen Cloud 与 Model Studio 的试用及 API 入口链接。
巨大惊喜! gpt-6-astra 疑似已悄悄部署到 OpenAI API 服务器!本周或正式上线! 网友实测验证:请求 gpt-5.7-astra 等不存在的模型返回 400(真没有);而 gpt-6-astra 返回 404——按以往经验,这说明已部署、只是还没发布。
This week is absolutely nuts for AI releases, and now a major new model update from Muse. We appear to be reaching escape velocity in capability progress. If this thing gets released as open weights it completely change…
@LangChain has day 0 support for Gemini 3.8 flash!
阿里云发布对内部解决方案架构师 Joey Huang 的访谈视频,他介绍团队使用 Qwen3.8-Max 后不再逐一分派工单,可留下积压任务,次日早上自动收到已完成、待评审和需人工查看内容的汇总。他表示因此能把时间投入产品、客户和架构。文中附有 Qwen Cloud 和 Model Studio 的试用及 API 入口链接。
Google AI 发布 Gemini 3.8 Flash Cyber,专为安全团队等防御者构建,可大规模生成修复漏洞的补丁(patch generation),官方称是其迄今最强的防御模型之一,较 3.5 代大幅提升。
Google DeepMind 发布 Gemini 3.8 Flash Cyber,面向防守方提供专家级漏洞检测和自主修补能力。官方表示该模型可帮助团队领先应对新出现的威胁,并附推文串介绍具体用法。
学大模型最怕的不是难,而是看懂了却不会写。 如果你也经常卡在“第一行代码怎么写”,可以看看这本《Hands-On Large Language Models》。 全书 12 章,从 Token、Embedding、Transformer,一路讲到 Prompt、语义搜索、RAG、多模态和模型微调。每章都有配套代码,可以直接用 Colab 跑起来。 少一点纯理论,多一点直接上手。 想系统入门 LLM 开发的,可以收藏这份资料。 🔗
今天是值得庆祝的一天! Claude 手机1:1终端的适配终于丝滑了… 其实早就实现了,纯白板模式5G蜂窝网络,上下文历史翻阅时候,每一次都是走5G网络,相当于手机操作,同步电脑,电脑的终端进行重画,再来回,导致有点卡顿的感觉…是我自己觉得这个问题必须解决,不然我很不爽,结果好家伙…就这么一个问题远比我想象的难度大! 原本想做一个独立通用的真彩渲染适配所有模型‘图3’后来我发现不对,如果只是实现目的的确可以但那只是玩具/工具,但什么
François Chollet 转发各家模型输出速度对比图并点名 TPU
Google 发布 Gemini 3.8 Flash,称其专为复杂推理打造。官方用 3.8 Flash 与 Three.js 在 Google AI Studio 中构建交互式 3D 可视化器,可自动将硬件设备分解为多个图层,用户通过解构滑块即可拆开并逐层查看各组件。
SemiAnalysis 发文称 NVIDIA Research 产出过 LatentMoE(用于 Kimi K3)和 GatedDeltaNets(用于 Qwen)等优秀研究,但在端到端前沿训练上,NVIDIA 的官僚文化导致 Nemotron3 Ultra 表现尴尬。Nemotron3 Ultra 总参数 550B(55B 激活),被包括 Qwen3.8 27B(参数量约少 20 倍)在内的中国模型全面超越。
Gemini 3.8 Flash发布了,竟然还有部分评分超过了Opus 5,等我实际试试代码能力如何。Gemini用来日常写作、总结内容还是相当不错的,有人味儿、很少AI味儿。
TestingCatalog 称 GPT-6-Astra 模型 slug 已出现在 OpenAI API 上,推测若明天发布将是重要一周,并猜测可能先上线路由功能。
Gemini 3.8 Flash 这次真的来了,网页可以直接访问。
本期早报围绕能力、工作过程与最终成本展开,精讲三篇:Google 发布 Gemini 3.8 Flash 系列含通用 Flash 与 Flash Cyber,内部漏洞发现成功率超 70%。
3.8 Flash = great quality @ great price https://t.co/teErwoGZon
@thehypedotnews 用 Three.js 让 Fable 5.1、Fable 5 和 Opus 5 分别从单张参考图程序化重建 bag end、barad-dûr、rivendell 三个《魔戒》场景,全程经 OpenRouter 运行。
Ethan Mollick 引述 Prinz 对 AI 系统的法律基准测试结果,称最新模型表现很好,但更便宜、低推理能力的模型表现不佳,并追问如何让厂商有动力提供好的模型。其引用的律师案例显示,一份由法律部门大量借助 AI 完成的备忘录格式精美,却在监管审批判断上得出完全错误的结论,还遗漏了两条导致交易被法律禁止的原因。