JULUO · SINCE 2026
技术交流
「技术交流」下的文章,按收录时间倒序排列;共 83 篇,第 1 / 5 页。
共 83 篇文章
2026-09
- Boris Cherny:用 Lean 与 TLA+ 对 Agent SDK 做形式化验证 英文原文 I used Opus 5.5 to formally verify the Claude Agent SDK using Lean. A couple short prompts = 16 PRs fixing …
- Google Play Console 应用提审流程详解 前情提要 能提前填写并完成的 Google Play Console 表单尽量全部完成。一个应用的这些表单通常只需填写一次,后续版本可以复用;应用信息发生变化时再更新。 作者此前一次提交审核时,忘记更新提供给审核人员的测试账…
- ai时代开发小技巧(2)—-TDD设计,红测与绿测 AI 让代码生成速度大幅提高,一个模块可能几十分钟就能完成,单元测试也很容易做到表面上的 100% 通过。但问题在于:这些测试有时根本没有验证真正的需求,只是在证明刚写出来的代码符合它自己生成的用例。 什么是 TDD TDD…
- Sebastian Raschka:MiMo-V2.6 的架构与后训练要点 英文原文 MiMo-V2.6 is “simply” the best (for now). Despite its simple architecture design it’s currently No.1 in the…
- Simon Willison:Jev 带来一种新形态的 LLM——System One(决策模型) 英文原文 Put together some notes on Jev and the new category of system one aka decision models 中文翻译 整理了一些关于 Jev,以及 S…
- 【AgentSeed】从零开始的Agent内核开发教程(一) —— 从“大模型”开始 这篇教程是 AgentSeed 系列的第一篇,目标是从最小可运行原型开始理解 Agent 内核。作者先把普通聊天应用拆成四步:客户端收集输入、发送请求、模型服务生成回答、客户端接收并展示结果。网页或桌面应用替用户封装了调用流…
- Sebastian Raschka:推理时扩展(一)——温度缩放、Top-p 与自一致性 英文原文 Inference scaling part 1. Starting with a modded text generation function (temperature scaling, top-p filte…
- 用了几天自部署的 ds v4.1f,说说实际使用中会遇到的问题 作者把官方权重的 ds v4.1f 部署在针对 Ampere 架构适配的 vLLM 版本上,并接入 Pi Agent,用于开发网络安全方向的科研原型。实际运行环境为 8 张 A800 80GB,另外约需 300GB 内存存放…
- John Carmack:相对 Bellman 回归就是 TD 误差中心化 英文原文 Very few will care about the actual reinforcement learning details here, but watching me grope around for u…
- Ethan Mollick:AI 在科研中的效率提升与验证瓶颈 英文原帖(节选)与中文翻译 Study from Google about AI use in science, complex impacts: acceleration (7 hours saved per week) …
- Nathan Lambert:用 Never Give Up 将 RL 计算分配给困难样本 英文原文节选与中文翻译 Can we allocate more compute to the harder problems? 我们能否把更多计算资源分配给更难的问题? If your GRPO group has all…
- Harrison Chase:Agent 记忆为何难以产品化 英文原文节选与中文翻译 memory has been a hot topic for the past ~2 years 记忆在过去大约两年里一直是热门话题。 the hardest part of memory is t…
- 小模型小测评:面壁 MiniCPM5-2B、讯飞 Spark-X2.5-4B、阿里 Qwen3.5-9B(民间蒸馏版) 这次实测比较三款可在 16 GB 显存环境运行的小模型,重点不是单轮问答分数,而是它们在 Windows 上执行搜索、文件写入、PDF 下载与解析等 Agent 任务时的稳定性。原帖发布于 2026 年 9 月 9 日,以下…
- Sebastian Raschka:只看最终结果会误导计算机使用基准 英文原帖节选与中文翻译 Some food for thought when designing benchmarks… So, here’s a little computer-use (visual) compariso…
- 我是如何学习大模型应用开发的 这篇文章面向大学阶段的技术学习者和大模型应用开发工程师,作者结合自己的学习与项目经历,梳理了 Agent 应用开发中的核心概念、学习顺序和实践重点。 三个核心概念 Agent Loop Agent Loop 是运行核心:用户…
- Simon Willison:用于重写 Git 提交信息的本地 Web 应用 英文原文与中文翻译 Built a little local web app to help edit commit messages for a repo. 构建了一个小型本地 Web 应用,用于编辑代码仓库的提交信息。 …
- Sebastian Raschka:从零构建推理模型(三)——验证器与 RLVR 英文原文(节选)与中文翻译 Reasoning from scratch round 3: This time, I cover generating a verifier for… 从零构建推理模型第三期:这次介绍如何生成…
- 耗费3亿token 让Astra总结我过往项目给出的codex子代理编排方案 原帖作者在高强度使用 GPT-6 Astra 后,让模型结合其多个项目的历史对话,整理出一套以 Astra 为主代理的 Codex 子代理编排方案。下面按原帖公开配置整理其结构、参数、工作流与使用边界。 全局调度规则 全局 …
- John Carmack:Jetson Thor 的内存与带宽权衡 英文原文(节选) If the target market is real time robotics, the Jetson Thor system … seems over-provisioned with expens…
- Simon Willison:用 OSM 数据生成 5K/10K 环形跑步路线 英文原文(节选) ChatGPT Work and GPT-6 Astra … can take an address and produce a 5K/10K circular running route … using …