JULUO · SINCE 2026
技术交流
「技术交流」下的文章,按收录时间倒序排列;共 83 篇,第 4 / 5 页。
共 83 篇文章
2026-08
- OpenCode 跨会话记忆与上下文裁剪方案 这篇实践把 OpenCode 的长期开发记忆拆成三个层次: claude-mem 保存跨会话的细粒度操作历史, magic-context 管理当前会话的上下文裁剪与近期记忆,StrictDoc 则把项目决策、进度和长期文档…
- Google DeepMind:双盲 AI 评测试点 Google DeepMind 于 2026 年 8 月 27 日公布一项面向闭源前沿模型的双盲评测试点。目标是同时保护两类通常互相冲突的机密资产:评测方不公开测试提示,模型提供方不交出模型权重,并通过可信执行环境和密码学证…
- dockerd CPU 打满:定位未退出的 docker logs 进程 一台 4 核 8 GB 的 VPS 出现 CPU 周期性冲到 99% 的现象:每隔一两秒短暂回落到七八成,随后再次升高。原作者当时运行的是 sub2api v0.1.177。最终定位到多组没有正常退出的 docker log…
- Anthropic:Model Hardware Standard 研究预览 Anthropic 于 2026 年 8 月 27 日开启 Model Hardware Standard(MHS)的首阶段研究预览。MHS 试图为 AI Agent 操作显微镜、移液工作站、机械臂和量子计算设备等可编程硬件…
- Sebastian Raschka:GLM-5.3-Flash 的混合注意力架构 Sebastian Raschka 这条帖子从架构角度拆解了刚公开身份的 GLM-5.3-Flash:此前以 Ox Alpha 名义出现的模型,采用稀疏 MoE、线性注意力与稀疏注意力混合的设计,并加入多流 mHC 残差路径…
- Google DeepMind:Gemini 3.5 Transcribe 语音转写模型 Google DeepMind 于 2026 年 8 月 26 日发布 Gemini 3.5 Transcribe,定位为面向实时流和预录音频的语音转文字模型。下面先保留完整英文线程,并逐段给出中文翻译。 原帖英文与翻译 G…
- Anthropic:让外部研究者分析真实 Claude 使用数据 Anthropic 于 2026 年 8 月 26 日介绍了一项外部研究试点:三组研究者自行提出问题和设计研究,由 Anthropic 在服务器内通过隐私保护工具 Anthropic Insights 分析真实 Claude…
- OpenAI:Jalapeño 推理芯片的首批性能结果 OpenAI 于 2026 年 8 月 25 日公布自研推理芯片 Jalapeño 的首批测试结果。原帖的核心主张不是单纯追求峰值吞吐,而是在相近用户体验下,同时改善单位功耗吞吐和端到端延迟,面向需要连续执行许多步骤的交互式…
- 科普向|一文了解世界模型(World Model):通往 AGI 的可行路径? 世界模型关注的核心问题,是在给定当前状态和一个动作后,预测环境接下来会发生什么,并把预测结果用于规划与决策。原帖采用狭义定义:语言模型主要预测下一个词,而世界模型学习环境的动态规律,预测动作发生后的下一个场景状态。广义语境里…
- CachyOS 安装及调优指南 CachyOS 是基于 Arch Linux 的滚动发行版,目标是在保留 Arch 软件生态的同时,提供偏性能取向的内核、调度器与默认配置。原作者使用约一个月后,整理了从安装、Btrfs 快照到 Niri/Wayland 输…
- 佬们到底怎么让 ai 维护 vps、部署与迁移项目? 当 VPS 和小项目越来越多,真正困难的并不是让 AI 执行一次 SSH 命令,而是让部署、更新、迁移和回退都可追踪、可重复。原帖从“直接给 Agent 服务器权限为何越来越难用”出发,社区讨论逐渐收敛出一条更稳妥的工程路径…
- Clash Verge:复杂链式代理的实现 这篇实践解决的是链式代理的两个单点故障:入口节点不可用时整条链路中断,固定出口不可用时同样无法访问。作者把入口和出口分别抽象为策略组,再利用 Mihomo 的 dialer-proxy 把两层串起来,形成“入口自动择优、出口…
- Google DeepMind:SL2T 将手语直接翻译为流式文本 Google DeepMind 发布的 SL2T(sign-language-to-text)试图解决一个长期缺口:让聋人和听障用户像使用语音听写一样,直接对手机打手语,并把结果实时转换为文本。它已经进入 Pixel 11 …
- 记一次手动为Pixel 8a将LineageOS更新到高版本 这是一份 Pixel 8a 从 LineageOS 22 手动升级到 23 的实操记录,目标是在升级系统的同时补装 Gapps,并在系统启动后使用 APatch 获取 Root。文章的价值不在于替代官方文档,而在于补充真实操…
- A100/A800 部署 DeepSeek V4 Flash 0731 实战 这篇实测解决的是一个很具体的问题:DeepSeek V4 Flash 0731 如何在 A100/A800 这类 Ampere(sm_80)GPU 上运行,并在不开重量化或 GGUF 转换的前提下获得可用的生成速度。原帖不仅…
- MIUI + OpenClash 拉起 VOXI Wi‑Fi Calling 排障实录 这篇排障记录针对一个难定位的问题:MIUI 手机通过软路由连接 VOXI Wi‑Fi Calling 时,ePDG 的 UDP 500 只有上行、没有下行,反复改 APN、换卡槽或刷机仍无法激活。作者最终把关键变量收敛到代理…
- DGX Spark 单机部署 Qwen3.8-27B:NVFP4 + DSpark 实战 这篇实践解决的是一个很具体的问题:Qwen3.8-27B 在 DGX Spark 上直接用 vLLM 推理时,解码速度只有个位数,怎样通过 SGLang、NVFP4 与 DSpark 投机解码把它调到可用水平。最终方案给出了…
- 强模型还需要工作流吗?从 Comet 看 AI 工程化开发 强模型能更快地写出代码,但复杂任务真正难的是:怎样定义完成、怎样在中断后恢复、怎样把实现交给下一位执行者,以及怎样避免模型在自我判断中提前宣布成功。Comet 的思路是把这些约束放到模型之外,用可检查的项目状态和运行时门禁管…
- CloudBase 云函数/云托管调用混元 HY3 实践 这篇实践解决的是:参加小程序成长计划后,怎样把混元 HY3 文本与生图能力接入腾讯云 CloudBase,并按 OpenAI 兼容接口调用。原帖同时给出云函数和云托管两条路径,适合想快速验证能力、又需要理解成本与接口差异的开…
- DEEIX 部署教程:Render + Aiven + Upstash 这套方案解决的是:没有自建服务器时,如何把 DEEIX Chat 的应用、PostgreSQL 和 Redis 分别托管到 Render、Aiven 与 Upstash,并完成一套可登录验证的公开部署。最终形态是 Rende…