EOGEE-岳极技术
  • 首页
  • 教程
    • 开发与运行环境
    • Agent基础概念详解
    • 模型部署与调用
    • RAG检索增强生成
    • 主流Agent安装与使用
    • VibeCoding从练气到结婴
    • 4天快速构建内容管理系统
  • 资讯
    • 行业资讯头条
    • AI基础能力提升
  • 开源
    • a4phone
    • a4api
  • 专栏
  • 工坊
  • 资源
    • 教程示例代码
    • 模型文件
    • skills技能
    • 直播回放
  • 关于
热门搜索
DeepSeek Harness 安装 deepseek 多模态
最近搜索
登录
热门搜索
DeepSeek Harness 安装 deepseek 多模态
最近搜索

rekey文章专栏

rekey 的极会员文章专栏,收录其发布的全部专栏文章

Qwen3.8-27B 本地高速部署方案(Mac Studio M4 Max / oMLX)

目标:在 Apple Silicon 上以最快速度推理 Qwen3.8-27B,支持长上下文与 Agent 工具调用,全部离线运行、不依赖外网 API。更新日期:2026-09-06 | oMLX 0.6.4

2026-09-12 50 次阅读

摘要只配当导读:让 AI 长对话不失忆的分层压缩架构(附业界对比)

长对话 AI 的"失忆"不是玄学,而是压缩机制的结构性缺陷。本文从根因出发,逐层拆解一套以"分层段块 + 双逐字轨"为核心的压缩架构,并与 Claude Code 等业界方案正面对比。

2026-09-13 20 次阅读

贵的不是上下文长,是前缀形状变了几次:MFS 的 KV-cache 命中优化与注入分层

大上下文"太贵"的原因不是上下文长,而是前缀形状变了几次。 前缀缓存让旧字节按 0.1 折续费,但任何一次前缀改动 = 改写点之后全部内容全额重付。MFS 的答案是:注入分层(每个注入源都有唯一合法落点)+ 显式计价(每次改动都过回本闸)+ 全路径同构(ws 与 RE

2026-09-13 14 次阅读
1

© EOGEE-岳极技术-AI知识技术共享平台. All rights reserved.

冀ICP备2024095105号

联系我们

  • 邮箱:eogee@qq.com
  • QQ: 3886370035
  • 微信:eogee2022

友情链接

  • 卷不卷
  • 老孟讲编程
  • 亦幸小阁