不折腾模型
盒子自动选择合适的非 thinking 模型和运行策略,用户主要关注响应速度与回答质量,而不是当前到底加载了哪个模型。
Product concept / 2026
一台可以长期在线、完全离线可用、能被电脑和手机随时调用的个人 AI 算力盒子。用户不需要研究模型,只需要提出问题、选择能力,并得到稳定快速的结果。
参考上海交大 Tiiny Pocket AI 的双芯片思路,但把产品重点从“能运行大模型”推进到“普通人能持续使用的本地 AI 设备”。
盒子自动选择合适的非 thinking 模型和运行策略,用户主要关注响应速度与回答质量,而不是当前到底加载了哪个模型。
关掉光猫后,盒子仍可在局域网内工作;只有用户主动开启网络访问能力时,系统才通过受控通道访问外部信息。
受内存和 KV Cache 限制,第一版明确采用单个大上下文、单请求串行处理,优先保证稳定性与速度。
目标输出速度。1000 token 输出约 33 秒。
覆盖长文档、代码和 Codex 类工具的基本需求。
空载低电耗,可作为家庭长期运行的基础设施。
两种模式覆盖“随身使用”和“远程调用”:USB-C 是默认的低门槛直连方式,网络模式则通过设备密钥建立授权访问。
在电脑 HiApp 中浏览经过测试、汉化的 Agent,点击安装即可部署到盒子。
电脑直接打开 Agent 的 Web 页面;手机通过 App 或微信小程序发起请求。
需要外部信息时,Agent 使用 web_search;网络能力受盒子与 HiApp 的权限管控。
OpenClaw 等电脑工具通过标准 LLM API 直接使用盒子的模型服务。
“帮我看下上个月做的 XXX 项目,用到的钢材来自哪个公司,什么型号?”盒子检索已同步的数据并给出答案。
电脑只承担入口和展示,Agent 的服务端与数据运行在盒子内,形成可安装、可卸载、可重置的个人 AI 环境。