无尘阁日记

小米把 RL 训练开成了直播:看懂 mimo.xiaomi.com/rl 这个页面

一句话说清 这是小米 MiMo 团队给 MiMo-V2.6 的强化学习(RL)训练开的一个「实时直播看板」。它不是模型发布页,也不是宣传页,而是把正在跑的训练任务的真实运行日志挂在公网上——花了多少钱、跑了多少 token、哪台机器挂了、某个数据集这轮通过了多少条,任何人都能随时刷新看。 页面的官方描述只有一句:Training metrics of t...

32B 多模态模型做内部数据脱敏,够用吗?

最近在做一件很具体的事:给内部的一批文件、数据表和音视频做脱敏,然后喂给大模型用。选型时最常被问到的一句话是——「我们本地部署一个 32B 的多模态模型,够不够?」 这个问题的答案不是「够」或「不够」,而是你让它承担哪一层责任。下面是我按这个口径做的完整评估,结论先给:32B 多模态模型是这类工作里性价比最高的「语义裁决层」,但它不是一个脱敏系统。把它...

向量知识库,能把应收账款的一百种说法都认出来吗?

从"把意思变成坐标",到"表格为什么是噩梦"——一次讲透语义检索的能与不能。 在会计、金融、法律这类行业里,有件特别折磨人的事:同一个意思,有一百种说法。 "应收账款"、"应收款"、"应收"、"AR"、"trade receivable"、"客户欠我们的钱"——说的是同一件事。但你用关键词去搜,"客户欠我们的钱"这七个字,跟"应收账款"一个字都匹配不上。...

AI日报|2026年3月23日(周末特刊)

这几天AI圈发生了一堆大事,我用最简单的话给你捋一遍。看完你就知道这个行业现在到底在发生什么。 一、英伟达GTC大会:老黄说"OpenClaw就是下一个ChatGPT" 上周英伟达在硅谷开了一年一度的GTC大会,号称"AI界的超级碗"。...

智能体的潜规则:从FIPA到ReAct,AI世界的“沟通协议”与思考逻辑

你提到的「智能体的流程协议」,其实是一个跨领域的概念:它取决于你指的“智能体(Agent)”是在 哪一层语义上。不同层面的“智能体”确实都有对应的“协议”(Protocol),只是这些协议的形式和目的差别很大。我们可以把“智能体流程协议”分为三大类理解:计算机科学 / 多智能体系统(MAS)层面的通信协议AI Agent / LLM-based Agent(...

DeepSeek-Chat八字算命智能体构建方案

各需求支持情况需求1:八字算命功能 – 支持部分实现。DeepSeek-Chat模型本身并未内置专门的命理推演引擎,但具备理解和生成中文文本的强大能力,可以通过精心设计提示词(Prompt)来实现八字命理分析的逻辑。实际测试表明,在提供适当指导时,DeepSeek模型能够将用户的出生日期转换为生辰八字(干支排盘),并依据传统命理学知识给出较为详细的命理推演结...

再理解什么是智能体

聊天式AI在严格意义上仍未完整成为智能体,它更像是“行动的外观”,而非真正的“行动者”。与朋友谈话本身当然是一种行动,但聊天式AI的“行动”并未在真实世界中留下可以直接验证的结果,它只是生成了文字,对话在屏幕上闪烁,却未真正改变外部环境的任何状态。聊天本质上是一种交流行为,而非执行行为,它的行动范围停留在“生成内容”这一层面,未进入“在环境中施加可观察变化”...

智能体究竟是什么

智能体是一种能主动感知环境、理解上下文并根据目标持续采取行动的存在,它与提示词生成的差别在于持续性、目标导向、环境交互与行动能力。有时候,我们用一句话生成一首诗、一幅画、一份文案,这已足够满足日常所需,也能在瞬间给我们带来成就感与短暂的满足。然而在持续推动一件事时,比如研究一个复杂课题、管理多个任务流、自动完成对接不同系统的操作,或者只是在一个看似简单却琐碎...

有技术底子的:送给你一份搭建deepseek智能体的操作框架

01 定义定位与目标先确定智能体使用场景与交互模式。角色定位: 决定是通用问答、领域垂直、自动流程处理(RPA)还是多模态交互(含搜索、生成、行动)。核心目标: 是用作内容创作、知识问答、科研辅助、量化决策支持,还是客户支持等。用户群体: 内部辅助(私域)或对外公开。安全和合规目标: 是否需要符合隐私、涉密、合规审计。02 模型及架构选型评估 DeepSee...