跳到正文

教程实践

拿来就能用的实操内容:提示词技巧、工作流搭建、工具用法与踩坑经验。

最新精选

第 21–31 条 · 共 31 条
8月27日周四
  1. Microsoft Semantic Kernel60

    Agent Harness:让你的 claw 进入生产就绪

    Microsoft Agent Framework 教程第 4 部分,将个人财务助手拆分为共享 agent factory 加 console、hosted service、evals runner 三种宿主,并接入 OpenTelemetry 可观测性、Microsoft Purview 治理、Foundry 托管部署以及本地与托管评测。

    推荐理由:通过共享 agent factory 配合三种宿主,把个人财务助手从本地玩具推进到可观测、可治理、可部署、可评测的生产级架构。

8月26日周三
8月25日周二
  1. Hugging Face Blog67

    Granite 4.2 推理模型构建方法解析

    IBM Granite 4.2 推理模型家族(3B/8B/30B)采用分阶段强化学习流水线构建,支持思考/非思考切换与低思考预算模式。8B 与 30B 经过智能体 RL 训练,可在真实沙盒环境中进行代码编辑、终端操作与网页搜索,训练基于 NeMo-RL 与 NeMo-Gym,最终以 Apache 2.0 许可证开源。

    推荐理由:详细展示了从可验证奖励到智能体环境交互的分阶段强化学习流水线,为构建具备工具调用能力的推理模型提供了可复现的训练框架。

  2. GitHub Engineering64

    GitHub Accessibility Scanner 推出 Alt Text 插件:自动化检查通过不代表质量合格

    GitHub 工程团队发布了一款 Alt Text 插件,帮助开发者改进网页图片的替代文本质量。插件默认运行 5 条确定性规则(缺失、文件名、占位符、泛泛用词、相邻重复),并可选调用模型判断上下文相关性;模型仅输出建议而非结论,且默认关闭。文中还说明了布局重复检测、隐私与成本控制、已知限制及开源评测工具。

    推荐理由:文章展示了自动化检查与模型判断的边界划分,读者可借鉴其确定性规则优先、模型仅作建议的设计模式。

8月18日周二
  1. Hugging Face Blog62

    Dharma AI:GPU管理实践——相同集群提升33个百分点利用率

    Dharma AI发布约束感知GPU分配器,在七种基准场景中对比FIFO调度器,相同硬件与负载下GPU利用率提升最多33个百分点,优先级加权输出最多提升105%。该方法将实时推理视为需求曲线而非固定预留,按优先级跨整个调度 horizon 放置批量任务,并通过22维特征预测训练负载与周需求画像来支撑调度决策。

    推荐理由:同一集群通过调整分配顺序而非更换硬件,实现了最高33个百分点的利用率提升,为企业GPU调度提供了可复用的约束感知方法。

8月14日周五
  1. Hugging Face Blog74

    Strands Robots、LeRobot 与 Hugging Face Storage Buckets 打通录制、训练与部署循环

    Strands Robots 演示了用 Storage Bucket 记录 LeRobot 格式数据、通过字节级去重同步、从 Hub 流式读取训练、再以 mode='real' 部署到物理机器人的完整循环。示例使用 SO-100 机械臂和 mock policy,配套 notebook 在模拟环境即可运行。

    推荐理由:原文给出一条从录制到训练再到部署的完整数据循环,读者可据此判断它会怎样改变现有机器人工作流。

7月30日周四
7月4日周六
  1. Lilian Weng77

    Harness Engineering for Self-Improvement

    Lilian Weng 梳理了 harness 工程如何支撑递归自改进(RSI),将 harness 定义为围绕基础模型的运行时系统,负责编排执行、工具调用、上下文管理、状态持久化与结果评估。

    推荐理由:原文系统梳理了 harness 工程的设计模式与优化路径,读者可借此理解自改进循环中非模型层的角色与边界。

5月29日周五
  1. Together AI78

    Together AI 构建最快语音转文本栈的方法

    Together AI 详细介绍了其生产级 ASR 栈的优化,覆盖 TensorRT 多 profile 编码器、无 CPU 同步的条件 CUDA 图解码器、共享内存与 Unix 域套接字零拷贝路径、epoll 事件驱动流式 I/O,以及 gc.freeze() 消除 p95 延迟尖峰。

    推荐理由:原文给出多层次系统优化路径,读者可据此评估自身 ASR 延迟瓶颈是否落在数据路径而非模型本身。

5月21日周四
  1. Weaviate Blog60

    用 Weaviate MCP 构建代码助手:基于代码与文档的 RAG 教程

    Weaviate Blog 发布教程,展示如何利用内置 MCP 服务器搭建代码助手:将代码按语法边界分块注入 CodeChunks,按标题分块注入 DocChunks,通过混合搜索(BM25+向量)让 Claude Code、Cursor、VS Code 调用 weaviate-query-hybrid 获取真实代码引用,而非依赖模型训练数据。

    推荐理由:原文给出了一套从零搭建代码助手的方法和脚本,读者可按步骤实操并迁移到自己的代码库。

5月1日周四
  1. Lilian Weng76

    为什么我们需要思考:测试时计算与思维链综述

    Lilian Weng 综述了测试时计算与思维链(CoT)的最新进展,涵盖动机、心理类比、并行采样与顺序修正、RL 训练、忠实性分析与连续空间思考等主题,并讨论了奖励黑客与可扩展性边界。

    推荐理由:原文系统梳理了测试时计算与思维链的技术全景,读者可借此理解不同推理增强方法的原理、适用边界与已知风险。