最新文章
计算机科学、工程与技术
让偶然的成功成为稳定的能力
8分钟阅读沿着一条配置修复轨迹,讲清好路径如何出现、成功如何评价、示范与奖励如何改变选择,以及评测和产品怎样把学习接成循环。
模型还做不到的事,先放进 Harness
7分钟阅读从知识库、记忆、工作流和工具的长处与缺口出发,理解技能怎样组织知识、经验、流程与可执行动作,以及它们与人类记忆的有趣对应。
Harness 的确定性,从哪里来?
9分钟阅读从长任务、资源依赖、自由组合和外部输入,推导 Harness 的调度、隔离、授权、防注入、恢复与验收,理解确定性应该落实在哪里。
模型会的越来越多,Harness 还剩什么?
7分钟阅读把运行设施与能力支持的职责列清,理解权限、状态、工具、知识与流程怎样分工,以及这些边界为什么随着训练持续移动。
语言模型开始拥有文字世界的物理
8分钟阅读文字世界有了行动的后果,上下文工程便要把真实任务的目标、对象、状态、行动和反馈表达出来,让模型拥有可理解、可操作的工作环境。
提示词为什么能调出模型的能力?
8分钟阅读从预训练与条件计算解释角色、示例、思维链和自检,再讨论推理模型与智能体时代,提示词应该保留什么、怎样检验效果。
难道这次真有银弹?
8分钟阅读重访软件工程关于复杂性、人、组织与变化的几条重要判断,看看编程智能体改变了哪些前提,又让哪些问题更加突出。
点云压成平面后,少看一个方向反而更清楚
6分钟阅读沿着 PlaneSegNet 的垂直投影、边界评价和场景实验,理解表示方式怎样保留植物分割真正需要的几何关系。
从计算机与人脑,到更像人的人工智能
6分钟阅读从冯·诺依曼的计算比较走向今天的人工智能:当我们能模拟计算,感觉、记忆、行动和情绪怎样共同形成一个更像人的系统?