复杂的Harness Evolution,甚至不如多跑几遍
复杂的Harness Evolution,甚至不如多跑几遍一个 Agent 第一次没把任务做对。
来自主题: AI技术研报
6472 点击 2026-09-16 14:40
搜索
一个 Agent 第一次没把任务做对。
OpenAI 可能正在酝酿一次大规模产品更新。
中国科技又拿下“全球第一”,这次突破难在哪?
零样本学习的目标,是让模型识别训练时从未出现过的类别。
作者三文盐体验良配等AI Dating产品后指出,AI Dating已演变为衡水中学式做题相亲,AI军师与提效机制无法解决情感茫然与真实人际连接的本质。
忍!不!了!了! 你老A社天天一会儿AI要失控、一会儿互联网要完蛋,转头自己IPO、融资、扩算力,一个都没耽误??
北航、南方科技大学、复旦大学、北京理工大学、爱丁堡大学等 8 家机构的 19 位研究者联合完成 Theory of Agent 综述,讨论模型内部与外部 harness 应如何分配能力,并据此梳理 LLM Agent 的学习、对齐、演化与评测。
把 On-Policy Distillation(在线策略蒸馏,OPD)的训练集从 17000 道题删到 1 道,会发生什么?
成立才一个多月,估值就要冲到 500 亿美元。
小宇宙想要「强而久」。