AGI新战场谷歌亚马逊巨头激战,杀出个中国LimiX-2赢了又赢
AGI新战场谷歌亚马逊巨头激战,杀出个中国LimiX-2赢了又赢稳准智能团队发布的结构化数据基础模型LimiX-2凭借400M参数在TabArena、TALENT、BCCO等国际主流基准测试中拿下多项第一,断层领先谷歌TabFM、Amazon Mitra及SAP TabPFN-3.5等模型。
搜索
稳准智能团队发布的结构化数据基础模型LimiX-2凭借400M参数在TabArena、TALENT、BCCO等国际主流基准测试中拿下多项第一,断层领先谷歌TabFM、Amazon Mitra及SAP TabPFN-3.5等模型。
亚马逊AWS宣布Amazon Bedrock AgentCore Payments正式进入GA阶段。此前还只有一些简单付费场景的预览功能,现在已经可以让 AI Agent在用户授权和预算限制下,自主购买付费API、MCP服务、数字内容以及模型推理能力。
大家都会以为,AI 会重构电商,甚至会完成自身的闭环交易,取代传统电商。但事实看起来却不是这样,ChatGPT 上线的 checkout 功能并没有获得预期的成功,Shopify、Amazon 这些电商平台依旧活得很好。
说在前面:这又是一篇讲Harness的Survey,你最近可能已经看过了数篇讲Harness的文章、论文,其中还可能包括我上周解读的《Agent Harness Engineering:Agent的底盘工程综述|CMU、耶鲁、Amazon》。
经常切换使用CC、Codex、OpenClaw这类Agent的人会发现:同一个模型,放进不同系统里,表现可能完全不同。
在大模型后训练中,数据不再只是 “越多越好”,而是要像人类学习一样,动态选择最合适难度的样本。华为提出的 EDCO 方法,将样本难度估计与动态课程编排引入领域大模型微调;数月后,由 Rutgers、Amazon、Google 等作者参与的 DARE 论文即引用 EDCO,并将其作为难度感知强化学习训练的重要对比基线。
云计算一哥,亚马逊云科技的龙虾,刚刚也被端上桌了。这只龙虾叫做Amazon Quick。它就是“活”在你电脑里的那种,直接连接你的本地文件、日历、邮件和各类应用,不需要任何上传文件的动作(需授权)。
昨天,OpenAI 和微软,官宣分手,今天,OpenAI 已在 AWS 把家安好。三件家具一起搬上:模型、Codex、Managed Agents。包括 GPT-5.5 在内的模型,今天起可以在 Amazon Bedrock 直接调用
刚刚,Anthropic 发布 Claude Opus 4.7,已经在 Claude 的所有产品、API、Amazon Bedrock、Google Cloud Vertex AI、Microsoft Foundry 上全面可用。模型 id claude-opus-4-7
巨头亚马逊,也深度入局生命科学了。