DeepSeek Harness国庆假期上新!90后负责人回应:希望做出让世界AI巨头跟进的创新

在春节发布新版本席卷全球后,DeepSeek又“加班”了:在国庆期间再次更新。10月3日,国产大模型龙头DeepSeek智能体框架DeepSeek Harness发布了新版本,强化插件化和跨平台能力,加入了实验性Claude Code Mods兼容层——这也意味着,美国AI巨头Anthropic旗下Claude Code开发的部分扩展功能,理论上可以经过适配后在DeepSeek Harness的框架里运行。这一更新迅速在技术社群引发关注,随后DeepSeek Harness负责人崔添翼4日发文回应:做这个兼容层的主要目的,是验证Claude Code Mods向插件作者提供的扩展能力,是否大致是DSH“一切皆插件”架构所提供能力的一个子集。目前还无法让所有Claude Code Mods在DeepSeek Harness中无缝运行;如果认为这是一个值得投入的目标,从技术上看,未来有可能做到。DeepSeek Harness的核心理念是“一切皆插件”:崔添翼表示,这个理念是从立项之初、写第一行代码之前就确立下来的,正如“…

来自“对手”的认证:中国最强模型,距美国前沿只剩4个月差距

美国当地时间9月29日,美国人工智能企业Anthropic前沿红队发布GLM-5.3网络安全能力研究报告。这份出自海外顶尖模型企业的报告,意外成为中国开源模型的一份“对手认证”。据了解,Anthropic前沿红队是Anthropic内部一个专门研究前沿人工智能模型能力与风险的技术研究团队,其专门站在攻击者视角,对Claude等前沿大模型开展高强度压力测试,挖掘生物安全、网络安全、自主系统层面的灾难性滥用风险。该报告对中国人工智能企业智谱GLM-5.3的网络能力进行了系统评测,并引用美国国家标准与技术研究院(NIST)下属机构美国人工智能标准与创新中心(CAISI)发布的独立评估结论称,GLM-5.3是“迄今发布的网络能力最强的开源权重模型”,综合网络基准落后美国前沿水平约4个月。在ExploitBench(漏洞利用基准测试)端到端漏洞利用测试中,智谱GLM-5.3在410次尝试中成功了50次,Anthropic自家模型Claude Mythos Preview为56次,两…


扫描关注微信号有更多的信息,点击可缩放大小