「设计领域Agent」共找到 5181 篇相关文章
顶尖数学家含泪退圈:熬了多年的博士难题,被AI几周秒杀!
顶尖数学学者Rishikesh Gajjala靠AI攻破博士课题,却宣布退出学术圈。他认为AI生成证明虽精巧但难验证,“漂亮证明未验证和垃圾无异”。他投身形式化验证领域,而AxiomProver完成“246定理”形式化验证。
从Claude隐形水印回望GenAI时代信息隐藏:嵌入水印如何保证无损?
2026年Anthropic新版Claude模型嵌入隐形水印,引发对水印是否伤模型的质疑。可证安全隐写理论为解决此问题提供支撑,中科大等团队取得诸多成果,将“可证无损”从内容延伸到模型,还探讨了水印攻防。
突发!Claude挑战黎曼猜想「失败」,却意外刷新37年数学纪录
AI向黎曼猜想发起挑战,Anthropic的Claude研究版本虽未攻克该猜想,但将黎曼ζ函数中已知至少位于临界线上的零点比例下界,由41.6%提高到了67.2%,这可能是解析数论领域重大进展。
爆火的腾讯WorkBuddy发了篇论文,公开了自家底牌
腾讯 WorkBuddy 团队将内部模型选型评测等开源成 Benchmark,公开多模型 Agent 工作台选型底牌。Bench 优点是任务分布真实且开源可审计,论文介绍了核心方法论、四大赛道拆解、榜单结果,还对比了现有工作。
刚刚,Kimi K3开源!3万亿模型权重全球开放
2026年7月27日,Moonshot AI开源全球首个3万亿参数级模型Kimi K3。它不仅参数量大,还在多领域表现出色,能与顶尖闭源模型媲美。其架构创新、训练独特、推理成本低,有望改变全球大模型格局。
8 位 AI Infra 高管复盘 WAIC:当堆砌「暴力美学」触顶,AI Infra 如何求变?
雷峰网与8位参展AI Infra公司的决策者交流,捕捉行业新方向和共识。今年行业关注重心从拼规模转向比效率,Token推理成算力消耗主体,AI工厂和Token工厂共生,未来竞争聚焦效率,不同玩家各有优劣。
AI最尴尬的短板,中国科学院出手了
7月24日,中科院计算所“知境”团队发布知境社会心智大模型技术体系,为现有大模型补社会心智短板。其建评测体系SoMBench,设计训练系统Zing,用部署架构Actio,在多评测超越GPT - 5.5等,应用前景广。
邢波再出手:上次「骂」完世界模型,这次轮到智能体了
邢波教授新作《智能体模型批评》上线 arXiv,质疑当下被称为「智能体」的系统是否名副其实。论文将其分为两类,沿五维度拆解主流设计,提出 GIC 架构,还探讨了安全问题,指出要让能力内化进模型。
阶跃开源JetSpec,大模型推测解码提速近10倍
随着Agent应用爆发,大模型推理效率成AI行业焦点。阶跃星辰联合多校团队开源JetSpec,该框架面向推测解码,在H100上把MATH - 500解码速度提升到9.64倍,突破了推测解码的扩展天花板。
想玩Loop Engineering,可以先从这6个Hook玩法开始。
Loop Engineering正火,入手可从Hook玩法开始。Hook是循环触发器,在Agent里很常见。文中整理了6个Claude Code的Hook玩法,如权限弹窗提醒、开机日程播报等,还提醒接入工作流要注意稳定性和边界。