「多智能体社会实验」共找到 4551 篇相关文章
Anthropic开始抢科学家了?周薪2.7万驻场,专治Claude专家级错误
Anthropic新推出STEM Fellow岗位,招募STEM领域专家驻场三个月,周薪3800美元,用其判断力校准Claude输出质量。其三年来科研路线不断加码,正构建科研生态。AI科研瓶颈是判断力而非算力。
单Agent时代正式结束:一个干不过,就上300个
月之暗面发布并开源 Kimi K2.6 模型,热度高。它强化 Agent 团队协作能力,核心能力进步,领先对手。在编程领域发力,长程编码能力突破,集群协同输出强,还适配框架,实测效果出色,Claw 群组开启内测。
Agent不是关键!人大AiScientist实现23小时、74轮长程记忆
中国人民大学团队打造的AiScientist,旨在解决长程机器学习研究工程的持续性难题。它通过File - as - Bus机制稳定保存项目状态,在多轮实验中表现出色,提升科研效率,推动AI真正接手科研流程。
表格建模也能Scaling?树模型的时代要改变了
文章指出 AI 算力增长与结构化数据建模以树模型为主形成反差。浙大 X 蚂蚁 AIforData 团队探索结构化数据预训练,在表格数据和行为序列预训练上有成果,验证了 Scaling Law,预示结构化数据建模范式将改变。
斯坦福2026 AI指数报告!中美差距已实质性抹平
斯坦福HAI发布2026年度人工智能指数报告,显示中美在顶级大模型性能上差距已实质性抹平。报告还呈现了AI能力进化、算力格局、智能边界、安全监管、人才流动等多方面情况。
独家|极佳视界再获新一轮数十亿大额融资,估值超百亿,领跑世界模型赛道
AI科技评论独家获悉,极佳视界近日完成新一轮数十亿大额融资,投资方阵容豪华。其成立于2023年,在世界模型技术与应用上领先,产品在多领域落地,还计划年内开启大规模Scaling进程。
Meta 重磅提出「神经计算机」:模型即电脑
Meta AI和KAUST提出「神经计算机」概念,目标是让神经网络承担计算、内存、输入输出。论文给出完整框架并做原型验证,虽当前原型距目标差距大,但提出问题和定义框架意义重大。
Karpathy用「harness」彻底终结了RAG。
假期时Karpathy提出llm.wiki想法引发关注。它是元框架,定义人类与AI协作管理知识的方式。与RAG不同,它将新材料关键信息编入已有wiki并持续维护。作者用多种数据测试,发现TextIn API解析效果好,还优化处理流程提升质量。
GitHub 已被各类Agent霸榜,今天挑选5个高star Agent
文章挑选5个GitHub高star Agent项目。如Hermes Agent是开源自改进AI Agent,有自主技能创建等特性;GitNexus是纯浏览器端代码智能工具;Shannon是白盒AI渗透测试工具等。
AI数据工程师在应用中如何"返璞归真"
文章反思‘知识库+Prompt工程+工具调用’轻量级Agent构建模式局限,指出其难应对知识质量、语义理解与规模化维护挑战。提出从‘Prompt驱动’到‘上下文工程’、从‘搭积木组装’到‘全链路闭环’的范式跃迁,并介绍MktAI知识体系建设。