「自主通用科学家」共找到 1460 篇相关文章
Show me《指环王》!卡帕西强推大模型评测新基准
大神卡帕西宣称Anthropic用《指环王》给大模型评测上强度,这一‘指环王基准’正接替‘鹈鹕骑自行车’SVG测试。虽Opus 5生成的画面粗糙,但网友测试展现出丰富创意,不过新测试也引发争议。
从答题到做实验:SciAgentGym让大模型进入科学工作流
复旦大学NLP实验室提出SciAgentGym,为科学智能体搭建工作流环境,还设计了评测集SciAgentBench。实验显示模型接入工具能提升成功率,但长流程任务性能下降。论文还提出SciForge构建训练数据,提升了模型表现。
直播预约 | Recursive Self-Improvement:当AI开始进化AI
2026年AI已能在无人类干预下自我进化。6月24日19:00 - 21:00,机器之心联合黄大年茶思屋举办直播,汇聚仉尚航等专家,呈现“AI如何自我超越”的技术路线与未来图景。
一句话造世界!开发者用10天婚假爆肝,让AI小镇真正「活」了过来
2023年斯坦福「AI小镇」火了,但后续类似项目世界多人工搭建、固定。独立开发者用10天婚假开发WorldX,输入一句话5分钟就能生成完整AI世界,还解决了让AI看懂自己生成图等难题。
让龙虾越用越聪明!普林斯顿大学为OpenClaw搞了个强化学习框架
普林斯顿大学研究团队发布强化学习框架OpenClaw - RL,能捕捉用户反馈与环境结果信号,有独立解耦异步机制,融合打分与文本指导,经真实场景验证效果良好,蹚出自我进化新路径。
QwenLong-L1.5发布:一套配方,三大法宝,让30B MoE模型长文本推理能力媲美GPT-5
通义文档智能团队推出QwenLong - L1.5长文本推理专家,提供端到端长文本推理后训练“配方”,含数据合成管线、强化学习方法、智能体架构,在多基准测试成绩佳,代码已开源。
69 页最新报告丨AI Agent 圣经:智能体的终极指南
AI Agent 定义下一轮科技创新浪潮,众多公司积极布局。CBINSIGHTS《AI Agent Bible》报告梳理其前景趋势,含六大预测与生态版图,解析市场格局等,还展示智能体重塑企业运营方式。
将数据优势发挥到极致:「杭州六小龙」开源搭建空间智能的第一步
大模型时代数据支撑至关重要。群核科技在首届TechDay为空间智能发布空间语言模型SpatialLM 1.5和空间生成模型SpatialGen,前者学会空间语言,后者实现场景多视角图像生成且具时空一致性,SpatialGen已开源。
全新唇同步技术OmniSync,遮挡,侧脸不在话下
唇同步对创建逼真视频内容很重要,但现有方法在身份一致、姿势变化等方面有局限。中国人大携手快手提出OmniSync,引入无需掩膜的训练范式,保证身份和姿态一致,能适应复杂场景,还建立AIGC - LipSync基准。
ICLR 2026 | OpenAI打广告后,如何成为爆款?CMU提出AutoGEO解密流量密码
AI搜索引擎渐成主流,OpenAI引入商业推荐后,内容在AI搜索成爆款取决于AI引用偏好。CMU团队在ICLR 2026论文中提出AutoGEO,抽取引擎偏好规则改写网页,实验证明其有效且兼顾引擎效用。