「论文新颖性评估」共找到 1642 篇相关文章
Anthropic 新研究:AI出错是“热混乱”
Anthropic研究团队发现AI可能无一致目标,只是瞎搞。他们将AI错误分类,测试发现推理越久越混乱,大模型复杂任务易失控。此发现改变对AI风险的认知,论文已在arXiv发布。
谁在为人形机器人铺「全开源生态」?
2026 年人形机器人硬件发展快,但行业生态基本未变、研发成本高。乐享科技旗下元点机器人联合 CMU 发表两篇论文,又发布开发者全开源生态 OpenBridge,将“从闭门造车到开源共创”路径摆在台面。
从答题到做实验:SciAgentGym让大模型进入科学工作流
复旦大学NLP实验室提出SciAgentGym,为科学智能体搭建工作流环境,还设计了评测集SciAgentBench。实验显示模型接入工具能提升成功率,但长流程任务性能下降。论文还提出SciForge构建训练数据,提升了模型表现。
Ollama升级模型调度系统:内存管理更精准,多GPU性能提升
Ollama升级模型调度系统,精确测量运行模型所需内存,带来内存崩溃减少、GPU利用率提高等改进。Gemma3、Mistral - small3.2等模型性能提升,更多模型正迁移,还在开发iGPU支持,评估NPU支持。
本周六直播预约 | Test-Time Reasoning综述分享!
当大模型训练成本飙升、数据枯竭,推理阶段扩展Test-Time Scaling(TTS)成研究热点。论文提出四维正交分析框架,梳理主流技术路线,提炼发展路径,给出操作指南与未来思考,本周六将直播分享该综述。
模型不是企业的护城河,那什么才是?
文章指出企业AI进入深水区后,真正的竞争是将AI变成企业自己的智能引擎。衔远科技创始人周伯文提出泛化基础上的深度专业化是企业竞争力来源。衔远发布EnterpriseClawBench,揭示企业需私有化评估和可持续进化能力。
疯狂小扎边裁员边给高管发钱!元宇宙硬件成重灾区
据纽约时报等报道,Meta近日一边裁700人,涉及多部门,内部还评估更大规模调整;一边为6位核心高管设股权激励,收益与股价挂钩。这源于AI烧钱,Meta要开源节流,优先AI等现实方向。
吴恩达手搓新项目:AI审稿人上线!只为终结学生“3年被拒稿6次”的痛苦
吴恩达开发新项目 Agentic Reviewer 代理审稿人,灵感源于学生3年论文被拒6次。此工具能加快研究人员迭代速度,在 ICLR 2025 评审数据测试中接近人类水平,适用于 arXiv 公开研究领域。
全球68%科研人压力爆表,高校AI人才集体大逃亡!
高校AI科研「内卷」加剧,经费缩水、压力增大。爱思唯尔数据显示68%科研人发论文压力暴增,面临时间与资源双重困境。杜克大学陈怡然教授分享看法,工业界崛起,高校面临转型。
算法与我们:谁在驱动极化?
荷兰阿姆斯特丹大学论文《我们能修复社交媒体吗?》借助AI模拟无算法社交平台,发现三大乱象迅速复现,干预收效甚微。指出问题根源或在社交底层架构,用户可改变分享模式。