「研究能力」共找到 4663 篇相关文章
GPT-6 Astra发布,多个基准测试接近满分,“欢迎来到AGI时代”?
当地时间9月3日,OpenAI发布GPT-6 Astra,称其为“最智能、最对齐”的模型。它在多测试表现逆天,能力提升显著,还加入新特性。不过价格更高,也带来安全问题。
别光看 Claude 多厉害!Anthropic 内部拉响警报:“AI 的经济冲击比想象的更危险!”
Anthropic宣布启动‘经济未来计划’,作为‘经济指数’扩展,聚焦深入实证研究、推动数据驱动政策制定、完善经济衡量工具,还将与独立机构合作,现已开放合作申请。
AI自动写学术综述:10分钟生成6万字,成本不到四块钱
上海人工智能实验室等单位提出SurveyForge框架,能自动化生成高质量学术综述论文。它有双数据库协同驱动的大纲生成机制、学者导航代理SANA和并行生成与协调机制。还有SurveyBench评估框架,实验显示其效果好,应用前景广。
用3D几何先验驱动视频扩散,实现更一致的世界生成
视频扩散模型生成新视角视频时,现有方法缺显式3D结构。智象未来提出DreamWorld,用3D先验与两阶段框架,结合结构和生成能力,在多基准测试表现领先。
AI Coding 流畅度模型:人机协作中的开发者角色转型与未来演进
生成式 AI 正进入软件开发流程,角色不断扩大。AI Coding Fluency 模型描述团队使用 AI 能力演进,从辅助到自主执行。AI 编程面临信任、上下文、任务设计挑战,关键在于协作方式。
上下文工程(Context Engineering)综述:大模型的下一个前沿
文章提出“上下文工程”学科,通过整合1400余篇论文构建“基础组件 - 系统实现”框架。它将上下文定义为动态结构化信息集合,揭示LLMs理解强于生成的矛盾,为AI研究指明方向。
王云鹤眼中的Harness:复杂优化问题,AGI灵魂争夺之战
王云鹤在知乎文章中探讨Harness Engineering,指出Agent=Model+Harness,多模型配合能提升Agent能力。还分析Harness存在的必要性,认为它是复杂优化问题,关乎AI“灵魂”之争。
Claude Code 能写十万行代码,读一篇公众号就废了
Claude Code 读链接能力弱,qiaomu - markdown - proxy 这个 Claude Code Skill 可解决。它按 URL 类型走不同通道抓内容转 Markdown,全程免费,安装简单,解决了 Claude Code 系统性短板。
国务院关于深入实施“人工智能+”行动的意见
国务院发布意见深入实施“人工智能+”行动,推动其与各行业领域融合。提出到2027年、2030年和2035年的目标,部署重点行动,强化基础支撑能力,明确组织实施要求。
硅基生命的「成年礼」:上海具身智能的入世大考与万亿生态突围
2025年,上海具身智能产业发展迅速。政府通过场景开放、算力平权等举措构建生态。智元、傅利叶等企业成果显著。12月12日GDPS大赛是成果检验,各赛道考验机器人不同能力。