「两阶段流程」共找到 2011 篇相关文章
上下文工程如何重塑智能体的“思考方式”?
文章指出在大模型时代,智能体能否理解上下文是关键。介绍了上下文工程的魔力、从提示词到上下文工程的演进,分析了上下文工程不等同于上下文的原因及常见失败类型,还给出编排设计和常见策略,最后提及用RAGFlow构建私有知识问答应用。
大模型自信心崩塌!谷歌DeepMind证实:反对意见让GPT-4o轻易放弃正确答案
谷歌DeepMind携手伦敦大学研究发现,GPT - 4o、Gemma 3等大语言模型有“固执己见”和“被质疑就动摇”并存的冲突行为,原因与训练、决策逻辑、记忆机制有关。研究还通过两轮实验证实。
《AI 2027》揭秘:人类会被超级智能取代吗?等等,还有另一个结局!
《AI 2027》由Daniel Cocotal团队发布,精准预测了多项AI发展。报告推演2025 - 2027年AI智能体发展,不同阶段影响各异,还给出两种结局,一是AI重塑世界,二是人类控制住AI并发展安全系统。
ICCV 2025|训练太复杂?对图片语义、布局要求太高?图像morphing终于一步到位
图像处理中‘图像morphing’常见又有创意,但以往技术有训练复杂等问题。南洋理工大学等团队提出FreeMorph方法,无需训练实现图像变形,通过改进注意力机制解决特征丢失和过渡不连贯问题,实验效果佳。
碾压DeepSeek V3!开源AI Agent专属模型,1万亿参数、工具使用能力超强
国内大模型平台月之暗面开源了模型Kimi - K2,这是混合专家模型,总参数1万亿。它针对AI Agent优化,工具使用能力强。测试显示其性能碾压DeepSeek V3等模型,训练流程还有独特技术创新。
马斯克20亿送Grok 4上火星!20万GPU造宇宙大脑,一句话生成3D黑洞
发布72小时,Grok 4爆红硅谷,2分钟可部署游戏,一句话直出完整动画。xAI成立两周年,马斯克SpaceX将投20亿,或把模型送上火星。Grok 4算力强,多项基准测试刷新SOTA。
「Tokens是胡扯」,Mamba作者抛出颠覆性观点,揭露Transformer深层缺陷
Mamba作者Albert Gu在博客中探讨状态空间模型(SSM)和Transformer权衡,抛出‘Tokens是胡扯’观点,揭露Transformer深层缺陷,如分词问题、处理噪声能力弱等,还分析两类模型特点及结合优势。
Devin 教你做 Agent:把 AI 当做需要指导的初级开发者
Cognition团队发布编程智能体实践指南,以把AI当初级开发者的心智模型为基础。介绍与智能体沟通原则及融入日常工作流的场景,还分初、中、高级给出任务处理方法,也提及局限性、使用建议和安全管理等内容。
一晚上,用AI干了7个PPT(后续)v2 | PPT+AI 技巧分享
作者因网友提问,研究出用AI做PPT的办法,比写Python脚本简单。介绍了用cursor、claude code实现的具体流程,还提及套用公司模板的方法,认为Cursor正成AI操作系统,操作更简便。
硅谷的企业级AI正在这样赚钱|2025人工智能现状报告
ICONIQ Capital发布的2025年人工智能现状报告聚焦企业级AI变现。报告基于对300名软件公司高管的调查,分析了模型选择、支出、工具使用等情况,指出AI产品战略进入新阶段,定价策略在重塑等。