「Mobile - Agent v3.5」共找到 5728 篇相关文章
看完 Manus、Cursor 分享后的最大收获:避免 Context 的过度工程化才是关键
上下文工程优化是Agent创业公司新一年竞争重点,其信息质量很大程度决定Agent表现。文章结合Manus、Cursor团队思路,给出做好上下文工程要点,如缩减上下文、搭建工具行动空间、多Agent协作等。
陪5岁小朋友玩到黔驴技穷,我用一张照片给他做了个汪汪队手办。
作者陪5岁小朋友玩时,用一张照片结合Hi3D网页和3D打印技术做汪汪队手办。介绍了3D建模、格式选择、代加工等全流程,还分享了成本控制和上色等经验。
大模型追逐星辰大海,GPT和Gemini国际天文奥赛夺金
新论文以国际天文学和天体物理学奥林匹克竞赛 (IOAA) 为基准测试,证明 GPT - 5 和 Gemini 2.5 Pro 能在天文奥赛获金牌。研究还分析不同模型表现、与人类成绩对比及错误类型,强调需全面评估模型科研潜力。
Anthropic 的 Harness 设计:build to delete
Anthropic工程博客发布Harness设计文章,探讨Claude完成全栈应用开发任务。指出单Agent模式问题,采用GAN式对抗、三Agent编排,对比单Agent与多智能体产出,还介绍调教评估者及编排简化,提出Build to Delete原则。
2025 年最全面的 LLM 架构技术解析【长文】
Sebastian Raschka更新「大型LLM架构对比」长文,解析2025年LLM架构发展。介绍了如DeepSeek V3、OLMo 2、Gemma 3等模型架构特点,像DeepSeek V3用MLA和MoE提升效率,还探讨线性注意力复兴等趋势。
天工Skywork开始"看"小红书了,1247个帖子的图片信息被它吃透!
昆仑万维技术发布周推出Skywork Deep Research Agent v2。它整合多模态检索理解和跨模态生成能力,有信息检索、小红书Agent等功能,Office Agent也有升级,还新增积分预估等特性,邀测后将全量开放。
万亿参数狂欢!一文刷爆2025年七大顶流大模型架构
文章深入剖析2025年顶级开源模型的创新技术,介绍了DeepSeek V3/R1、Kimi 2、Qwen3等七大顶流大模型架构,揭示滑动窗口注意力、MoE和NoPE如何重塑效率与性能。
造过 Codex 的人,为什么每天用 Claude Code
Calvin曾带队构建编程Agent Codex,如今日常用Claude Code。他和Garry Tan在播客聊了编程Agent的产品哲学差异、分发逻辑等。Claude Code拆分上下文表现出色,LLM成开发者工具推荐引擎,还探讨了构建、使用编程Agent的要点。
比 Playwright 更给力,这个新开源的项目6啊~
GitHub上的BrowserAct项目是面向AI Agent的浏览器自动化CLI,是为AI Agent设计的真实浏览器执行层。它有三层反检测突破体系、三种浏览器模式等功能,能解决Agent操作浏览器的诸多问题,适合多场景。
Meta发最强模型打响价格战,小扎对谷歌贴脸开大!北大校友立大功
九月刚过3天就有五个前沿模型发布,Meta发布Muse Spark 1.3踢馆谷歌Gemini 3.8 Flash。它跑分提升大、成本低,性价比高,但也遭质疑,大模型下半场或比拼系统架构和智能体工程能力。