「通用代理智能」共找到 4087 篇相关文章
AMS最新AI4PDE综述:清华大学冯西桥教授团队白金帅等提出面向计算力学中物理和数据引导的AI框架的未来
本文综述人工智能赋能计算力学框架发展与现状,指出纯数据驱动、物理信息神经网络和算子学习方法虽有潜力,但在鲁棒性等方面有挑战。阐述四个研究方向,为复杂物理系统建模等开辟新途径。
离职员工首次长文揭秘真实的OpenAI:一半是天才,一半是疯子,7天时间上线code x
OpenAI离职员工Calvin French - Owen分享在公司一年工作的回忆与反思。从企业文化、技术栈揭秘,到7天打造编程代理code x的故事,让我们首次得以窥见OpenAI内部。作者认为这里有独特文化和强大执行力。
斯坦福毕业,用RL做Agent,华人创业团队种子轮融资1200万美元
华人创业团队 Pokee.ai 以 RL 为核心开发 AI Agent,与主流以 LLM 为核心的方式不同。该团队创始人朱哲清有丰富经验,现完成 1200 万美元种子轮融资,产品公开测试版已上线。对话中还探讨了 Agent 特点、发展阶段等问题。
如何让 AI 成为你的编程搭档?一次真实重构告诉你答案
文章介绍编程工具Cursor,它是基于VS Code、深度集成AI的智能代码编辑器,有多种模式,能力强但有局限。作者分享用其完成重构需求的过程、经验,还提及使用中踩坑及应对方案,最后总结提效成果。
8B模型可以超过GPT-4o!并行KV Cache压缩支持的128K长度外推方法ParallelComp
大模型长文本推理存在瓶颈,作者提出 ParallelComp 方案。它有并行 Attention 分块、KV 缓存智能淘汰与注意力偏差校准三大创新,能让 8B 模型性能达 GPT - 4o 的 91.17%,特定任务超 GPT - 4o。
MiniMax-M1:全球首个开源超长上下文大模型,超越DeepSeek-R1,推理成本仅1/4
MiniMax-M1是全球首个开源超长上下文大模型,刷新三项记录。它采用混合专家架构,闪电注意力让推理复杂度近乎线性增长。CISPO算法加速训练,成本低。在工业级任务测试表现佳,已开源且方便开发者接入。
员工每天花1000美元也要用ClaudeCode!创始人:太贵了,大公司专属,但它比 Cursor 猛!
Claude Code处理大型代码库能力强,但价格贵,有用户称能力超Cursor。其创始人分享设计理念、使用方法等,还提到它基于Claude 4系列模型有新变化,可在GitHub等场景用,未来会拓展工具协同和小任务处理。
Figure机器人分拣快递新视频曝光,网友:太像人类
Figure 02机器人开启打工模式,创始人放出其分拣快递新视频,它动作流畅像人类,由端到端通用控制模型Helix自主驱动。此前它还在宝马生产线连续20小时轮班作业,Figure与OpenAI分道扬镳后推出Helix。
阿里通义开源「推理+搜索」预训练新框架:小模型媲美大模型,多个开放域问答数据集表现显著提升
阿里通义实验室开源通用预训练框架MaskSearch,引入检索增强型掩码预测任务,兼容两种训练方法。实验显示,它在多数据集提升模型性能,小模型能媲美大模型,还验证了训练方式、策略及奖励函数的效果。
规模化破局:中国无人驾驶全球突围|甲子光年
在全球新能源与智能交通变革中,中国无人驾驶企业改写竞争逻辑。百度旗下萝卜快跑凭借12年研发,跨越‘用户规模断层’鸿沟,以‘倍速出海’策略在全球出行革命中争夺主动权,其出海模式与技术能力值得关注。