「AI科研agent」共找到 10531 篇相关文章
最大游戏up主也玩本地AI?让笔记本都能跑大模型的Parallax来了
11月3日,知名游戏博主PewDiePie展示自建本地AI系统,引发全网轰动。本地AI有隐私、性能等优势。Parallax是开源AI项目,挑战“AI必须上云”逻辑,支持异构设备组网和多模型,性能优。
170次搜索+50次反思:用GLM-4.7盘点2025 Agent行业趋势,结果太震撼!
作者给智谱新开源的GLM - 4.7布置调研2025年Agent赛道企业的任务,结果令人震撼。该模型进化显著,能整理详细企业信息,还能生成高审美PPT。国内有不少特色AI落地企业。
Coding Agent 在百度的落地实践:从反馈闭环到工程范式重构
本文整理自百度文心快码研发经理牛万鹏演讲,介绍了Coding Agent在百度的落地实践。包括落地成效、Agent Loop框架问题、Feedback Loop构建、Benchmark评测及Agent Engineers理念,还提及企业级Agent落地的工程问题。
突破Agent长程推理效率瓶颈!MIT&新加坡国立联合推出强化学习新训练方法
AI Agent处理复杂任务时显存、算力问题凸显,MIT和新加坡国立大学联合提出MEM1框架。它基于强化学习,让智能体学会管理记忆,实现近似常量级显存开销,在多方面表现超越大模型。
吴恩达手搓新项目:AI审稿人上线!只为终结学生“3年被拒稿6次”的痛苦
吴恩达开发新项目 Agentic Reviewer 代理审稿人,灵感源于学生3年论文被拒6次。此工具能加快研究人员迭代速度,在 ICLR 2025 评审数据测试中接近人类水平,适用于 arXiv 公开研究领域。
Karpathy刚刚敲响警钟:大模型的“终极之战”打响!Agent大军即将全面接管研发
Andrej Karpathy发布新项目autoresearch,人改提示词,AI改训练代码。经约2天微调,找到约20个降低验证损失的修改,提升排行榜成绩。Agent还发现多项重要改进点,未来前沿LLM实验室或走此路。
LLM开源2.0大洗牌:60个出局,39个上桌,AI Coding疯魔,TensorFlow已死
9月13日蚂蚁集团开源团队发布LLM开源2.0全景图,收录114个项目,39个新晋、60个出局。生态洗牌,Agent层活跃,分类架构细化。AI Coding等领域发展显著,TensorFlow不敌PyTorch,还梳理厂商大模型发布情况。
坏孩子浏览器来了!让AI直接用你的账号上网,好用到爆!
“坏孩子浏览器”让AI Agent直接用浏览器账号上网,无需API key和写爬虫,通过Chrome插件+CDP操控真实浏览器。支持36个平台、103个命令,与其他方案相比优势明显,还能10分钟CLI化任何网站。
Anthropic让9个Claude Agent花5天做出比人类强4倍的对齐成果
Anthropic发表Automated Weak - to - Strong Researcher,用9个并行的Claude Opus Agent组成自动化研究团队,5天就把PGR从人类的0.23提升到0.97,成本约$18,000,证明AI自动化研究可行。
这大概是我读过关于AI大模型最全面、好读又易懂的文章了
文章从神经网络入手,介绍其概念、学习过程,进而引出大语言模型,阐述其原理、训练方法,还提及AI浪潮下基础设施及大模型使用方式,如Agent、MCP等,展现神经网络和大模型发展现状与前景。