AutoResearch-LLM」共找到 982 篇相关文章

算法论文8

短视频刷多了AI也会变蠢!“年度最令人不安的论文”

最新研究显示,大模型灌多垃圾内容会‘脑损伤’,研究人员用不同维度定义垃圾数据并训练模型,测试其核心能力,发现垃圾数据致认知下降,且损伤不可逆,还给出行业启发。

量子位
新闻资讯7

65岁图灵巨头离职创业!LeCun愤然与小扎决裂,Meta巨震

FT爆料,65岁Meta首席AI科学家LeCun将在未来几个月离职创业,推进「世界模型」研究。他任职12年,因与小扎战略分歧而决裂,此前MetaAI业务改革,战略重心转移,FAIR被边缘化。

新智元
产品应用7

比 Context7 更靠谱:Exa-code 靠 1B+ GitHub 与 Stack Overflow 减少幻觉

Exa团队索引超1B+文档、GitHub仓库等内容,exa - code对其混合搜索、分块处理。它是首个为编码代理制作的Web规模上下文工具,在代码幻觉评估中表现超流行网页搜索工具,核心技术有专为AI的搜索引擎和高效返回上下文。

AI进修生
推荐文章7

Shopify分享了他们做Agent的万字踩坑经验

Shopify分享构建生产级AI助手Sidekick的万字经验。构建中遇工具拓展难题,用JIT指令解决;评估是大挑战,建立严谨体系,虽有提升但效果仍有波动,模型还会钻空子,最后强调单Agent系统也强大。

探索AGI
推荐文章8

Physical Intelligence 核心技术团队分享:物理世界的“Vibe Coding”如何实现?

Physical Intelligence 核心技术团队解读机器人技术路径,分享前沿探索。介绍 VLA 与 VLM、LLM 关系,还提及 PI 构建数据管线、提出“知识绝缘”机制,分析开放世界部署难题,展望未来“机器人模型即服务”。

海外独角兽
开源动态8

9K Star 开源工作流爆火!超轻量直观的AI Agent 工作流构建器!

在AI应用开发领域,将大语言模型与业务逻辑和外部工具结合是重点。GitHub上获9K Star的Sim项目是AI Agent工作流构建器,提供Figma式拖拽界面,无需手写代码,降低配置、调用和部署门槛。

开源星探
算法论文8

北航LiveRepoReflection: 扭转乾坤-仓库级代码反射

本文提出LiveRepoReflection基准,评估多文件仓库代码理解和生成能力,含1888个测试案例。创建RepoReflection - Instruct数据集训练RepoReflectionCoder,评估40多个LLMs,结果显示其能有效测模型反思修复能力。

PaperAgent
推荐文章8

从RLHF、PPO到GRPO再训练推理模型,这是你需要的强化学习入门指南

强化学习是当今LLM重要技术,Unsloth团队发布教程,从吃豆人谈起,介绍RLHF、PPO到GRPO,分享用GRPO训练推理模型技巧,涵盖相关概念、训练方法及奖励函数设计等内容。

机器之心
新闻资讯8

震撼全网,AlphaEvolve矩阵乘法突破被证明为真!开发者用代码证实

开发者用Claude写代码证实谷歌DeepMind的AlphaEvolve求解矩阵乘法的突破为真,它将4×4复数矩阵计算次数从49次减到48次。小哥测试代码各项指标与论文报告一致,还上传到GitHub。

新智元
新闻资讯8

OpenAI曝出第一颗芯片叫「辣椒」!AI自己设计,9个月流片

OpenAI首颗自研芯片Jalapeño问世,9个月从白纸到流片,创行业最快纪录。该芯片专为大模型推理设计,由其AI参与设计优化,有望降低推理成本,提升用户体验。OpenAI欲做全栈AI公司。

新智元