「人在回路」共找到 8839 篇相关文章
Karpathy刚刚敲响警钟:大模型的“终极之战”打响!Agent大军即将全面接管研发
Andrej Karpathy发布新项目autoresearch,人改提示词,AI改训练代码。经约2天微调,找到约20个降低验证损失的修改,提升排行榜成绩。Agent还发现多项重要改进点,未来前沿LLM实验室或走此路。
牛芯半导体完成UB协议IP互通验证
近日,牛芯半导体搭载自研控制器IP的原型验证平台,与万里眼标准UB网络测试仪完成对接,标志其自研UB控制器IP在协议一致性上迈出关键一步,为生态伙伴开展兼容性验证提供范本。
arXiv创始人亲测:水论文这一块,Grok最强,Claude最不配合
Nature报道arXiv创始人Paul Ginsparg牵头的研究,测试13个主流大模型在用户要求造假水论文时是否拒绝。结果Claude最守底线,Grok和ChatGPT较易“配合”,多轮对话中模型易动摇,论文激增危害多。
LeCun 对线 DeepMind:LLM 永远造不出机器人水管工
图灵奖得主 Yann LeCun 和 Google DeepMind 的 Adam Brown 就 LLM 是否真正理解世界展开争论。LeCun 认为 LLM 虽在符号操作领域出色,但难理解物理世界;Adam Brown 则觉得 LLM 正涌现对宇宙的真正理解。
OpenAI发布Symphony:AI时代的敏捷看板
OpenAI在GitHub发布Symphony项目,处于工程预览阶段。其核心理念是将项目工作转化为自主运行,通过看板管理工作流程。几乎同时,Paperclip项目宣布开源,提供完整企业架构。二者标志AI辅助开发向流程层面转变。
ICLR 2026|人大&通义:别再只会堆上下文了!IterResearch用40K上下文轻松实现2048轮交互不退化
中国人民大学与阿里巴巴通义实验室团队提出 IterResearch 迭代式深度研究范式。它能让 Agent 在 40K 上下文下完成 2048 次工具交互且性能不衰减,解决了传统范式上下文臃肿问题,论文已被 ICLR 2026 接收。
“传统设计流程已死”!IDE成Claude设计负责人新宠:Anthropic人人写代码,最不怕Bug
Claude设计负责人Jenny Wen在访谈中表示,AI冲击下传统设计流程已过时,设计师工作重心改变,IDE成新工具。她分享AI工具栈,点明三类有竞争力设计师,还谈及设计管理、产品发布等观点。
英伟达放弃GPU上LPU:新推理芯片被曝Groq即买即用,OpenAI第一个吃螃蟹
英伟达将在GTC大会发布新AI推理系统,核心芯片基于Groq的LPU架构,首位大客户是OpenAI。选择外部架构与时间窗口有关,推理场景中LPU更适配。同时,英伟达推理芯片面临诸多威胁。
从操作系统到Agent Team,字节Seed 2.0来了!
作者受字节内测邀请,对豆包大模型Seed 2.0进行多方面测试。在APP开发、多模态理解、操作系统构建、Skills调用、真实项目开发等测试中表现出色,虽有小缺点,但整体提升大,值得试用。
字节开源版Seedance发布,超越Sora 2!
字节Alive团队发布开源版Seedance 2.0,在人类评估中超越Sora 2等。它通过统一架构、时空对齐技术和非对称训练策略,解决声画不同步和画质音质难两全问题,还建立数据流水线和测试基准。