机器学习工程代理」共找到 2236 篇相关文章

推荐文章7

软件的新玩法:如何 Fork 一个技能库|AGIX PM Notes

文章围绕软件新玩法展开,指出软件正从面向人向面向机器转变,Claude Skills 代表新范式,软件或消解为面向 LLM 的 skill.md 文件。还涵盖市场总结、AI 动态及 ETF 知识等内容。

海外独角兽
推荐文章8

从Transformer到Agent:生成式AI行业技术路线与职业发展指南,深度解析AI价值链

文章深度解析生成式AI行业,介绍其宏观图景、商业运作、行业定位与战略考量。指出行业价值链呈“杠铃”形态,应用层机会大,还提及盈利模式、岗位薪酬、开源闭源之争等,为从业者提供职业指南。

AI Reading Hub
开源动态8

LLaVA-OneVision-1.5全流程开源,8B模型预训练只需4天、1.6万美元

灵感实验室团队联合 LMMs - Lab 推出 LLaVA - OneVision - 1.5,全流程开源。其 8B 模型预训练 4 天、成本 1.6 万美元,在多模态基准上性能优,还公开数据构建与训练策略等细节,复现简单。

机器之心
推荐文章7

Anthropic:怎么才能控制模型的行为,做好Agents?

Anthropic发关于AI Agents博客,围绕如何配置上下文让模型输出期望行为展开。指出上下文是有限资源,有Context Rot现象,介绍了上下文工程概念、构成,还提及即时策略、长时间任务处理方法及实践建议。

探索AGI
算法论文8

CMU&斯坦福提出Reasoning新范式!自己找“窍门”,教会LLM抽象Reasoning

大型语言模型解决复杂推理问题时效率低,论文提出创新方法,让模型利用“推理抽象”,通过RLAD两玩家强化学习框架训练,在多基准测试提升性能,还分析了其作用、局限与未来方向。

深度学习自然语言处理
新闻资讯7

GPT-5仅23.3%,全球AI集体挂科!地狱级编程考试,夺金神话破灭

最新基准测试SWE-Bench Pro评估AI编程智能体,直面真实企业级工程任务。顶尖模型几乎溃败,GPT - 5仅23.3%。该测试解决现有基准数据污染、任务简单问题,能成未来LLM编码能力标尺。

新智元
新闻资讯7

创始人自曝让儿子辍学用AI上课、水平超同龄人!俞敏洪最先押注的“AI学校”,负债9亿不垮、现在要开到美国了

松鼠Ai创始人栗浩洋让儿子辍学用AI上课,称其水平超同龄人。该公司由俞敏洪最早投资,曾负债9亿,后转型推出学习机业务。如今计划将‘AI学校’开到美国,正做相应市场适配调整。

AI前线
新闻资讯7

老黄刚投的具身智能公司:三个华人创办

Dyna Robotics获1.2亿美元A轮融资,英伟达是新晋股东。该公司由三个华人创立,决定先将具身AGI带入商用场景,今年4月发布可落地商业场景的灵巧操作基础模型DYNA - 1,已在多场景应用。

量子位
新闻资讯7

刚刚!Thinking Machines Lab | 长文揭开LLM推理不确定性真相!

Thinking Machines Lab发布《克服LLM推理中的不确定性》,揭示大语言模型推理不确定性原因,并非“并发 + 浮点”假设那么简单,主要是负载及batch size不确定所致,还给出让核函数有批次不变性的方法及实验结果。

AINLPer
开源动态8

重磅!Thinking Machines开山之作:大模型输出随机的根本原因被揪出,并开源终结方案

由OpenAI前CTO创办的Thinking Machines宣布上线技术研究博客,开篇文章揪出LLM输出随机的根本原因是负载及批次大小的非确定性变化,并给出系统性解法,还开源方案。

AI寒武纪