我的世界」共找到 10954 篇相关文章

产品应用7

一年没用Perplexity,AI搜索进化惊呆了丨TIP 005

Perplexity Lab推出后,AI搜索实现技术成熟度拐点。作者体验其新出Perplexity Lab,发现它进化很大,如答案数据可视化、回答可交互等,虽有亏损且价格贵,但仍是实用AI搜索。

鲸选AI
新闻资讯7

从性能到实战,怎样才算是靠谱 Agent 产品?

红杉中国团队提出AI基准测试工具Xbench,其双轨测评体系不再单纯执着于测评问题难度,重点量化AI系统在真实场景效用价值,还构建长青评估机制,以确保评估结果时效性和相关性。

机器之心
开源动态8

全球首次实测通过!CMU华人用AI设计乐高「不翻车」

CMU研究人员提出LegoGPT,它微调MetaLLaMA模型,结合47000个稳定结构数据集,确保98.8%乐高设计符合物理定律,可实际搭建。目前,数据集、代码和模型均已开源。

新智元
推荐文章8

《动手写AI Agent》50 行代码,你第一个 Agent

文章教你用50行代码打造能读文件、跑命令、自主决策AI Agent Ling。介绍用JSON Schema给LLM装工具,通过循环让LLM按需调用工具,还给出运行示例及与Claude Code对照。

AI Reading Hub
产品应用7

AutoDev Review Agent:应对 10 倍代码量 Agentic 代码审查

文章介绍 AutoDev 新 Agent——基于多端架构 Code Review Agent,应对 Vibe Coding 时代 10 倍代码量审查压力。它采用 Agentic 多步骤审查,能在多端运行,串联多环节,虽有不足但奠定自动化审查基础。

phodal
算法论文7

刚刚,OpenAI发长篇论文:大模型幻觉原因找到了~

OpenAI发论文揭示语言模型出现幻觉根本原因,即训练和评估过程奖励猜测而非承认不确定性。预训练阶段就埋下幻觉种子,后训练阶段‘考试机制’强化幻觉,还给出改评分规则解法。

PaperAgent
新闻资讯7

7B小模型超越DeepSeek-R1:模仿人类教师,弱模型也能教出强推理LLM | Transformer作者团队

Transformer作者之一创立Sakana AI带来新方法,让教师模型像人类教师一样做启发式教学,根据已知解决方案输出解释。用此方法训练7B小模型在传授推理技能上比671BDeepSeek - R1更有效。

量子位
产品应用7

人形之外,擎羽把“身体”变成具身智能新变量

机器人身体正成为具身智能里被低估变量。擎羽科技不走人形路线,带来三款仿生柔性机器人及跨本体基础模型Fi0,提出柔性具身智能概念,让智能摆脱对单一身体依赖。

量子位
开源动态7

装完Hermes Agent玩了一圈,觉得龙虾已死!

Hermes Agent势头正猛,被视为龙虾以来首个真正竞争对手。它让Agent自己做Harness Engineering,自己写、用、改Skill,还能自迭代。文章介绍了安装使用方法,对比了与其他项目差异。

探索AGI
算法论文8

综述 | Agentic RL for LLM最新进展与未来挑战,idea满满

该综述对新兴Agentic RL进行系统性总结与展望,介绍其与传统LLM - RL区别,从核心能力和任务视角阐述其应用,梳理支撑系统,指出核心挑战与未来方向,展示通向通用AI希望之路。

深度学习自然语言处理