超并行实验」共找到 3431 篇相关文章

算法论文8

提示工程死亡?不,它刚刚重生为计算科学:一篇讲透Prompt设计的科学基础

大型语言模型在多步推理任务中受挫,因Transformer架构有计算深度限制。本文建立提示设计理论框架,揭示提示是信息选择器,优化提示可使推理性能提升50%,将提示设计从试错艺术变为可计算科学。

深度学习自然语言处理
产品应用8

录音笔的终结者,还是AI时代的又一个“美丽废物”?深度体验出门问问TicNote

作者体验出门问问AI硬件产品TicNote一个月,称其轻,有双模式录音功能,解决手机录音痛点。软件强大,支持多语种和方言,能自动总结,还可拓展内容。价格有两档,适合多类人群。

歸藏的AI工具箱
算法论文8

谷歌助力神经科学飞跃,破解斑马鱼全脑活动密码

谷歌等机构科学家联合发布开创性研究成果ZAPBench,这是预测斑马鱼全脑活动的基准测试平台。它含70000个神经元4D光片显微镜记录,设计多种刺激条件采集数据,有特定基准测试任务和评估指标。

AIGC开放社区
推荐文章7

LangChain官方实测:多智能体架构怎么选?

构建AI Agent时,单智能体应对复杂场景易“变笨”且难维护。LangChain官方评测主流多智能体架构,在复杂零售场景实验,对比单智能体、Swarm、Supervisor架构的性能、成本,还给出优化Supervisor架构的方法。

探索AGI
算法论文7

无需人类插手!AI战队自主进化,人类玩家瑟瑟发抖

论文《Agents of Change: Self - Evolving LLM Agents for Strategic Planning》以桌游《卡坦岛》为“考场”测试AI战略能力。研究团队设计四代AI特工,实验显示能自我进化的AI完爆静态AI,不过也存在计算成本高、依赖基础模型等问题。

深度学习自然语言处理
算法论文8

伯克利斯坦福联手造出「科研预言家」:77%准确率押注研究想法前景

伯克利和斯坦福团队让GPT - 4.1变身「科研预言家」,从顶会提取想法对比案例训练,不借助实验验证,靠推理押注。其在公开题库测试、人类专家团战等测试中表现出色,还能预测AI新点子。

深度学习自然语言处理
新闻资讯8

双重突破:全球首个零售VLA大模型来了!开源OpenWBT让机器人遥操门槛暴降!

2025北京智源大会上,银河通用机器人展示端到端具身大模型GroceryVLA,可在商场景自主操作,具强适用性等五大能力。还发布OpenWBT开源系统,降人形机器人遥操门槛,促产业发展。

量子位
算法论文8

揭开大模型“伪遗忘”,港理工等团队:结构不变就是没忘

近年来大语言模型隐私风险受关注,机器遗忘技术应运而生。港理工等团队构建表示空间诊断工具,区分‘可逆性遗忘’与‘不可逆遗忘’,揭示遗忘现象背后表示结构变化规律,还做了相关实验并得出核心结论。

量子位
新闻资讯7

AI接管程序员!Anthropic创始人自曝行业末日时间表

Anthropic创始人Dario Amodei预测,AI三到六个月内或能编写90%代码,一年后可能编写所有代码。谷歌25%代码已由AI生成。不过人类短期内仍在代码设计等方面重要,程序员要适应与AI协作。

新智元
算法论文7

DeepSeek们越来越聪明,却也越来越不听话了。

论文《When Thinking Fails: The Pitfalls of Reasoning for Instruction - Following in LLMs》用实验验证,模型推理能力变强时,提示词遵循能力变差。研究团队对15个模型测试,发现用CoT推理后执行准确率下降,还提出4种提升指令遵循效果的方案。

数字生命卡兹克