中科加禾」共找到 2816 篇相关文章

推荐文章7

【访谈】在黑箱寻找自我显影——对话苏仲尧|三影堂厦门

苏仲尧个展《打开黑箱说亮话》聚焦摄影人机互动,引向对‘技术黑箱’思考。创作分三阶段,从文字照片到金属板,再结合AI。他将创作主导权回归自身,借作品探讨技术与人关系及当下处境。

三影堂摄影艺术中心
产品应用7

既然 Claude 封了不让用,Codex 就疯狂追赶之

Claude 受限,作者转用 Codex 等 Agent 工具,效率不错。OpenAI 大 Coding 投入,Codex 追赶势头猛。作者还分享 Codex 使用心得,介绍为 CatReader 新功能过程,提醒功能要谨慎。

MacTalk
算法论文8

你的AI Agent越用越蠢?港大、浙大戳破「记忆」的谎言

香港文大学联合浙江大学发布论文指出,当前主流的Agent记忆方案只是「备忘录」,而非真正的记忆。论文归纳出三大结构性缺陷,提出双系统共存架构,引发学术界广泛讨论。

新智元
新闻资讯7

Claude骂声启动「隐形水印」:新模型全量嵌入,标记所有文字

Anthropic宣布新款Claude将在生成文本嵌入隐形水印,还会给特定文件附数字签名元数据,全球统一施行。此前A社就用Unicode贴暗标,虽称不影响生成质量,但遭质疑。

量子位
算法论文8

刚刚,Meta风雨飘摇发了篇重量级论文,作者几乎全是华人

风雨飘摇的Meta发布重量级论文《Agent Learning via Early Experience》,提出「早期经验」新范式,让AI智能体「无师自通」,为突破强化学习瓶颈提供新思路。该范式结合两种策略,实验效果显著,还指出了局限与未来方向。

新智元
产品应用7

关于Nsight ComputeCompute Workload Analysis反映的Tensor Pipe Uti的理解

文章分析Nsight ComputeCompute Workload Analysis反映的Tensor Pipe Uti异常现象。通过实验和推算,发现ncu对L20 GPU上特定指令用错误执行延迟算指标,导致异常,还给出GEMM Kernel性能分析建议。

GiantPandaLLM
算法论文8

Think in Games:做一个在王者荣耀会玩和思考的Agent

文章介绍论文《Think in Games: Learning to Reason in Games via Reinforcement Learning with Large Language Models》,指出当前AI在游戏领域面临的困境,提出TiG框架结合大语言模型与强化学习,打造既会做又会说的AI,实验验证其高效性。

深度学习自然语言处理
算法论文7

拟合接近满分,外推却会跑偏:Meta 给缩放律了一个指数

大模型训练前,团队常用 Chinchilla 缩放律估算模型规模和数据量,但它在模型和数据极不平衡的边界预测易跑偏。Meta FAIR 提出的 Skaling 只增一个耦合指数,降低外推误差,还采用 L 形采样降低试算成本。

深度学习自然语言处理
算法论文8

ICML 2025 | 注意力机制的极大值:破解大语言模型上下文理解的关键

ICML 2025新研究揭示,在使用RoPE的现代Transformer模型里,注意力机制Q和K表示有集极大值,V表示无此模式。研究通过实验明确极大值与上下文知识理解的联系,对模型设计、优化和量化有重要启示。

深度学习自然语言处理
新闻资讯8

大模型上天、马斯克发射GPU?国团队直接建「太空超算」

2025年11月,英伟达送H100入太空,谷歌计划2027年发射81颗搭载TPU的卫星。美国欲打造太空生态闭环,天算等团队也在行动,天算目标是在太空建超算心。

新智元