语言交互」共找到 1667 篇相关文章

新闻资讯8

JoyInside 创新大赛现场,我看到 AI 硬件长出了灵魂

作者曾对多数AI硬件失望,认为其有硬件没灵魂。但在观猹和京东联合举办的JoyInside创新大赛上,20强产品让其改观。大赛基于京东JoyAI大模型,缩短产品上市周期,前三名产品各有亮点,还呈现场景垂直化和交互方式改变趋势。

特工宇宙
算法论文8

RL在Agentic Reasoning中的作用:拨开迷雾,看清本质

近年大语言模型在推理任务能力惊人,但使用外部工具存挑战。传统SFT无法让模型自主调用工具,强化学习虽被引入,但在智能体推理中面临训练效率、稳定性和泛化能力难题。论文从多维度解构智能体强化学习,提出有效方法。

深度学习自然语言处理
算法论文8

破解AI对不同上下⽂位置的敏感度不⼀致,新框架使出“解铃还须系铃人”

语言模型存在位置偏见,影响复杂推理等任务。论文提出Pos2Distill框架,将模型优势位置能力迁移到劣势位置缓解偏差,设计了Pos2Distill - R1和Pos2Distill - R2,在检索和推理任务表现好且有跨任务泛化能力。

量子位
开源动态7

不可思议!400B大模型在iPhone上跑起来了

一个跑在 iPhone 17 Pro 的 A19 Pro 芯片上的 400B 大模型 Qwen3.5 - 397B - A17B 引发关注。这源于 Flash - MoE 开源项目,它摒弃现代 AI 框架,回归底层开发,实现消费级硬件上大模型交互级速度运行。

机器之心
算法论文8

SAPO:让强化学习告别“硬剪切”

强化学习是提升大语言模型推理能力的核心技术之一,但现有基于组的策略优化方法面临 token 级重要性比率高方差问题。GRPO 和 GSPO 采用硬剪切有学习信号丢失等缺点。为此提出 SAPO,用平滑门控函数替代硬剪切,实验效果良好。

通义千问Qwen
开源动态7

智谱新模型也用DeepSeek的MLA,苹果M5就能跑

智谱AI上市后发布新成果,开源轻量级大语言模型GLM-4.7-Flash,API免费开放调用。该模型是30B总参数、3B激活参数的MoE架构,定位为“本地编程与智能体助手”,评测表现佳,采用MLA架构,多平台支持。

量子位
推荐文章8

每天审200个PR、每月3000个Issue?智能体开始并行写代码,人类可能成最薄弱环节

本文是对微软 VS Code 团队工程经理 Kai Maetzel 的访谈。他回顾了 VS Code 发展历程,分享 AI 编程、智能体开发及开发者工具设计的实践思考,如 AI 补全体验优化、智能体开发权衡、与 IDE 交互机制等,还探讨了未来发展挑战与趋势。

InfoQ
新闻资讯7

Markdown要凉…卡帕西也站HTML了

Anthropic工程师Thariq发文呼吁抛弃Markdown,力推HTML,认为其在信息密度、可读性等方面优于MD。卡帕西也认可此观点。不过HTML存在费token、版本控制难等问题,文中也给出了应对建议。

量子位
新闻资讯8

黄仁勋做客美国第一播客:每天都在担心英伟达倒闭

英伟达CEO黄仁勋做客美国第一播客Joe Rogan,畅谈AI底层逻辑与技术演进,还分享英伟达创业历程。他指出AI已从检索转向推理,数据中心成“AI工厂”,并坦言每天担心公司倒闭。

量子位
算法论文8

清华AI数学家系统攻克均匀化理论难题!人机协同完成17页严谨证明

清华大学科研团队用自主研发的AI数学家系统(AIM),以人机交互模式解决均匀化理论研究问题,形成约17页证明。研究系统性总结五大高效人机交互模式,在三方面取得突破,还提出未来研究方向。

量子位