新功能实现」共找到 6252 篇相关文章

算法论文8

Meta&CMU:Token级LLM协同路由范式

Meta AI、CMU等联合推出FusionRoute,是让多个大模型在token级协作的范式。它能在每个token位置精准选专家,自带“急救包”。经实验验证其高效,也指出了待研究的方向。

PaperAgent
新闻资讯7

Anthropic 研究员:强化学习将推动 Transformer 实现 AGI

在 AI Agenda Live 纽约活动上,Anthropic 强化学习团队技术负责人 Sholto Douglas 称,无需架构突破,强化学习能让 Transformer 达人类专家级别表现,接近 AGI。但定义「好表现」是难题,Anthropic 或投 10 亿美元提升模型企业应用表现。

AGI Hunt
新闻资讯8

OpenAI 终于意识到,单靠微软,实现不了AGI

11月3日,OpenAI与亚马逊云科技达成约380亿美元合作。此前其与微软关系生变,协议降低微软持股、取消优先购买权。OpenAI预计需1.4万亿美元构建计算设施,重组后或2026年上市。

InfoQ
开源动态8

刚刚,Kimi开源架构,开始押注线性注意力

智能体时代推理计算需求成瓶颈,线性注意力可降复杂度但表达有限。月之暗面开源 Kimi Linear 架构,结合线性与全注意力,性能和硬件效率出色,引发对线性与全注意力发展方向的思考。

机器之心
开源动态7

Qwen3又又又发布了模型~~~

Qwen3团队继发布`Qwen3-235B-A22B-Instruct-2507`和`wen3-235B-A22B-Thinking-2507`后,又发布`Qwen3-Coder-30B-A3B-Instruct`。该简化模型性能和效率出色,有多项关键增强功能,且是非思考模型,输出效率高。

CourseAI
新闻资讯8

刚刚,扎克伯格宣布成立Meta超级智能实验室

Meta宣布进入超级智能赛道,扎克伯格成立Meta超级智能实验室,任命前Scale AI CEO为首席AI官。MSL整合多团队,Meta还投资Scale AI,为抢人才不惜重金,团队成员来自顶尖实验室,Meta有独特优势。

AGI Hunt
产品应用7

我用给DeepSeek 加了个搜索功能

作者为弥补DeepSeek无搜索聊天记录功能的不足,用Claude Code做了个插件。介绍了使用说明,还提及各LLM模型适用场景,称DeepSeek重模型智能,少营销但用户体验有折扣。此外,作者还用AI采集资讯发群。

AGI Hunt
算法论文8

大模型训练突破!Meta提出LSP:无数据也能实现能力飞升

Meta提出语言自我博弈(LSP)方法,利用自我博弈框架让模型自我改进,不依赖额外数据。LSP赋予模型挑战者和解题者身份,引入GRPO和KL散度正则化技术,解决了大模型训练的数据依赖难题。

新智元
开源动态8

腾讯开源智能体框架:不用训练无需充值,用开源模型实现SOTA Agent

智能体框架是推动智能体生态发展的基础设施,但现有框架存在上手门槛高、依赖闭源模型等问题。腾讯优图实验室开源Youtu - agent框架,无需训练模型、不依赖闭源API,性能领先,有多个核心亮点和典型应用案例。

量子位
开源动态8

社区供稿 | VibeVoice实现90分钟、多角色播客生成,拓展语音合成边界

微软亚洲研究院提出全语音生成模型 VibeVoice,采用 next - token diffusion 机制,能将文字脚本转为最长 90 分钟、最多 4 人对话的高质量播客音频,在多方面有显著优势,未来潜力大。

Hugging Face