「全双工模型」共找到 8764 篇相关文章
Anthropic 研究发现:仅需少量污染文档即可对 LLM 实施投毒
Anthropic的Alignment Science团队研究大语言模型训练投毒攻击,实验发现仅250条恶意样本就能植入“后门”,且模型越大攻击越易,还对微调数据集实验,引发讨论。
世界模型+强化学习=具身智能性能翻倍!清华&加州伯克利最新开源
具身智能发展中样本效率成瓶颈,传统无模型强化学习依赖盲目试错。清华与加州伯克利团队提出BOOM框架,通过自举循环机制解决在线规划与策略学习矛盾,实验表现卓越,为具身智能落地提供支撑。
313页的StateofAI2025报告全解读:今年AI圈发生了什么
本文解读了313页的《State of AI 2025》报告,回顾去年预测,盘点今年AI圈大事,如DeepSeek崛起、OpenAI开源、NVIDIA循环投资等,还提及AI安全、数据使用情况,最后给出2026年10个预测并为普通人提供关注建议。
AI教父Geoffrey Hinton,全球第二个百万引用科学家!
AI教父Geoffrey Hinton论文被引数破百万,成全球第二人。其代表作如AlexNet、Deep Learning等影响深远,覆盖理论、技巧等层面,支撑大模型运行。他还称大模型是黑箱,领域待探索。
告别「利用率崩溃」:GIPO开启大模型强化学习高效训练新方法 | ICML 2026
树根科技与三一集团团队联合提出 GIPO 算法,在机器人操控及大语言/视觉动作模型强化学习训练中,缓解了策略滞后痛点,改善了 PPO 硬截断引发的‘利用率崩溃’问题。介绍了 GIPO 算法原理、优势及实验结果。
前端同事看走眼了,这个“游戏网页”其实全是AI写的!
Kimi K2.5上新,集视觉理解、代码生成等能力于一体,提供四种使用模式,其中Agent集群模式提效显著。实测显示其网页生成、动效理解能力出色,下一代K3模型或用新架构KDA降低计算成本。
编程进入「对讲机」时代!Claude抢发语音写代码,转录Token全免费
Anthropic给Claude Code加语音模式,输入 /voice,长按空格说话即可输入,转录Token全免。OpenAI的Codex也更新类似功能。语音编程在Debug、架构讨论等场景好用,但识别变量名等仍有短板,未来编程将多模态。
最新 AGI 暴论:强化学习的「GPT-3 时刻」实现,还需要 1 万年?
国外AI初创公司Mechanize三位创始人联合撰文称,RL或迎“GPT - 3时刻”,但需数千至上万年“模型处理任务所用时间”训练。还提出“复制训练”新范式,能磨炼模型能力,补足短板。
我在OpenAI修中文
OpenAI研究科学家陈博远介绍GPT Image 2官网博客花絮,分享模型训练、测试情况,还展示亲手制作的官网图片,包括中文彩蛋、漫画、杂志页等,体现模型文字渲染、视觉推理等能力。
面向长时语音与声音克隆的全模态开源万能聊天机器人MGM-Omni
文章介绍了全模态开源聊天机器人MGM - Omni,它基于MiniGemini,支持多模态输入输出,具备长语音理解、生成、流式生成、零样本语音克隆等特性,还给出安装、使用方法,展示评估结果。