顶会研究」共找到 3145 篇相关文章

推荐文章7

RL 是新的 Fine-Tuning

今年 9 月,Thinking Machines 研究使 LoRA 重获重视。OpenPipe 创始人 Kyle Corbitt 访谈指出,多数场景微调 ROI 低,RL 将融入 agent 生命周期成主流,但 RL 落地难在环境搭建,World Model 或为关键。

海外独角兽
新闻资讯7

Meta裁员后续:田渊栋被过河拆桥,姚顺雨等集体「抢人」

Meta在人工智能部门裁减约600个职位,田渊栋团队被裁,原因众说纷纭。此次裁员或为强化Alexandr Wang核心地位,也反映Meta内部研究架构混乱。同时,引发AI公司“抢人大战”。

机器之心
算法论文8

让LLM扔块石头,它居然造了个投石机

港中大研究团队带来《Agentic Design of Compositional Machines》,推出BesiegeField平台,支持并行实验和大模型‘自我进化’。它将机械设计转为语言生成任务,通过闭环训练提升模型能力,多个模型测试表现良好。

量子位
新闻资讯7

Sora 2 即将发布?

OpenAI官方发预热推文,暗示Sora 2即将发布,众人纷纷猜测。有人认为它将超越Veo3,也有人保持冷静。此外,还爆料OpenAI正打造AI视频媒体平台,大家看法不一,有人期待,有人焦虑。

AGI Hunt
算法论文8

RLPT:腾讯混元在预训练数据上实现自主强化学习

腾讯混元团队发布RLPT,是在预训练数据上应用强化学习的方法,可突破大语言模型扩展瓶颈。它能让模型自主学习推理能力,无需人工标注,在Qwen3 - 4B - Base模型实验中性能显著提升。

AI工程化
开源动态8

Meta开源首个320亿参数代码世界模型CWM

Meta FAIR发布320亿参数的研究模型Code World Model (CWM),用“世界模拟”方式处理代码,试图真正“理解”代码逻辑。它在Math - 500数据集测试成绩亮眼,模型权重开放,可多渠道下载。

AI工程化
算法论文8

比思维链准43%!逻辑脑+大模型直觉,推理可靠性大幅提升

中德研究团队发布成果,给大模型外挂「逻辑脑」,结合答案集编程与LLM,构建神经 - 符号框架,提升空间推理准确率,让AI能说清逻辑、跨任务迁移,迈向更可靠的通用推理。

新智元
算法论文7

一个让 AI 智能体(AI Agent)工作更出色的绝妙方法,简单到令人惊讶:只要给它们设定一个人格

论文揭示无需复杂重新训练就能引导AI行为,提出MBTI-in-Thoughts框架,在提示词里让大语言模型扮演特定MBTI人格,其行为改变,还经测试验证,有广泛应用前景。

宝玉AI
产品应用8

数字生活的原生入口:蚂蚁集团发布AI眼镜全新技术框架gPass

日前,蚂蚁集团在2025 Inclusion・外滩大发布全球首个智能眼镜可信连接技术框架gPass,具备“安全、交互、连接”能力,可解决AI眼镜生态痛点,已应用于部分品牌,未来将释放更多潜能。

机器之心
产品应用7

刚刚,Claude 又杀死了所有 todo 工具

Claude 可直接操作 iOS 提醒事项,只需告知任务,它申请权限并设定日程。作者认为从现在起,所有 todo 软件都可‘去死’,Claude 将成智能日程助理,还能查看、管理提醒。

AGI Hunt