「小实验」共找到 2218 篇相关文章
30天狂刷60万亿Token,光“榜一”就烧掉140万美元!Meta员工搞出“AI Token排行榜”,结果小扎连前250都进不了?
Meta员工开发“Claudeonomics”仪表盘统计员工AI Token使用量,引发“Tokenmaxxing”风潮,上线两天因数据“外泄”下线。30天内全公司Token使用超60万亿,“榜一”花超140万美元,扎克伯格未进前250。
0.5B以小搏大拿下端侧模型新SOTA:4090可跑,长文本处理5倍常规加速丨清华&面壁开源
清华大学和面壁智能团队开源MiniCPM 4,有8B、0.5B两种参数规模,以22%训练开销达同级别最优。它在架构、推理、数据、训练多方面创新,性能领先,适用于综述生成、工具调用等场景。
最新豆包、deepseek、元宝、夸克、千问、百度、文心、Kimi、微信搜一搜、抖音、小红书等AI搜索生成内容引用来自哪些地方?【干货】
作者白杨SEO指出,生成式人工智能发展快,AI搜索优化GEO受关注。介绍了豆包、DeepSeek等多个AI搜索生成内容引用来源,如豆包引用抖音、头条等,DeepSeek用开源数据等,还提及各平台优化要点。
用75亿募投资金理财?摩尔线程:合理提高资金收益;豆包手机“可查询银行卡余额”?官方辟谣侵犯用户隐私;小扎宣告元宇宙死亡|Q资讯
本文汇总 AI 行业近期热点,有摩尔线程拟用 75 亿闲置募资理财,Meta 砍元宇宙投入转 AI,豆包手机回应隐私质疑,宇树推人形机器人应用商店等,还涉及阿里、腾讯等大厂动态及 IT 业界消息。
吴恩达推出LLM 后训练免费课程,覆盖三大调优方法:SFT、DPO、RL
吴恩达发布「Post-training of LLMs」课程,由Banghua Zhu主讲,瞄准实用技术,重点介绍SFT、DPO、RL三种后训练方法,有大量动手实验,课程发布后引发热烈讨论。
智能体自己出现问题自己找!首次提出“自动化失败归因”课题 | ICML2025 Spotlight
LLM Multi - Agent系统失败诊断难,阻碍迭代优化。宾夕法尼亚州立大学等机构研究者首次提出“自动化失败归因”课题,构建Who&When数据集,开发评估多种归因方法,实验揭示当前方法不足。
演讲生成黑科技,PresentAgent从文本到演讲视频
联合团队提出 PresentAgent,能将长篇文档转化为带解说演示视频。采用模块化流程,还引入 PresentEval 评估框架。实验显示其接近人类表现,优于现有方案,展现了多模态智能体潜力。
从视觉压缩,到视觉记忆:MonkeyOCRv2以重建保留文档页面证据
文档视觉编码器对LLM理解和推理很重要。MonkeyOCRv2提出‘重建即文档视觉记忆’,通过多组实验验证其有效性,还发布MonkeyDoc v2数据集,推动公平比较的研究文化。
ICML 2026 |让大模型边想边说:这篇文章把「何时开口」变成可学习策略
论文《When to Think, When to Speak: Learning Disclosure Policies for LLM Reasoning》针对推理模型的‘沉默税’问题,提出Side - by - Side(SxS)Interleaved Reasoning,将‘何时披露内容’变为可学习决策,经实验验证效果良好。
让LLM互相“审稿”:简单的LLM Collaboration/Ensemble方法实现7%性能提升
文章提出LLM-PeerReview方法,受学术同行评审启发,含评分、推理、选择模块。采用‘翻转三元评分技术’减少偏差,实验显示该方法超单一LLM及LLM Ensemble基线,性能提升显著。