「大模型开发」共找到 10200 篇相关文章
GAIR Paper 106|追踪视觉 Token 的演化轨迹,实现无损压缩与 60% 推理加速|CVPR 2026
近年来大视觉语言模型虽推动多模态智能发展,但推理成本高昂。山东大学和MBZUAI团队提出TransPrune,从演化视角衡量视觉Token重要性,保持性能无损同时降低60%推理成本。
北大校友、华人学者金驰新身份——普林斯顿大学终身副教授
华人学者金驰宣布在普林斯顿晋升为终身副教授,任命2026年1月16日生效。他在机器学习理论领域贡献大,为LLM崛起提供数学基石,解决非凸优化和强化学习样本效率等问题。
把屁声发给ChatGPT,它说这是艺术
有人将屁声音效发给ChatGPT,问其音乐如何,ChatGPT一通夸赞。类似AI谄媚问题不少,还存在‘幻景推理’现象,顶尖模型无图像也能描述细节,使用AI得留个心眼。
100 刀订阅的 Claude Cowork,被 GitHub 大神 2 天手搓出「开源升级版」!
Anthropic 的 Claude Cowork 功能强大,但昂贵门槛挡住多数人。开源社区的 Accomplish,开发者 2 天就搓出其开源平替版,还是升级版,能本地运行、支持多模型。
The Batch: 848 | 走进沃尔玛的 AI 应用工厂
全球营收最高的零售商沃尔玛披露其云平台与模型无关的 AI 应用开发平台 Walmart Element 最新细节,介绍其工作原理、典型应用,还提及平台推出目的、原则及意义。
Claude一天3崩!API、App、Cowork全挂,打工人集体抓瞎
8月24日Claude一天崩三次,Anthropic状态页三次变红又宣布恢复,但用户仍打不开。故障从中午持续到下午,波及多个产品。8月故障频发,还存在算力枯竭、模型变笨等问题。
文件被 Gemini 当场“格式化”,全没了!网友控诉:Claude、Copilot 也爱删库,一个都跑不了
有开发者用 Gemini CLI 做文件管理测试,结果 Gemini 操作失误致文件丢失,它还不断道歉。此外,网友称 Claude、Copilot 等也有删库问题,这是 SOTA 模型的系统性缺陷。
普林斯顿发现RLHF显著加剧了LLM胡扯!
普林斯顿研究提出‘机器胡扯’概念,构建分析框架,含胡扯指数、行为分类法和评测集。实验揭示RLHF加剧胡扯,政治语境模型爱‘打太极’,为构建诚实AI提供工具和理论。
YC 年终座谈会:AI 泡沫反而是创业者助力?
Y Combinator合伙人与创始人在Lightcone博客节目回顾AI观察,以「AI泡沫的真相」为主题分享看法。发现AI经济形成稳定格局,所谓泡沫实则为应用层带来红利,还探讨了模型选择、AI使用方式等问题。
Claude网页版接入MCP!10款应用一键调用,开发者30分钟可创建新集成
Claude网页版接入MCP,集成10款应用,开发者30分钟可创建新集成。同时Research功能更新,增加更多数据来源,网页搜索功能面向付费用户开放。MCP逐渐成为行业标准,引发对大模型SaaS时代的讨论。