大厂推虾苗」共找到 5497 篇相关文章

产品应用7

DeepSeek接入智慧小浪,「评论罗伯特」爆梗进化!背后模型全揭秘

新浪新闻出AI辅助工具「智慧小浪」,接入DeepSeek深度思考能力,依托知微模型,能总结资讯要点、提供延伸阅读。微博「评论罗伯特」升级,更懂用户情绪、回复有深度。此外,微博还有博主AI助手等爆款应用。

新智元
算法论文8

Stanford、Meta和Google等发现LLM存在五天花板,再扩算力已无用

论文《On the Fundamental Limits of LLMs at Scale》指出,LLM性能提升有理论天花板,扩展中会遇幻觉、上下文压缩等五根本限制,源于计算、信息与学习理论,未来应转向‘有限优化’。

深度学习自然语言处理
算法论文8

揭开模型“伪遗忘”,港理工等团队:结构不变就是没忘

近年来语言模型隐私风险受关注,机器遗忘技术应运而生。港理工等团队构建表示空间诊断工具,区分‘可逆性遗忘’与‘不可逆遗忘’,揭示遗忘现象背后表示结构变化规律,还做了相关实验并得出核心结论。

量子位
开源动态8

杨立昆亲自指导开源世界模型,为AI Agent打造超级

今天凌晨,Meta开源世界模型V - JEPA 2,它用超规模数据集训练,能让AI Agent理解物理世界。图灵奖得主杨立昆参与开发并荐。模型经多方面改进,还拓展用于机器人规划和视频问答,效果良好。

AIGC开放社区
推荐文章7

装了N个skills之后,鹅员工觉得“最香”的是哪一个?

文章围绕技能使用展开,介绍鹅员工荐的各类实用技能,如腾讯文档 skill、westock - data、小区避坑神器等,还鼓励读者分享自己的宝藏 skill 或想法,关注有奖励。

腾讯技术工程
推荐文章7

对话蚂蚁吴伟:训一体池化调度,如何把GPU用到极限

AICon会前,与蚂蚁集团吴伟深度对话,探讨GPU资源调度解法。他指出CPU和GPU有结构性差异,只在理或训练内优化有资源闲置,国产卡缺全链路生态,软件优化有天花板。还分享架构思路、算法及落地效果等。

InfoQ
新闻资讯7

20美元,撕开人类思维鸿沟!宾教授警告AI隐形阶层战

教授Ethan Mollick指出,AI已成新社会基础设施,正制造人类内部分层。从免费到20美元、200美元,不同付费层级对应不同使用模式和能力,思维差异才是关键,未来需培养与AI协作的直觉。

新智元
7

拿下五角单后,OpenAI被曝开始向北约销军事化AI

刚拿下五角单,OpenAI 转头向北约销军事化 AI。其 CEO 奥特曼称要覆盖北约「所有机密网络」,后解释为「非机密网络」。Anthropic 因坚守安全红线被国防部出局,OpenAI 却拥抱军工,其「护栏工程学」难控风险。

新智元
开源动态8

微软、哈佛开源创新优化器:全面超越Muon,提升模型训练效率

随着模型训练所需计算资源爆炸式增长,微软和哈佛团队联合开源优化器Dion。它利用低秩近似和解耦动量缓冲区,避免分布式训练同步完整梯度,在集中式和分布式场景都有高效表现,性能超Muon。

AIGC开放社区
推荐文章8

百度端侧模型安全建设实践:在算力与保障之间找到平衡

在 QCon 全球软件开发会上,百度李志伟分享端侧模型安全建设实践。介绍其发展趋势、优势与应用场景,指出面临隐私、内容等安全挑战,阐述云端与端侧安全方案,通过案例展示优化效果,展望未来安全建设方向。

InfoQ