「核心能力」共找到 4472 篇相关文章
谷歌开源Gemma 3n:2G内存就能跑,100亿参数内最强多模态模型
本周五凌晨,谷歌正式发布、开源全新端侧多模态大模型 Gemma 3n。它有多模态设计、专为设备端优化等特性,核心是 MatFormer 架构,还采用了 PLE 技术等,在多方面实现质量提升。
ChatGPT上瘾,大脑萎缩47%!MIT祭出206页92图超长报告
麻省理工学院完成针对ChatGPT用户的首次大脑扫描研究,发现长期依赖大模型,学习能力下降、大脑受损,神经连接减少47%。AI提高效率或为误解,使用它是用长期思维能力换短暂效率。
突发!xAI联创杨格过劳病离职,给马斯克干活压力山大
xAI联创杨格因长期高强度工作患莱姆病离职。此前已有多位核心成员离开。马斯克强调速度的管理风格使员工压力大,其公司高管更迭率高,不过也有人认为这能筛选出能力强的成员。
The Batch: 978 | DeepSeek-V4-Pro 更新了
DeepSeek发布旗舰模型DeepSeek-V4-Pro-0813正式版,性能提升,还发布开源agent harness开发者预览版并提价。模型在多指标表现佳,编码能力改进明显,公司公开基准测试框架意义大。
Huashu-Excel正式发布!可能、也许、大概是最好用的Excel数据处理和分析skill
花叔开源Huashu - Excel,它能处理Excel或CSV,按八步流程工作,有体检、对账、质控特色。经十份真实数据压测效果好,其设计激发大模型能力、避开缺陷,几乎所有agent都能用。
AI视觉创作总差点意思?中科大等综述500+篇文献,系统分析生成一致性
中国科学技术大学等多机构研究者发表综述,梳理超500篇论文,揭示扩散模型视觉内容合成“一致性危机”,介绍三类一致性关系、加强位置、评估问题,指出未来模型需具备冲突感知等能力。
为什么你的 AI Agent 总是用不起来?答案在 Skills
文章围绕AI Agent的Skills展开,介绍其范式价值,如从“单一智能”到“模块化智能”;还提及知识沉淀、跨平台能力迁移等作用,以及对人机关系、人力市场与劳动结构的影响。
米哈游蔡浩宇AI公司首个视频模型曝光了
米哈游蔡浩宇的AI公司Anuttacon首个视频模型LPM 1.0曝光。它可通过多模态形式生成动态角色,有超绝情绪演绎、实时视频生成等能力,背后技术架构复杂,目前未正式上线。
LLM 竟然会内省!Anthropic 整了个大活:首次揭开 AI 意识
Anthropic最新研究《大语言模型中涌现的内省意识》,首次通过直接操控模型内部状态验证AI能否觉察自己思想。研究采用概念注入技术,发现AI有内省能力,且不同模型表现有差异。
上科大何旭明团队新作:克服简单样本偏置,让多模态模型学会「难题优先」
上海科技大学何旭明团队针对多模态模型幻觉问题,提出DA-DPO框架。该方法不依赖额外人工标注,通过动态调整样本权重,缓解简单样本偏置,在降低幻觉率同时提升综合能力,具成本效益。