「多任务操作」共找到 5620 篇相关文章
Gemini 3 Flash 发布,多、快、好、省,Coding 能力不输大哥Gemini 3 Pro
Google DeepMind 发布 Gemini 3 Flash,成本极低。它在多项测试表现出色,速度快、效率高,代码能力超 Gemini 3 Pro,获企业客户好评,今日起向全球开发者和普通用户推送。
Transformer学不会多位数乘法?MIT和哈佛的研究指出了一个简单漏洞
MIT、哈佛和谷歌DeepMind团队实验发现,Transformer做4位数乘法有软肋。用‘隐式思维链’(ICoT)训练的模型准确率达100%,传统方法仅1%。研究揭示了问题根源,还给出修复方案,但也引发诸多质疑。
Claude Sonnet 4.5来了!能连续编程30多小时、1.1万行代码
十一假期前,DeepSeek 开源新模型 V3.2 - Exp,深夜 Anthropic 发布 Claude Sonnet 4.5,自称世界最好编码模型,自主编码时长超 30 小时,还带来系列产品升级,在多方面表现优异。
双手取货+漂移搬运,WRC明星机器人告诉大家:什么是高级操作|甲子光年
去年90后创业者王鹤提出具身智能产品化思路,一年后银河通用在零售和工业找到业务切口。2025 WRC上其Galbot机器人表现亮眼,会前还发布银河太空舱,开启‘十城百店’计划,以务实方式推动人形机器人商业化。
在OpenAI上班有多卷?离职员工爆料:7周打造Codex,每天熬到凌晨
OpenAI前员工Calvin French - Owen离职后在博客分享工作经历。他介绍了OpenAI内部沟通、晋升机制、战略调整等情况,还讲述Codex 7周开发发布过程,最后分享离职收获并建议创业者反思或加入顶级实验室。
ICML 2025 | 清华、上海AI Lab等提出傅里叶位置编码,多项任务远超RoPE
长文本能力对语言模型重要,但现有模型训练窗长有限,流行的RoPE也有局限。清华、上海AI Lab团队用傅里叶分析解读其不足,提出傅里叶位置编码FoPE,提升长文本泛化能力,实验表现超RoPE。
20%的美国打工人把活儿甩给AI!被替代的是任务,不是岗位
8月6日,Epoch AI联合Ipsos发布职场调查报告,20%美国就业者将工作甩给AI,表明活儿在人和AI间重新分配。AI参与广但不深入,用时情况不一,输出多需修改,先冲击外包工作,且使用不均衡。
让大模型学会「心灵感应」:基于思维沟通的多智能体合作范式来了
NeurIPS 2025的论文提出思维沟通概念,建立潜在思维可识别性理论,构建ThoughtComm框架。该框架让模型共享潜在思维,跳过语言冗余歧义,实验显示其提升了协作效率与推理能力,或开启新智能形态。
又多了一个哄孩子AI神器,一张破涂鸦竟能秒变迪士尼动画
年轻父母有了哄娃新法子,用AI可将涂鸦变动画。博主用Midjourney将妈妈30年前涂鸦做成动画,还给出提示词框架。介绍即梦、可灵、谷歌Veo3等工具,它们能快速生成音视频,各有优劣。还提到Meta的Animated Drawings玩法。
免剪辑直出!AI生成多角色同框对话视频,动态路由精准绑定音频
Bind-Your-Avatar基于扩散Transformer框架,通过细粒度嵌入路由将语音与角色绑定,实现精准音画同步,还引入数据集MTCC和基准测试,实验显示其在身份保真和音画同步上优于现有方法。