任务系统升级」共找到 4151 篇相关文章

算法论文7

思维链推理是一种脆弱的‘海市蜃楼’,一旦超出训练分布,它便会消失。| 直播预约

思维链提示能提升LLM在多任务上的表现,让人感觉模型在深思熟虑。但研究从数据分布角度剖析,发现思维链推理是脆弱的‘海市蜃楼’,超出训练分布就会消失,强调实现通用推理能力挑战大。

深度学习自然语言处理
产品应用8

GPT-5.2 发布:做表格、写 PPT、敲代码 | 打工人的生产力利器

GPT - 5.2发布,在GDPval评测等众多基准测试中刷新行业水平。GPT - 5.2 Thinking适合真实场景与专业工作,在知识型任务、编码、长上下文处理、视觉理解、工具调用等方面表现出色,部分功能需付费使用。

AI进修生
8

12月首炸!可灵 O1 正式发布,全球首个统一多模态视频大模型,强得可怕!

12月快手旗下可灵发布全球首个统一多模态视频大模型Kling O1,标志AI视频进入“全流程语义控制时代”。它将多种视频创作能力统一,有全能引擎等五大亮点,性能对比优势明显,让AI视频生成更可控。

开源星探
新闻资讯8

为什么所有企业都在谈 Agent?50+ 技术实践给出真实答案

12月19 - 20日北京举办的AICon全球人工智能开发与应用大会,聚焦AI Agent等关键方向。来自腾讯等企业的实践者将分享构建智能系统经验,大会设Keynote和12大平行技术专场,呈现AI技术全景。

PaperAgent
开源动态8

8.8K Star!真正的本地实时 Whisper 开源神器,彻底干翻云端 STT!

做实时语音转文字系统,上云端 API 贵且隐私难保障,本地跑 Whisper 延迟高。WhisperLiveKit 是专为本地流式语音识别优化的全栈方案,解决了 Whisper 痛点,有极速处理等功能,适用多类项目。

开源星探
产品应用7

卡帕西大模型横评方法太好玩了!四大AI匿名参赛评分,最强出乎意料

卡帕西发布“大模型议会”web app,系统通过OpenRouter调起多模型开会商议,各模型答题、互评、排序,由主席模型给出统一答案。可对比模型差异,模型自评与人类主观或不同,多模型集成或成突破点。

量子位
产品应用7

Gemini 3 编程第一断崖式领先,谷歌 AI Mode 直接装备 G3,反重力的 Antigravity 是啥?

今年 8 月发布的 GPT 5 未达成 AGI,Gemini 3 能力提升明显。谷歌将其塞进 Search 的 AI Mode,AI 普惠意义超能力升级。开发者方面,它是主力型号,编程能力跃升,还加强 Agent 能力并推出新工具 Antigravity。

MacTalk
产品应用8

TRAE SOLO正式版上线,我用30分钟写了一个想做了半年的网站。

字节的TRAESOLO正式版上线且限时免费。它更新不少,有新的多任务列表和SOLO Coder。作者用它做APP logo合集网站,SOLO Builder搭框架,SOLO Coder迭代开发,30分钟完成,功能完整,还介绍了价格。

数字生命卡兹克
8

AI首胜人类博士,顶会论文秒变代码!港大90后开源刷爆8k星

香港大学黄超团队开源的DeepCode,能分析论文、生成可运行代码。在四大基准测试中全面领先,首超人类专家,还优于现有AI Coding。它有三大核心能力,采用三阶段框架实现代码自动转换。

新智元
开源动态8

Kimi开源新线性注意力架构,首次超越全注意力模型,推理速度暴涨6倍

月之暗面发布开源Kimi Linear架构,用新注意力机制首次超越全注意力模型。长上下文任务中,它减少75%的KV缓存需求,推理加速达6倍。核心创新Kimi Delta Attention有细粒度遗忘门控等特点。

量子位