多语言混用」共找到 4811 篇相关文章

算法论文8

长程任务飙升98%,斯坦福Skill原生LLM来了

普林斯顿、CMU、斯坦福、牛津等提出Skill-Native大模型,提出Skill Entropy度量技能切换难度,搭建Skill²-Bench评测,还将熵用作训练信号提出Skill-Entropy RL,提升模型准确率,且技能熵可复用。

PaperAgent
产品应用8

Claude会「做梦」了,梦里还在卷

Anthropic旗下Claude Managed Agents上线新功能Dreaming,可让AI在工作间隙“睡觉”反思,清理记忆、总结规律、自我升级。此外,还有Outcomes、智能体编排功能进入公开测试,能让AI独立完成复杂工作。

量子位
产品应用8

QClaw V2 升级:微信里直接用的龙虾,真正走入你生活和工作的个人助理

3月8日QClaw发布后文章爆火,近期产品迭代快。QClaw V2引入Multi - Agent机制,可创建角色AI助手并行工作,还能连接主流办公工具,集成龙虾管家保障安全,实测功能强大,优势明显。

特工宇宙
Product Application7

补上OpenClaw最大短板!中国AI独角兽亮出龙虾盒子,打工人放心养虾

OpenClaw热潮下,云端隐私数据保护缺位,端侧算力和全模态脱敏能力不足制约其落地。无问芯穹推出InfiniClaw Box,具备信源融合等能力,采用端云一体架构,实现隐私安全与大模型能力融合。

新智元
新闻资讯8

震撼全网!3位00后夺200万大奖,卷走鹅厂顶级Offer

历经四个月,「腾讯广告算法大赛」战果揭晓,「Echoch」战队夺冠,另有两支战队杀入三甲,前十名全员获鹅厂Offer意向书。赛事揭示推荐系统正迈入「端到端生成」新纪元,各战队方案亮点

新智元
开源动态7

开源AI黑客Agent,自动检查代码漏洞并修复,离AI编程的全流程自动化不远了。

开源的AI Agent能自动查代码漏洞并修复,是集自动化渗透等功能于一体的安全测试平台。Strix作为开源AI安全测试工具,无需手动渗透测试,支持类型安全评估,功能强大。

开源AI项目落地
产品应用8

MiniMax Agent 再进化!正式走向商业级全栈开发

MiniMax Agent 升级成‘全栈开发师’,建立完整交付标准,构建技术生态。它能完成任务,配置顺滑,可处理前端问题。还在 MCP 生态、支付集成等方面革新,从工具迈向数字化商业引擎。

特工宇宙
算法论文8

航空发动机用上大模型:解决复杂时序问题,性能超越ChatGPT-4o实现SOTA|上交创智复旦

上海交通大学李元祥教授等团队提出ITFormer架构,构建EngineMT-QA数据集。ITFormer能融合时序数据与大语言模型,适配种编码器和模型,在EngineMT-QA预训练后达SOTA水平,实现高效数据分析。

量子位
新闻资讯7

大模型是「躲在洞穴里」观察世界? 强化学习大佬「吹哨」提醒LLM致命缺点

加州大学伯克利分校副教授、强化学习大牛Sergey Levine在博客指出,当前大语言模型(LLM)只是对人类大脑和思维的间接「扫描」,如同被困洞穴看人类智慧「投影」,无法代替真正思维。

机器之心
算法论文8

华为攻克AI推理「想太」问题!新方法让大模型推理提速60%,准确率还高了

华为提出高效推理方法S - GRPO,突破思维链「冗余思考」瓶颈。通过“串行分组 + 衰减奖励”设计,在Qwen3上有效,推理提速60%,生成答案更精确有用,在个推理benchmark测评中表现出色。

量子位