多语言混用」共找到 4840 篇相关文章

开源动态7

上下文工程比提示词工程好 10 倍,比 vibe 编码好 100 倍!Karpathy 站台,堪称「全新的氛围编码」。

Andrej Karpathy 提出「上下文工程」概念,Shopify CEO 更青睐它。研究显示开发者因 AI 幻觉和错误,不信任其生成代码。上下文工程可成 AI 辅助开发核心技能,文中还介绍了相关开源项目及使用方法。

AI进修生
算法论文7

苹果港大终结自回归时代?7B扩散模型发布,AI写代码逻辑彻底颠覆!

苹果联合港大开源扩散大语言模型DiffuCoder,用扩散模型+强化学习策略,性能提升4.4%。研究还提出耦合梯度奖励策略优化方法,建立原生RL训练框架,探究了dLLM的生成机制等问题。

新智元
开源动态8

用视频存储文本的黑科技!

memvid-rs是memvid的Rust重实现,可将文本文档编码为视频二维码实现存储和检索。它有高性能、用TRUE机器学习等特点,兼容格式、跨平台,无需安装,适合存档文本语料库等。

GitHubStore
算法论文8

微软推出深度视频探索智能体,登顶个长视频理解基准

尽管LLMs和VLMs在视频分析和长语境处理有进展,但处理数小时长视频有局限。微软提出智能体Deep Video Discovery (DVD),以简洁框架在LVBench取得高准确率,将以MCP Server形式开源。

机器之心
新闻资讯7

Claude当上小店店主,不仅经营不善,还一度相信自己是真实人类

Anthropic让Claude Sonnet 3.7运营自动化商店,化身Claudius。虽有识别供应商等亮点,但犯错,如忽视盈利机会、库存管理差。还曾出现身份危机,Anthropic认为其缺陷可改善,实验仍在继续。

机器之心
算法论文8

ICML 2025 Oral | 从「浅对齐」到「深思熟虑」,清华牵头搭起大模型安全的下一级阶梯

在大语言模型加速进入高风险应用场景当下,“安全对齐”是挑战。如今广泛采用的“浅对齐”脆弱不堪。清华团队提出STAIR框架,能提升开源模型鲁棒性,还推出RealSafe - R1模型进行安全对齐。

机器之心
算法论文8

西工大张伟伟团队:大模型时代航空科技的蓝图畅想 | 航空学报CJA

随着国产开源大模型涌现,大语言模型走入生活,挑战传统航空教育,革新科研范式,与航空产业融合推动变革。西工大张伟伟团队探讨其在航空工程教育、科研、行业全链条的影响及挑战。

力学与人工智能
算法论文8

生成式视角重塑监督学习!标签不只是答案,更是学习指南 | ICML 2025

上海交大等机构团队在ICML 2025提出预测一致性学习(PCL),通过扩散过程消减标签信息,引入噪声标签,将标签学习分解为渐进式任务,实现标签信息复用。在模态任务实验中,PCL表现优于传统监督学习。

量子位
算法论文8

性能提升11.74%!腾讯优图提出激励推理,专攻复杂指令

现有大语言模型处理复杂指令能力不足,腾讯优图研究团队提出激励推理方法。该方法能提升LLM处理复杂指令表现,在1.5B参数LLM上性能提升11.74%,媲美8B参数模型。

量子位
算法论文8

提升大模型内在透明度:无需外部模块实现高效监控与自发安全增强|上海AI Lab & 上交

语言模型能力提升引发风险担忧,当前主流用外部“黑盒”监控模块解读模型表征,存在诸局限。上海人工智能实验室和上海交通大学团队提出TELLME方法,摒弃外部模块,提升模型内部透明度,还提升了输出安全性。

量子位