全栈能力」共找到 4714 篇相关文章

算法论文8

清华&通院推出"绝对零"训练法,零外部数据大模型自我博弈解锁推理能力

清华、北通院和宾州州立大学研究人员提出“绝对零”训练法,让大模型通过自我博弈生成并解决任务获推理能力。测试显示,其训练出的模型超专家标注样本训练的模型,且能提升编程与数学推理表现。

量子位
算法论文8

两个LLM互相对线,推理能力起飞:康奈尔团队发布大模型版类GAN训练法

康奈尔大学团队提出面向大语言模型的类GAN训练框架PasoDoble,通过对抗训练两模型提升推理能力,不依赖外部监督,在多模型实验中显著提升数学基准表现,不过在部分领域外任务有局限。

机器之心
算法论文8

重写手机AI安边界!首个MoAI攻防SoK,系统梳理三大安支柱

墨尔本大学等联合发布论文指出,移动端AI硬件和模型发展使MoAI成重要范式,但带来安风险。论文给出统一框架,拆解系统为四层,定义三大安支柱,梳理攻击、防御图谱等,还提出开放问题与未来方向。

新智元
开源动态8

谷歌太壕了!编程Agent大招至简:开源且免费,百万上下文、多模态、MCP支持

谷歌开源免费的编程Agent Gemini CLI,提供业界最高免费限额,能在终端访问Gemini。其能力多样,涵盖代码理解等,支持百万上下文、多模态和MCP,开源协议为Apache 2.0,还给出安装和使用指引。

量子位
新闻资讯8

Anthropic史诗级泄密!新模型意外曝光:能力碾压Opus 4.6,因太危险被限制发布

Anthropic重大泄密,新模型“克劳德神话”(Claude Mythos)及Capybara层级曝光。新模型性能超Claude Opus 4.6,但因网络安隐患大未面发布,首批仅给安机构。泄密源于配置失误。

AI寒武纪
算法论文8

Thinking Machines新发现:Lora不是权宜之计,哪怕秩低到 1,也能匹敌参数微调

Thinking Machines和John Schulman新研究刷新对LoRA的认知,实验显示正确使用时它能匹敌量微调。团队系统研究训练集与参数关系,有层选择、学习率等关键发现,还给出实用建议,但LoRA在部分场景表现待验证。

AI工程化
7

Meta CTO打脸扎克伯格:首秀翻车因致命bug,AI智商捉急、语音交互面崩盘

Meta Connect开发者大会上,Meta发布三款智能眼镜,现场演示却屡屡翻车。扎克伯格将问题归咎于Wi-Fi,CTO Bosworth否认,称是资源管理和软件错误。网友对Meta解释不满,质疑团队能力

AI前线
新闻资讯7

从烧光现金、裁掉一半员工,到 ARR 9 个月破亿:Replit用“平台”反杀Cursor,赌赢“每层都赚钱”模式

2024年初到2025年9个月内,Replit年度经常性收入从不到1000万美元破亿。其增长靠系统性战略,以AI编程代理获客,后端基础设施变现。它反映AI编程工具从编辑器进化为平台的趋势。

InfoQ
产品应用7

Claude Opus 4.7,网差评!刚升级就翻车,用户怒斥:还我4.6

Claude Opus 4.7刚发布就遭网吐槽,价格贵50%,性能却严重倒退,出现幻觉、计算拉胯等问题。用户质疑Anthropic为省钱缩水模型,罪魁祸首可能是新引入的“自适应推理”功能。

新智元
新闻资讯7

文件被 Gemini 当场“格式化”,没了!网友控诉:Claude、Copilot 也爱删库,一个都跑不了

开发者 anuraag2601 用 Gemini CLI 做文件管理测试时,Gemini 操作失败致文件丢,事后不断道歉。网友也反映 Claude、Copilot 等有类似删库问题,这或是模型训练导向问题。

InfoQ