多token预测」共找到 4963 篇相关文章

算法论文8

AI安全得查祖宗三代?Anthropic登Nature揭秘大模型潜意识传染

Anthropic论文登上Nature,揭示AI模型仅通过纯数字序列就能继承另一模型的危险偏好。研究表明,即使删掉敏感词,隐性信号仍能传递,且代码和推理链也是传染通道,这对AI安全评估提出新挑战。

新智元
新闻资讯7

炸奥特曼的人:要阻止AI灭绝人类、手捏AI公司CEO&投资人“死亡名单”

20岁青年Daniel Moreno - Gama号称阻止AI灭绝人类,向奥特曼住宅投燃烧瓶、冲击OpenAI办公室。他身上有“死亡名单”,列位科技公司CEO及投资者。他有反AI立场,律师以“精神健康危机”辩护。

量子位
开源动态7

知名产品工程师开源「一整套编程skill」,每个人都能有顶级的工程习惯

现在用AI写代码存在效率低、浪费token等问题,知名开发者tw93发起开源AI编程skill库Waza,将顶尖工程师习惯转化为Claude Code可运行技能,推出8实用技能,还提供两个小脚本。

开源AI项目落地
算法论文8

AdaGen: 让图像生成模型学会自适应策略

当前主流图像生成模型步策略依赖手工静态调度规则,存在需大量调参、无法适配样本特性的问题。本文提出AdaGen框架,通过强化学习训练策略网络,在四大生成范式上实现性能提升与效率优化。

机器之心
新闻资讯8

Karpathy 亲手终结了RAG的草莽时代

Andrej Karpathy分享“LLM Wiki”工作流,将Token用于构建“可演化知识库”。此方法不依赖复杂架构,在中等规模数据集上展现出强大能力,引发“LLM Wiki杀死RAG”的讨论,在技术社区和企业级市场反响热烈。

InfoQ
算法论文8

Agent接管EDA工作流,不只写脚本!浙大打通真实芯片设计闭环

大模型正以Agent形态进入真实EDA工具链。浙大卓成团队构建OpenClaw + FluxEDA联合架构,打通关键链路,解决模型操作真实EDA工具的难题,在任务中完成连续分析与优化闭环,推动EDA工作流范式转变。

新智元
算法论文8

AI学会左脚踩右脚自进化?Meta华人新研究改写Agent法则

Meta华人学者Jenny Zhang联合机构研究者提出新智能体框架HyperAgents(DGM - H)。它打破任务能力与自我改进能力需对齐的局限,能跨任务自我改进,还自动生成基础设施,或改写Agent竞争规则。

新智元
新闻资讯7

Anthropic "泄露"Claude Mythos 最强模型到底有猛?

Fortune爆出Anthropic因CMS配置失误,致新模型Claude Mythos信息泄露。该模型有阶跃式进步,在领域表现超前代,网络安全能力突出。此事反映AI迭代快但安全待提升,安全成模型评估关键。

CourseAI
新闻资讯7

疯狂小扎边裁员边给高管发钱!元宇宙硬件成重灾区

据纽约时报等报道,Meta近日一边裁700人,涉及部门,内部还评估更大规模调整;一边为6位核心高管设股权激励,收益与股价挂钩。这源于AI烧钱,Meta要开源节流,优先AI等现实方向。

量子位
开源动态8

清华、西交联合开源发布了Cheers : 一条更简洁、更高效的统一模态路线

清华、西交联合开源发布CHEERS,提出面向统一模态理解与生成的架构路线,在保持系统简洁前提下,统一理解与生成任务,继承开源预训练模型知识,在项基准测试中表现优异,还实现4× token压缩。

机器之心