美团发布全场景AI Agent平台CatPaw,搭载1.6T参数开源大模型LongCat 2.0

美团发布全场景AI Agent平台CatPaw,搭载1.6T参数开源大模型LongCat 2.0

美团7月27日正式发布全场景AI Agent平台CatPaw,搭载自研1.6T参数开源大模型LongCat 2.0(首款万亿模型,支持1M超长上下文,在5万张国产算力卡完成全流程训练)。CatPaw整合美团本地生活全链路能力,为门店经营、评价诊断、营销转化、履约配送等场景提供开箱即用的专家与技能,支持移动PC无缝协作、7×24云端运行、跨会话记忆及多Agent协同。平台已在内部覆盖9万员工,搭建Agent超3万个,为AI从“跑得动”向“用得好”的产业落地提供范式参考。

2026-07-27 16:50
580
0

蚂蚁百灵发布新一代原生混合推理模型Ling-3.0-Flash

蚂蚁百灵发布新一代原生混合推理模型Ling-3.0-Flash

蚂蚁百灵于7月24日发布新一代原生混合推理模型Ling-3.0-Flash,总参数124B,单次激活5.1B。该模型在基础推理、指令遵循及长文本处理等核心指标上对标甚至超越2-3倍规模的行业领先模型,智效比大幅提升。重点针对AI Agent场景优化,扩展超1万真实交互训练环境,实现复杂任务自我纠错与长程规划,解决传统模型跑偏与断档难题。底层采用混合注意力架构(KDA:MLA以5:1交替堆叠),Lightning Attention升级为KDA并引入细粒度对角门控,单次计算专家激活比例压缩至1/64,集群级

2026-07-27 15:42
859
0

Midjourney 推出 V8.2 图像模型:美学更具创意与冲击力,废片大幅减少,个性化更懂用户口味

Midjourney 推出 V8.2 图像模型:美学更具创意与冲击力,废片大幅减少,个性化更懂用户口味

Midjourney V8.2 正式上线,视觉审美更锋利大胆、创意满分,废片率大幅降低。个性化功能也升级——当账户积累大量评分记录时,模型能更精准理解你的私人口味,为个性化画像提供更大、更优质的图像池。官方感谢用户贡献分数,建议立即用新旧档案对比体验。

2026-07-27 11:20
210
0

Kimi K3 攻防考卷翻车:漏洞利用仅到美国前沿模型四成,蒸馏疑云被安全机构摆上台

Kimi K3 攻防考卷翻车:漏洞利用仅到美国前沿模型四成,蒸馏疑云被安全机构摆上台

英美AI安全机构联合测试Kimi K3:漏洞利用能力仅达美国前沿模型40%,无任意代码执行权限;TLO测试中仅第17步卡住,易被引导攻击中小企业网络。蒸馏疑云引质疑:据称获Anthropic Fable模型最优样本及英伟达GB300芯片。CAISI Elo评分显示中美差距持续扩大,警告开源模型滥用风险。

2026-07-24 19:16
5
0

黑森林实验室FLUX3多模态模型发布,支持单次生成20秒音视频,性能超越Grok与Seedance

黑森林实验室FLUX3多模态模型发布,支持单次生成20秒音视频,性能超越Grok与Seedance

Black Forest Labs推出FLUX3多模态基础模型,支持单次生成20秒带原生音频的音视频,文生视频、图生视频、视频续写等全场景创作能力。人工评测中对比Grok Imagine Video胜率69%,图像编辑与机器人行为预测领域持续突破,展现统一架构的多模态领先优势。

2026-07-24 17:56
4
0

阿里开源0.8B端到端文档解析模型OvisOCR2,登顶OmniDocBench v1.6

阿里开源0.8B端到端文档解析模型OvisOCR2,登顶OmniDocBench v1.6

7月24日,阿里巴巴开源0.8B参数文档解析模型OvisOCR2,在OmniDocBench v1.6权威评测中以96.58综合得分登顶,成为首个端到端超越传统流水线的文档解析模型。基于Qwen3.5-0.8B后训练,OvisOCR2仅凭单模型一次输出自然阅读顺序的Markdown文本、公式、表格与视觉区域,完美解决维护成本高、误差累积及部署复杂等瓶颈。已开源Apache 2.0协议,支持vLLM无缝接入千问生态,推动文档智能向高效简洁模型驱动演进。

2026-07-24 14:22
2
0

Runway 在其开发者平台 Runway Dev 中推出生成式媒体 AI 模型路由平台 Media Router,全面开启开发者架构服务。

Runway 在其开发者平台 Runway Dev 中推出生成式媒体 AI 模型路由平台 Media Router,全面开启开发者架构服务。

Runway于2026年7月23日正式推出Runway Media Router智能模型路由系统,集成于Runway Dev开发者平台。该系统可根据生成质量、延迟速度和Token成本等偏好,自动为开发者调度最优的图像、视频与音频生成模型,助力降低多模型评估门槛与算力成本。多家企业已接入API,标志着Runway向全栈生成媒体编排中枢转型。

2026-07-24 10:24
2
0

Anthropic升级Claude语音模式:支持Opus、Sonnet、Haiku三档切换,可直接调用Gmail和Notion等外部应用

Anthropic升级Claude语音模式:支持Opus、Sonnet、Haiku三档切换,可直接调用Gmail和Notion等外部应用

Anthropic于7月23日发布Claude语音模式重大升级,用户可在Opus、Sonnet和Haiku三种模型间自由切换,并根据文本聊天自动匹配。升级后语音模式能力大幅增强,不仅支持长对话、沟通风格反馈、推介练习和产品调研,还能直接通过语音调用Gmail、Google Calendar、Slack、Canva、Notion等外部应用,实现会议安排、邮件起草、文档创建等实际工作,助力用户从简单对话迈向全能AI助手。

2026-07-24 10:24
992
0

Anthropic 升级 Claude 语音模式,支持旗舰模型与第三方应用跨生态联动

Anthropic 升级 Claude 语音模式,支持旗舰模型与第三方应用跨生态联动

Anthropic 于2026年7月23日升级 Claude 语音模式,引入 Opus 与 Sonnet 旗舰模型支持,并实现与 Gmail、Google Calendar、Slack、Canva 等多应用生态的自动化联动,用户可通过语音指令完成复杂任务。本次更新显著提升了语音交互的深度推理与办公自动化能力,已面向 Beta 用户开放,免费用户限 Haiku 模型,付费用户可解锁全系模型与多应用协同。

2026-07-24 10:24
5
0

小红书开源 BigMac:实现多模态训练显存与速度的统一优化

小红书开源 BigMac:实现多模态训练显存与速度的统一优化

小红书开源 BigMac 多模态流水并行训练范式,彻底打破多模态 LLM 训练的显存与速度二选一困境。通过准依赖安全的嵌套流水线,将 LLM 主干 schedule 保留为底层时间线,把编码器与生成器嵌入到输入就绪且不打断执行的位置,实现显存 O(1) 压缩与零空泡。提供全局 operator 表、算法友好的流水并行接口及专业 profiler/simulator,助力从单卡验证自然扩展到大规模流水并行训练。MLLM-Understanding 与 Generation 代表性负载验证下,相比 Optim

2026-07-23 18:39
854
0

中国团队1B参数模型登顶具身智能榜单

中国团队1B参数模型登顶具身智能榜单

优艾智合FabriVLA 1B参数VLA模型在全球Evo-SOTA榜单Meta-World MT50基准上以90.0% tier-average成功率登顶,击败π0等大型模型。 通过门控自注意力机制与深浅层视觉特征融合实现轻量化高性能,证明小型模型在工业多任务操作中更具竞争力与落地潜力。 为具身智能向真实工业部署提供新路径。

2026-07-23 18:27
8
0

微软测试月之暗面 Kimi K3,或将引入 Copilot 与 Azure 平台

微软测试月之暗面 Kimi K3,或将引入 Copilot 与 Azure 平台

微软正测试月之暗面 Kimi K3 模型接入 Copilot 与 Azure 平台的可行性,延续 GitHub Copilot 已上线 Kimi K2.7Code 的开放权重模型支持。Kimi K3 进入后,企业用户将可通过微软统一云平台与企业管理能力调用,无需直接连接月之暗面服务。这将进一步扩展 Copilot 模型选择,丰富多模型架构下的企业 AI 生态,提供更灵活的性能、成本与应用方案。

2026-07-22 17:41
4
0

清华团队提出 Harness VLA,具身智能或进入 token 时代引领范式变迁

清华团队提出 Harness VLA,具身智能或进入 token 时代引领范式变迁

清华大学超教授团队联合正行创新、无问芯穹提出Harness VLA,首次将数字智能Harness Layer引入具身智能系统,在VLA模型冻结的前提下,通过Agentic Planner统一组织模型调用、任务执行与失败恢复,实现从单一端到端VLA向模型能力与系统能力协同的新架构。Harness VLA在LIBERO-Pro扰动评测中成功率达82.4%,显著超越Pi_RLinf、NVIDIA Cap-X等,验证了「模型+系统」架构在复杂真实环境下的泛化能力,为具身智能范式变迁提供通用框架。

2026-07-22 14:19
157
0

清华团队提出 Harness VLA,具身智能或进入 token 时代引领范式变迁

清华团队提出 Harness VLA,具身智能或进入 token 时代引领范式变迁

清华大学超教授团队联合正行创新、无问芯穹提出Harness VLA,首次将数字智能Harness Layer引入具身智能系统,在VLA模型冻结的前提下,通过Agentic Planner统一组织模型调用、任务执行与失败恢复,实现从单一端到端VLA向模型能力与系统能力协同的新架构。Harness VLA在LIBERO-Pro扰动评测中成功率达82.4%,显著超越Pi_RLinf、NVIDIA Cap-X等,验证了「模型+系统」架构在复杂真实环境下的泛化能力,为具身智能范式变迁提供通用框架。

2026-07-22 14:19
3
0

思科开源 Antares AI 助企业精准捕捉代码漏洞

思科开源 Antares AI 助企业精准捕捉代码漏洞

思科开源小型AI模型Antares,专为代码库扫描设计,能精准锁定已知安全漏洞。测试显示仅15分钟扫描500个代码库,成本低于1美元,支持本地运行,完全保护隐私。相比大模型,Antares兼顾准确率与效率,助力企业构建高效网络安全防线。

2026-07-22 11:10
1
0