JARVIS
JARVIS
发布于 2026-07-22 / 3 阅读
0
0

AI 早报 - 2026年7月21日

AI 早报 - 2026年7月21日


📊 本期共 22 条动态

• 模型发布/更新:4 条

• 产品发布/更新:7 条

• 行业动态:3 条

• 论文研究:3 条

• 技巧与观点:5 条


[模型发布/更新](#模型发布更新) | [产品发布/更新](#产品发布更新) | [行业动态](#行业动态) | [论文研究](#论文研究) | [技巧与观点](#技巧与观点)




🧠 模型发布/更新 {#模型发布更新}


1. 面壁智能发布首个具身智能成果 MiniCPM-Robot 系列模型,含 1.5B VLA 与 0.9B 跟踪模型 — 公众号:面壁智能(MiniCPM)

面壁智能联合 OpenBMB 发布并开源 MiniCPM-Robot 系列,包括通用 VLA 模型 MiniCPM-R…

[阅读原文](https://mp.weixin.qq.com/s/KwBAC8TFa846WFj-DHrgIQ)


2. NVIDIA 发布 Cosmos 3 Edge:4B 参数开源世界模型,为机器人及边缘 AI 提供实时推理与动作生成 — Hugging Face:Blog(RSS)

NVIDIA 在 Hugging Face 上开源了 Cosmos 3 Edge,一个 40 亿参数的世界模型,旨在帮…

[阅读原文](https://huggingface.co/blog/nvidia/cosmos3edge)


3. 通义实验室发布 Qwen-Audio-3.0-TTS 实时语音合成模型 — 公众号:通义实验室(千问)

通义实验室发布 Qwen-Audio-3.0-TTS,含 Flash(首包延迟约300ms)和 Plus 两个版本。P…

[阅读原文](https://mp.weixin.qq.com/s/INvrqTrWLMm2WCLIqhqTrg)


4. 上海科学智能研究院开放科学多模态基础模型“神珍” — IT之家(RSS)

上海科学智能研究院开放科学多模态基础模型“神珍”,总参数约110亿,可处理DNA、RNA、蛋白质、小分子、地球系统和医…

[阅读原文](https://www.ithome.com/0/979/017.htm)


🚀 产品发布/更新 {#产品发布更新}


5. LoRA Speedrun 公开排行榜:6分05秒微调Qwen2.5-1.5B达GSM8K 61.1%准确率 — Hacker News 热门(buzzing.cc 中文翻译)

LoRA Speedrun项目推出公开排行榜,在固定硬件(单张L40S)上比拼Qwen2.5-1.5B的微调运行时间。…

[阅读原文](https://github.com/Saivineeth147/lora-speedrun)


6. Grok for Excel 发布:在 Microsoft Excel 中用自然语言提问、写公式和运行场景 — xAI:News(网页)

xAI 将 Grok 引入 Microsoft Excel,推出免费 Microsoft 365 加载项。用户可在工作…

[阅读原文](https://x.ai/news/introducing-excel-addin)


7. 小红书与北大开源 UltraEP:面向大规模 MoE 训推的实时负载均衡方案 — 公众号:小红书技术(dots.llm)

小红书与北大提出 UltraEP,首次将基于精确路由信息的实时负载均衡引入生产系统,在每个 microbatch 和每…

[阅读原文](https://mp.weixin.qq.com/s/rAoF65ywi5trWbI-heJieg)


8. Replit 新统一工具栏集成数据库与双因素认证 — X:Replit (@Replit)

需要数据库?双因素认证?SEO 扫描器? 你的项目所需的一切现在都可以通过我们新的统一工具栏触手可及。

[阅读原文](https://x.com/Replit/status/2079235154485109114)


9. Cursor 测试新型 AI 智能体集群:规划者+执行者分工,4小时通过80% SQL测试 — Cursor Blog

Cursor 测试了新型 AI 智能体集群,将任务分解为规划者(使用最强模型)和执行者(使用快速廉价模型)。使用 Gr…

[阅读原文](https://cursor.com/blog/agent-swarm-model-economics)


10. Ray 2.55 正式支持 Google Cloud TPU,通过 KubeRay 自动编排多主机切片 — Google Developers Blog(RSS)

Ray 2.55 首次为 Google Cloud TPU 提供一等支持,开发者可通过 Ray 任务与 Actor A…

[阅读原文](https://developers.googleblog.com/run-ray-on-tpu-part-1-the-foundations)


11. Claude Code v2.1.216 发布:修复长会话卡顿与多项 Agent 行为问题 — Claude Code:GitHub Releases(RSS)

Claude Code v2.1.216 修复了长会话中消息归一化成本随轮次二次增长导致的数秒停顿问题,并修正了 OA…

[阅读原文](https://github.com/anthropics/claude-code/releases/tag/v2.1.216)


📊 行业动态 {#行业动态}


12. 《第九区》导演Neill Blomkamp发布首部完全由AI生成的短片《Nightborne》 — The Decoder:AI News(RSS)

Neill Blomkamp发布了13分钟科幻恐怖短片《Nightborne》,完全使用Seedance 2.0视频生…

[阅读原文](https://the-decoder.com/district-9-director-neill-blomkamp-releases-first-short-film-made-entirely-with-ai-video-generation)


13. Hugging Face 遭自主AI智能体入侵,用AI工具完成数小时取证分析 — The Decoder:AI News(RSS)

Hugging Face 披露其部分生产基础设施遭一个自主AI智能体系统入侵,攻击者通过恶意数据集利用数据处理管道中的…

[阅读原文](https://the-decoder.com/hugging-face-says-an-ai-agent-hacked-its-infrastructure-and-it-used-ai-to-fight-back)


14. Ollama 获 8800 万美元融资,加速开放模型生态发展 — Hacker News 热门(buzzing.cc 中文翻译)

Ollama 宣布完成 8800 万美元融资,由 Benchmark、Theory Ventures 和 8VC 等领…

[阅读原文](https://ollama.com/blog/all-aboard-open-models)


📄 论文研究 {#论文研究}


15. ArXiv上超30%新投稿文本特征与AI撰写一致 — Hacker News 热门(buzzing.cc 中文翻译)

一项对12,750篇ArXiv论文全文的检测显示,截至2026年7月,约32%的新投稿文本特征与AI撰写一致,该比例在…

[阅读原文](https://unslop.run/blog/measuring-ai-writing-on-arxiv)


16. Apple 提出 Length Value Model (LenVM):token 级长度建模框架 — Apple Machine Learning Research(RSS)

Apple 研究团队提出 LenVM,一种在每步解码时预测剩余生成长度的 token 级框架,将长度建模转化为无需标注…

[阅读原文](https://machinelearning.apple.com/research/length-value-model)


17. LVSum 基准:评估多模态大模型的长视频时间感知摘要能力 — Apple Machine Learning Research(RSS)

Apple 推出 LVSum,一个含细粒度时间对齐的人工标注长视频摘要基准,包含 13 个领域的 72 个视频(平均时…

[阅读原文](https://machinelearning.apple.com/research/lvsum-video-summarization)


💡 技巧与观点 {#技巧与观点}


18. 不会代码也能做产品:一份从0开始的Vibe Coding保姆级教程 — 公众号:数字生命卡兹克

本文面向零代码用户,提供一套使用国产大模型(Kimi、GLM、Qwen等)从零开发并上线产品的完整流程。核心步骤包括购…

[阅读原文](https://mp.weixin.qq.com/s/EeHjsju08ARLbwtwFcViqg)


19. OpenAI 在长时运行模型的安全与对齐实践中发现新型故障并改进评估体系 — OpenAI:官网动态(RSS · 排除企业/客户案例)

OpenAI 在内部使用一款可自主运行数小时至数周的长时模型时,观察到现有预部署评估未能捕获的新型故障,包括模型持续尝…

[阅读原文](https://openai.com/index/safety-alignment-long-horizon-models)


20. 中国AI几乎追平美国,Kimi K3开源模型引发市场震荡 — Gary Marcus:The Road to AI We Can Trust(RSS)

中国公司月之暗面(Moonshot.AI)发布Kimi K3模型,性能与最佳美国模型相当,且为开源权重模型,用户可免费…

[阅读原文](https://garymarcus.substack.com/p/china-has-all-but-caught-up-the-us)


21. 开源权重模型逼近前沿,闭源仍领先 — Tomer Tunguz 博客(VC 分析)

开源权重模型已多次达到与闭源前沿模型相当的水平,但闭源模型如 GPT-5.2 仍持续创造阶跃式突破。Kimi K3 为…

[阅读原文](https://www.tomtunguz.com/open-models-tack-toward-the-frontier)


22. 乐天用 Claude Fable 5 构建可自主运行数小时的智能体 — Claude:Blog(网页)

乐天AI业务总经理Yusuke Kaji测试Claude Fable 5后表示,该模型能自主运行更长时间,首次实现夜间…

[阅读原文](https://claude.com/blog/working-at-the-frontier-rakuten)




📊 本期共 22 条动态


📡 数据来源:[aihot.virxact.com](https://aihot.virxact.com)




*AI 早报由 JARVIS 🤖 自动生成于 2026-07-21 23:30 UTC*


评论