<?xml version="1.0" encoding="utf-8"?>
<rss version="2.0"
xmlns:dc="http://purl.org/dc/elements/1.1/"
xmlns:atom="http://www.w3.org/2005/Atom"
>
<channel>
<title><![CDATA[Hello World]]></title> 
<atom:link href="https://www.flying6.eu.org/rss.php" rel="self" type="application/rss+xml" />
<description><![CDATA[]]></description>
<link>https://www.flying6.eu.org/</link>
<language>zh-cn</language>

<item>
    <title>MiniMax H3开源部署实测：8G显存流畅运行，越狱模型同步放出（附教程）</title>
    <link>https://www.flying6.eu.org/?post=4</link>
    <description><![CDATA[<p>玩过太多开源视频模型，最后大多被删。要么模型太大跑不动，要么画质崩坏、音画分离。但这次MiniMax开源的H3，确实让我看到了不一样的希望——它可能是我用过可控性最强的AI视频模型。</p>
<p>最惊艳的不是画质，而是它把文本、图像、视频、音频、角色参考、镜头运动、语音克隆全部塞进同一套工作流。广告片、MV、品牌素材、游戏过场动画，这种控制精度，真的往前跨了一大步。</p>
<p>一、H3到底是什么？<br />
H3是MiniMax在8月3日正式开源的全模态生成系统，不是单纯的“文生视频”模型。它能统一理解由文本、图像、视频、音频构成的多模态上下文，直接生成带原生立体声的视频。</p>
<p>核心能力一览：</p>
<p>输出规格：4-15秒，最高2K分辨率</p>
<p>音频特性：视频音频同步生成，32kHz立体声，非后期配音</p>
<p>多语言支持：中、英、日、韩、法等11种语言口型与语音</p>
<p>行业排名：Artificial Analysis榜单视频编辑能力全球第一，文生视频/图生视频分列第二、第三</p>
<p>架构升级：基于H3-Context-IR，与Hailuo 01/02完全不同</p>
<p>关键亮点：越狱版已放出，相比官方版更自由，内容限制更少。</p>
<p>二、显存门槛实测：8G到底能不能跑？<br />
网上“8G显存也能跑”的说法满天飞，我把公开实测数据整理如下：</p>
<p>配置方案    实测表现<br />
稳定跑通配置  12G显存 + 32G内存 + NVMe固态，5秒480p视频，20步，约5分钟<br />
官方未量化验证 双卡各32G显存（合计64G）+ 384G内存，5秒1344×768视频，50步，约9.3分钟<br />
为什么12G显存能跑40多G的模型？ ComfyUI采用按层动态调度——需要哪一层就搬进显存，其余留在内存/硬盘。显存不够不会直接报错，只是变慢。</p>
<p>8G显存用户建议：</p>
<p>系统内存：32GB起步</p>
<p>硬盘：必须NVMe固态</p>
<p>起步设置：480p、20步、5秒开始试，别直接冲720p</p>
<p>量化选择：Q3或混合精度Q2版本，低量化对画质有损</p>
<p>三、部署实战指南<br />
第一步：升级ComfyUI（跳过全是坑）<br />
H3需要ComfyUI 0.27或更高版本，老版本没有对应原生节点。</p>
<p><a href="https://comfy.org/" title="ComfyUI最新版下载">ComfyUI最新版下载</a></p>
<p>整合包用户用启动器“更新”功能升级，启动后在右下角确认版本号</p>
<p>第二步：选择模型<br />
模板中心提供三种H3开源模型：文生视频、图生视频、视频转视频。</p>
<p>建议：分辨率先设小一点，生成后再用高清放大工具提升到1080p/2K/4K。</p>
<p>视频高清放大工具： 【<a href="https://pan.quark.cn/s/c47e461d094b#/list/share" title="网盘下载">网盘下载</a> 】或【备用下载】<br />
MiniMax H3开源部署实测：8G显存流畅运行，越狱模型同步放出（附教程）</p>
<p>第三步：获取越狱模型<br />
MiniMax H3开源部署实测：8G显存流畅运行，越狱模型同步放出（附教程）</p>
<p><a href="https://git.cloudeop.com/repo.php?id=afff7d33" title="Hugging Face下载">Hugging Face下载</a></p>
<p><a href="https://git.cloudeop.com/repo.php?id=afff7d33" title="备用整合包下载">备用整合包下载</a></p>
<p>版本选择：BF16满血版47.97G对显存要求高，家用消费级显卡建议选24.55G的量化版，实测效果也不错。</p>
<p>第四步：越狱模型工作流<br />
越狱工作流：【<a href="https://pan.quark.cn/s/72e594594337#/list/share" title="点击下载">点击下载</a>】或 【<a href="https://pan.cloudeop.com/s/770F7A4129739540" title="备用下载">备用下载</a>】</p>
<p>模型文件放置目录：</p>
<p>类型  文件  放置目录<br />
主模型 MiniMax-H3-FL2VA-Q4_K_M.gguf（按显存选量化）    models/unet/<br />
文本编码器   qwen3vl_32b_minimax_h3_Q4_K_M.gguf  models/text_encoders/<br />
视频VAE   minimax_h3_video_vae_fp16.safetensors   models/vae/<br />
音频VAE   minimax_h3_audio_vae_fp32.safetensors   models/vae/<br />
量化版本选择建议：</p>
<p>24G及以上：Q8或官方INT8/NVFP4</p>
<p>16G：Q5或Q4</p>
<p>12G：Q4</p>
<p>8G：Q3或混合精度Q2</p>
<p>特别提醒：音频VAE必须用fp32版本，fp16会导致音画不同步或无声。</p>
<p>官方原生路线补充：模型权重需同时放在models/MiniMax-H3/（单文件）和models/diffusers/MiniMax-H3/（分片版含config.json）两个目录，缺一都会报错。</p>
<p>第五步：加载工作流<br />
GGUF路线：将附带的工作流JSON拖入ComfyUI界面即可。<br />
官方原生路线：ComfyUI模板浏览器内置H3官方工作流。</p>
<p>加载后检查要点：</p>
<p>Unet Loader (GGUF)：选主模型</p>
<p>CLIP Loader (GGUF)：选qwen3vl文本编码器</p>
<p>VAE Loader：视频VAE和音频VAE分别对应，别接反</p>
<p>分辨率/帧数：首次建议480p、5秒</p>
<p>节点全部变绿即可生成。</p>
<p>第六步：首次生成<br />
第一次会慢（8-15分钟），因为要从硬盘加载权重。第二次开始快很多，部分权重已缓存在内存。</p>
<p>四、实测技巧：怎么把片子拍好看？<br />
提示词要写“分镜”，不要写“标签”<br />
H3吃完整场景描述+镜头调度，而不是关键词堆砌。</p>
<p>❌ 错误写法：</p>
<p>一个女人，咖啡馆，下雨，电影感，8k，高质量</p>
<p>✅ 正确写法：</p>
<p>黄昏的咖啡馆靠窗位置，窗外下着小雨。一位穿米色针织衫的女性正低头搅拌咖啡，镜头从她的手部特写缓慢上摇至面部，她抬头看向窗外，嘴角微微上扬。暖色调室内灯光，窗外冷色调环境光形成对比。背景音：雨声、咖啡杯轻碰声、隐约的爵士乐。</p>
<p>关键差异：把画面、动作、镜头运动、光线、声音全部交代清楚。你不写声音，模型就自己猜，猜出来多半不是你要的。</p>
<p>镜头运动直接用术语<br />
推、拉、摇、移、跟、升降——这些术语H3都认。英文的dolly in、pan left、crane shot、handheld也支持。</p>
<p>角色一致性靠Ref2VA<br />
这是H3最实用的功能。通过Ref2VA分区，喂入同一角色多张参考图（最多9张，建议3-5张不同角度）配语音参考，就能实现跨镜头同一个人、同一个声音的连续片段。</p>
<p>实测经验：参考图质量比数量重要。5张清晰正侧面照，效果远好于9张糊图。</p>
<p>15秒不够用怎么办？<br />
首尾帧接力法：第一段最后一帧导出，作为第二段首帧输入，配合Ref2VA锁角色，做出连贯多镜头。社区已有人做出30秒三镜头、人物声音全程一致的成片。</p>
<p>五、常见问题排查<br />
问题  解决方案<br />
报错找不到节点 ComfyUI版本太老，或没装ComfyUI-GGUF<br />
爆显存崩溃   换更低量化版本，启动参数加--lowvram<br />
生成没声音   检查音频VAE是否误用fp16版本，必须用fp32<br />
音画不同步   视频VAE和音频VAE接反了，检查连线<br />
速度极慢    确认模型在固态硬盘上；检查系统内存是否充足<br />
画面崩坏/人物变形   量化太狠（Q2/Q3），画质损伤不可逆，需加显存或降分辨率<br />
六、关于社区改版权重的风险提醒<br />
网上已有各种二次修改的H3权重流传，这里必须提醒三点：</p>
<p>安全风险：来源不明的权重可能夹带恶意内容，尤其是非safetensors格式。下载前务必确认发布者、核对文件哈希，别在主力机上随意加载。</p>
<p>法律风险：H3的角色参考+语音克隆组合，法律边界很近。用真人脸和声音生成内容，在澳洲、欧盟、美国多州及国内都有明确法规约束。肖像权和声音权独立受保护。</p>
<p>平台风险：相关内容在YouTube、B站轻则限流，重则封号。对内容创作者来说，代价不值得。</p>
<p>建议：把精力花在提示词和分镜设计上，那才是真正拉开差距的地方。</p>
<p>七、总结<br />
H3开源的意义，不在于“多了一个能跑的模型”，而是开源视频模型第一次在可控性上追平了闭源产品。</p>
<p>音画同步生成、角色跨镜头一致、镜头语言可控、11种语言口型——这些半年前还是闭源产品的1. 护城河，现在权重就在你硬盘里。</p>
<p>配置门槛：12G显存是舒服的起点，8G能跑但需要耐心。考虑到开源才第一周，量化方案和推理优化的迭代速度一向很快，未来可期。</p>
<p>想玩的现在就可以动手了。有问题欢迎评论区交流，我看到都会回。</p>
<p>视频教程：<a href="https://www.youtube.com/watch?v=UXEjocWEfiM">https://www.youtube.com/watch?v=UXEjocWEfiM</a></p>]]></description>
    <pubDate>Sun, 16 Aug 2026 18:53:17 +0800</pubDate>
    <dc:creator>🔔小小站长</dc:creator>
    <guid>https://www.flying6.eu.org/?post=4</guid>
</item>
<item>
    <title>免费 Grok 4.5 正式发布！编码能力极强，支持 Grok Build 和 Cursor，附使用教程！</title>
    <link>https://www.flying6.eu.org/?post=3</link>
    <description><![CDATA[<p>免费 Grok 4.5 正式发布！编码能力极强，支持 Grok Build 和 Cursor，附使用教程！<br />
就在前两天，xAI 正式发布了 Grok 4.5，这是目前 xAI 推出的最强 AI 模型，也是 Grok 系列一次重要升级。</p>
<p>更重要的是，目前已经限时免费开放体验，只需要拥有任何 X（Twitter）账户 或 SuperGrok 账户，即可使用 Grok Build 体验 Grok 4.5。</p>
<p>Grok 4.5：xAI 目前最强大的 AI 模型<br />
根据 xAI 官方介绍，Grok 4.5 是目前性能最强的 Grok 模型，专门针对以下场景进行了优化：</p>
<p>软件开发与编程<br />
智能 Agent<br />
科学研究<br />
工程计算<br />
数学推理<br />
知识工作<br />
免费 Grok 4.5 正式发布！编码能力极强，支持 Grok Build 和 Cursor，附使用教程！<br />
多项编程基准测试成绩亮眼<br />
Grok 4.5 在多个国际编程基准测试中取得了非常优秀的成绩。</p>
<p>DeepSWE 1.0<br />
在 DeepSWE 1.0 基准测试中，Grok 4.5 获得 62% 的成绩，仅次于：</p>
<p>Claude Fable Max<br />
OpenAI GPT-5.5 XHigh<br />
这一成绩已经超过了目前大多数主流大语言模型。</p>
<p>SWE Marathon<br />
在 SWE Marathon（软件工程马拉松）测试中，Grok 4.5 取得了 29% 的准确率，并成功排名第一。</p>
<p>超过了包括：</p>
<p>Claude Opus 4.8 Max<br />
Claude Fable Max<br />
成为目前该排行榜上的最佳模型。</p>
<p>Terminal Bench 2.1<br />
在 Terminal Bench 2.1 测试中：</p>
<p>Grok 4.5：83.3%</p>
<p>排名第三。</p>
<p>SWE Bench Pro<br />
在 SWE Bench Pro 中：</p>
<p>Grok 4.5：64.7%</p>
<p>同样位居第三。</p>
<p>以上数据均来自各模型官方公布的系统配置卡（System Card）或公开基准测试排行榜。</p>
<p>数万块 NVIDIA GB300 GPU 完成训练<br />
xAI 官方透露：</p>
<p>Grok 4.5 是在数万块 NVIDIA GB300 GPU 上完成训练。</p>
<ul>
<li>AD -<br />
整个训练过程不仅扩大了 Token 数量，还重点优化了数据质量。</li>
</ul>
<p>包括：</p>
<p>数据去重（Deduplication）<br />
数据质量评分<br />
基于领域的数据筛选<br />
高覆盖率的数据混合<br />
官方表示，他们投入了大量资源用于数据过滤与整理，而不仅仅是一味增加训练数据规模，从而保证训练数据具有更高质量和更高信号密度。</p>
<p>强化学习再次升级<br />
除了预训练外，Grok 4.5 进一步扩大了强化学习（Reinforcement Learning）的规模。</p>
<p>强化学习阶段覆盖了数十万个任务，重点围绕：</p>
<p>多步骤软件工程<br />
Agent 工作流<br />
技术推理<br />
自动评分<br />
模型自我反馈<br />
整个训练平台采用高度异步架构设计。</p>
<p>因此：</p>
<p>Agent 可以持续运行数小时<br />
数万个 GPU 可持续进行强化学习训练<br />
最终提升了模型在真实工程任务中的推理效率和执行能力。</p>
<p>编码能力非常强<br />
官方特别强调，Grok 4.5 的编码能力覆盖从简单脚本到大型项目开发。</p>
<p>支持：</p>
<p>Rust<br />
C / C++<br />
Python<br />
JavaScript<br />
TypeScript<br />
全栈 Web 开发<br />
甚至可以根据一句自然语言描述，直接完成完整应用程序开发。</p>
<p>例如官方演示：</p>
<p>制作一个精美的宇宙和太阳系模拟程序。模拟速度应可调节，并包含逼真的运动、轨道和恒星。使用 Three.js 开发。界面设计应美观，并符合现代设计原则。</p>
<p>即使只有这一句话，Grok 4.5 依然能够生成：</p>
<p>精美 UI<br />
完整 Three.js 场景<br />
可调节模拟速度<br />
行星轨道动画<br />
完整可运行项目<br />
真正实现从 Prompt 到完整应用程序的一站式开发。</p>
<p>速度比 Fast Model 更快<br />
除了性能之外，Grok 4.5 的生成速度同样值得关注。</p>
<p>官方数据显示：</p>
<p>最高可达到 80 TPS（Tokens Per Second）<br />
属于快速模型级别<br />
Token 效率相比上一代提升约 2 倍<br />
意味着：</p>
<p>响应速度更快<br />
推理效率更高<br />
使用成本更低<br />
对于需要长上下文生成或复杂代码开发的用户来说，体验会更加流畅。</p>
<p>Grok Build：不仅会写代码，还会办公<br />
目前，Grok 4.5 已成为 Grok Build 的默认模型。</p>
<p>除了编程之外，它还能够处理大量办公场景。</p>
<p>例如：</p>
<p>构建复杂 Excel 模型<br />
网络数据搜索<br />
多工作表公式<br />
自动添加备注和批注<br />
对于数据分析人员来说，可以直接让 AI 构建完整的数据模型。</p>
<p>PowerPoint 和 Word 同样表现优秀<br />
在 Office 办公方面，Grok 4.5 也进行了专门优化。</p>
<p>它能够：</p>
<p>使用 PowerPoint 原生形状绘图<br />
自动制作流程图<br />
设计现代化幻灯片<br />
撰写 Word 文档<br />
输出结构清晰的报告<br />
例如，可以直接输入：</p>
<p>帮我制作一份包含 5 张幻灯片的季度业务回顾（Quarterly Business Review）报告。</p>
<p>Grok Build 就能够自动完成：</p>
<p>幻灯片布局<br />
图表设计<br />
内容排版<br />
文案撰写<br />
大幅提升办公效率。</p>
<p>目前已免费开放体验<br />
目前，Grok 4.5 已在免费套餐中开放试用。</p>
<p>只需要：</p>
<p>X（Twitter）账户<br />
或 Grok 账户<br />
即可免费体验 Grok Build。</p>
<p>另外，官方还限时开放：</p>
<p>Grok Build<br />
Cursor<br />
中的 Grok 4.5 使用权限。</p>
<p>CLI 安装方式<br />
如果希望通过命令行体验 Grok，可以安装官方 CLI。</p>
<p>Windows PowerShell<br />
irm <a href="https://x.ai/cli/install.ps1">https://x.ai/cli/install.ps1</a> | iex<br />
PowerShell<br />
Copy<br />
Linux / macOS / WSL<br />
curl -fsSL <a href="https://x.ai/cli/install.sh">https://x.ai/cli/install.sh</a> | bash<br />
JavaScript<br />
Copy<br />
从目前官方公布的信息来看，Grok 4.5 的提升主要集中在以下几个方面：</p>
<p>更强的软件工程能力<br />
更优秀的代码生成质量<br />
更完善的强化学习训练<br />
更快的推理速度（最高 80 TPS）<br />
Grok Build 默认模型<br />
更强的 Office 办公能力<br />
免费开放体验<br />
如果你平时主要用于编程、AI Agent 开发、自动化办公或知识工作，那么 Grok 4.5 值得体验一下。</p>
<p>当然，目前文章中的大部分性能数据均来自 xAI 官方发布的系统配置卡、官方博客及公开基准测试结果。不同模型在实际使用中的表现，还会受到测试任务、提示词设计以及具体应用场景的影响，建议大家结合自己的工作需求进行实际体验与评估。</p>
<p>视频教程：<a href="https://www.youtube.com/watch?v=MMx4k3emXHk">https://www.youtube.com/watch?v=MMx4k3emXHk</a></p>]]></description>
    <pubDate>Wed, 22 Jul 2026 00:35:28 +0800</pubDate>
    <dc:creator>🔔小小站长</dc:creator>
    <guid>https://www.flying6.eu.org/?post=3</guid>
</item>
</channel>
</rss>