生成式AI
15 published articles
AI 视频生成
阿里巴巴 Wan3.0 按秒出售视频:30秒片段6美元
Wan3.0 可以将 PDF 或品牌演示文稿在一次生成中变成 30 秒视频,API 按秒计费,1080P 最高每秒 0.20 美元。我们拆解了每段视频的成本,以及阿里巴巴在自测中承认的不足。
2026-08-16
视频生成
MiniMax 放弃其成熟架构,让 H3 包揽一切
MiniMax 表示,H3 将文本、图像、视频和音频生成统一到一个模型中,2K 输出的定价低于主流模型的三分之一,并计划在数日内开放权重。细则才是真正的故事:该公司为了达到这一目标,放弃了自己曾占据优势的架构。
2026-08-07
生成式AI
Pippa为每张图片向艺术家支付0.005美元,但其模型仍在用抓取的艺术作品训练
Pippa承诺,艺术家可从以其风格进行的每一次生成中分得收入:每张图像0.005美元,每秒视频0.003美元,外加5%版税池中的一份分成。目前约有800名订阅用户和四位签约艺术家,且基础模型仍使用抓取内容训练,这一道德主张面临数学上的难题。
2026-08-07
AI视频生成
Wan3.0-Video按秒计费:一条30秒视频收费6美元
阿里巴巴的Wan3.0-Video在DashScope上按秒计费,一条30秒1080P视频每次生成花费6美元。我们解析了定价分层、多输入工作流程,以及该列表未解答的问题。
2026-08-07
构建世界的AI
阿里巴巴HappyOyster:单张图片即可生成可探索的3D世界
阿里巴巴的HappyOyster 1.0是首个主动式实时交互开放世界模型,让开发者和创作者能够通过文本或图片构建可探索的虚拟环境。灰度测试提供了Android、iOS和Web的SDK。
2026-07-24
AI 研究
理解必须先于生成:MiniMax 的新分词器如何打破缩放瓶颈
MiniMax 的 VTP 框架重新思考了视觉分词器的预训练方式,用混合了语义理解的损失替代了纯粹的重建目标。结果是一个随计算量、数据和参数规模扩展的分词器,以及在下游生成任务中 65.8% 的 FID 改进。
2026-07-22
机器学习理论
为什么扩散模型能插值而非简单记忆:创造力的数学理论
谷歌研究人员揭示,扩散模型的创造力源于神经网络正则化引起的“分数平滑”效应。这一理论框架解释了为什么模型在训练数据点之间插值,而非仅仅记忆它们,为可控新颖性的生成式AI开辟了道路。
2026-07-16
AI基础设施
Ollama的“85%财富500强”数据是每家AI供应商正在玩的相同把戏
Ollama 8800万美元融资以“85%的财富500强公司使用”这一数据开头,听起来像是市场饱和,但几乎证明不了什么。本文分析为何这一特定举动已成为AI基础设施融资公告的默认开场白,以及真正推动资金流入开放权重推理的因素。
2026-07-14
Funding round
Ollama 融资 8800 万美元,推动开源模型成为专有 API 的替代方案
Ollama 融资 8800 万美元,用于发展其本地运行开源权重模型的平台,该平台拥有 890 万开发者,并且 85% 的财富 500 强公司都在使用。投资者包括 Benchmark、Theory Ventures、8VC 和 Y Combinator,Docker 创始人 Solomon Hykes 担任顾问。
2026-07-14
透明度
Google广告现强制添加AI标签 执法空白才是真正看点
谷歌在搜索、发现和YouTube上为广告添加“由AI创建或编辑”标签。谷歌自身的AI工具自动标注。其他广告则依靠自律机制。
2026-07-09
人工智能
那个让我重写了三次导语的AI写作生成器
AI写作工具正从拼写检查器演变为合著者,引发了关于原创性、个人风格以及人类重写价值的疑问。
2026-07-09
人工智能
编辑的工作没有消亡,只是变得更难了
AI写作助手正迫使人们对编辑的含义进行一次早该进行的重新定义。这个角色并未消失,而是演变成一种结合了人类判断与机器速度的混合学科。
2026-07-09