图像生成
图像,绘画
震惊硅谷的Kimi K3正式开源!全球Day 0适配
Kimi K3作为全球首个开源的3万亿参数级别混合专家模型正式发布,其编程和智能体能力已逼近顶尖闭源模型,且推理成本大幅降低。该模型不仅开源了完整权重,还...
Claude设计师被工程师卷到掉队,反手造出百万用户工具
Anthropic产品设计师Nate Parrott在Opus 4.5发布后,面对工程师产出激增而设计进度落后的困境,利用业余时间开发了一款辅助工具以提升工作效率。这款最初作为...
从视觉压缩,到视觉记忆:MonkeyOCRv2以重建保留文档页面证据
MonkeyOCRv2 提出了“重建即文档视觉记忆”的核心理念,强调文档视觉编码器在文档智能任务中的决定性作用。受控实验表明,在固定语言模型、训练数据和优化设置...
一年从3B卷到0.xB:MonkeyOCRv2用0.7B拿下17语种文档解析开源第一
文档OCR领域正加速迈入小模型时代,模型参数量不断缩减的同时,性能上限却持续被刷新。MonkeyOCRv2团队推出的0.6B和0.7B参数版本模型,在MDPBench榜单上分别...
Black Forest Labs发布Flux 3!初评超过Seedance 2.0,将开源
黑森林实验室最新发布的新一代模型标志着其从单一图像生成向全面多模态架构的重大进化。该模型将视频、音频及动作预测统一整合,致力于通过同时处理多种感官...
Qwen-Image-3.0效果炸裂?我反手扔了这9道题
阿里近期推出了AI生图新模型Qwen-Image-3.0,该模型主打实用性,旨在满足实际工作需求,其核心优势体现在细节真实、内容丰实和知识厚实三个层面。模型不仅支...
从「视觉生成」到「世界生成」:智象未来三个月融资超 21 亿,跻身独角兽
智象未来近期宣布完成15亿元C轮融资,估值突破10亿美元,正式成为独角兽企业。本轮融资由社保基金、工银资本等国家级资本领投,多地国资及头部影视公司跟投,...
现场直击:高昂真机成本锁死具身进化,Google 科学家用视频世界模型破局|RSS 2026
具身智能领域正面临现实世界中高昂交互与试错成本的核心困境,这成为阻碍机器人通往通用人工智能的最大瓶颈。为解决这一问题,研究人员提出利用可控的视频生...
1nm后的芯片技术
未来几年内实现1纳米以下芯片的前景正变得越来越现实,这推动了新型工艺技术的发展。为降低极紫外光刻系统的成本和体积,研究人员开发出桌面式极紫外光刻设备...
Meshy 完成近 4 亿美元 B 轮,AI 3D 为什么能长出一家百亿公司
AI 3D生成公司Meshy近期完成近4亿美元B轮融资,投后估值超百亿元人民币,刷新了该领域迄今规模最大的单轮融资纪录。在众多AI创业公司仍依赖融资维持运转时,...




