-
Seele AI- 全球首个AI生成3D游戏多模态大模型
不会编程也能做3D游戏?这款AI工具让你用文字描述就能创造世界 想做游戏但被编程和建模劝退?有绝妙的游戏创意却苦于没有技术能力实现?现在,只需用文字描述你的想法,AI就能自动生成完整的3D游戏世界——这就是Seele带来的革命性体验。无论是角色设计、场景构建还是玩法机制,统统可以用自然语言搞定,游戏开发从未如此简单。 https://www.seeles.ai 核心功能:一句话生成完整3D游戏 S… -
-
-
Seed-Music:字节跳动推出的AI音乐大模型,支持一键生成高质量歌曲
🎵 Seed-Music:会写歌的AI音乐伙伴,让每个人都是作曲家 想不想让你写的词变成真正的歌曲?Seed-Music就是这样一个神奇的AI音乐生成工具,由字节跳动豆包大模型团队打造。它能把你的歌词、灵感甚至随便哼唱的旋律,变成完整的音乐作品,无论你是音乐小白还是专业制作人,都能用它玩转音乐创作。 官网体验:https://seed.bytedance.com/zh/special/seed-m… -
-
MatterGen:微软推出的无机材料设计AI模型,辅助生成新材料
🔬 材料研发迎来"ChatGPT时刻"!AI三天搞定传统三年实验 还在用"炒菜式"试错法研发新材料?微软研究院推出的MatterGen正在彻底改变游戏规则。这个基于扩散架构的生成式AI模型,能够根据目标属性直接生成新型无机材料结构,把传统需要3年的研发周期压缩到3天。从新能源电池到航空航天材料,它正在颠覆整个材料研发行业。 官方博客:https://www.… -
CogVideoX-智谱推出的开源AI视频生成模型
🔍 CogVideoX是什么? CogVideoX是智谱AI开发的视频生成大模型,只需输入文本或图片就能生成高质量视频。2025年8月开源的CogVideoX-2B是该系列首个模型,参数规模达20亿,与智谱的AI视频产品“清影”同源。它能根据最长226个英文token的提示词,生成6秒、720×480分辨率的视频,推理时显存消耗仅18GB(FP16精度),大幅降低了使用门槛。更强大的版本正在开发中… -
混元DiT-腾讯最新开源的文生图AI模型
混元DiT:腾讯最新开源的文生图AI模型,让AI绘画更简单 混元DiT是腾讯推出的开源文生图模型,基于扩散变换器架构开发,能够根据文字描述快速生成高质量图像。这个模型支持中英文提示词,在人物生成、场景构建等方面表现出色,为开发者和创作者提供了一个强大且易用的AI绘画工具。 官网链接:https://hunyuan.tencent.com/ ✨ 核心功能亮点 高质量图像生成:输入文字描述即可生成细节… -
BangChat-创业邦推出的创投大模型
💡 BangChat:创投圈的"智能军师",让创业找钱不再难! 创业找投资像大海捞针?看不懂市场趋势?BangChat这款由创业邦打造的创投领域智能决策引擎,可能就是你的"创业外脑"。它基于16年创投数据积累,深度融合睿兽分析数据库与AI技术,能帮你智能问答、分析趋势、对接资源——从发现机会到落地执行,全程为你保驾护航。 访问BangChat官网 ✨ 核心功… -
探迹SalesGPT
🔥 探迹SalesGPT:重新定义智能销售的AI黑科技 探迹SalesGPT是探迹科技推出的国内首个销售大模型SaaS产品,专为ToB销售场景打造。它通过AI大模型技术,彻底革新了企业从线索挖掘到客户管理的全流程,让复杂销售工作变得高效又简单!2025年8月,探迹科技还携手讯通展览,用AI赋能大湾区工博会,推动工业供需生态升级。 官网直达:https://www.tungee.com/ 💡 202… -
FLUX.1 Kontext [dev]:Black Forest Labs开源的图像编辑模型
🎨 修图只会用PS?这款AI工具让你用文字就能精准编辑图片 还在为修改图片中的某个细节而头疼吗?FLUX.1 Kontext [dev]正在重新定义图像编辑的方式!这款由Black Forest Labs研发的开源图像编辑模型,基于Flow Transformer架构实现精准的局部修改与多轮迭代。只需要用自然语言描述你想修改的内容,比如"给人物添加牛仔帽"或"将背景替… -
Skywork R1V:昆仑万维开源的多模态视觉思维链推理模型
给AI装上“火眼金睛”:Skywork R1V让机器真正看懂世界 👁️ 想象一下,AI不仅能识别图片中有只猫,还能推断出这只猫的品种、年龄,甚至从背景细节判断出拍摄地点和季节——这就是Skywork R1V带来的革命性突破。这个由昆仑万维开源的多模态视觉推理模型,正在让机器真正具备“看懂”世界的能力。 最新评测显示,R1V在复杂视觉推理任务上的表现已经超越了许多闭源商业模型,其中在数学视觉推理测试… -
Step1X-Edit:阶跃星辰推出的开源图像编辑大模型
告别修图烦恼!Step1X-Edit开源AI图像编辑工具,通过自然语言指令自动换背景、改材质、美颜,保持形象一致性。免费开源,提升创作效率,立即体验专业级编辑。 -
VideoWorld:豆包等推出的开源视频生成模型,从无标签视频中学习知识
VideoWorld:豆包团队研发纯视觉模型,支持工业自动化与医疗培训,学习效率提升300%,开源生态完善,适配PC端长文本处理及移动端快速决策场景。 -
-
新壹视频大模型
🎬 剪视频剪到头疼?这款国产AI让你一句话生成专业视频 还在为视频制作熬夜秃头吗?新壹视频大模型来拯救你了!作为国内首个专注视频内容生成的行业大模型,它深度融合文本理解与多模态处理技术,提供视频摘要生成、语义分析、脚本创作等核心能力。依托海量视频数据训练,精准适配短视频、直播、影视等垂直场景需求,让你用文字就能操控视频。 官网链接:https://yizhenai.com/ai/index.htm… -
Ferret:苹果发布的多模态大语言模型
🚀 Ferret是什么? Ferret是苹果憋了三年放出的“读图界福尔摩斯”——能揪着你的文字描述,在图片里精准定位任何形状的物体!不管是“左下角咬了一口的草莓”还是“窗帘后露出的猫尾巴”,它都能瞬间圈出来。2025年已塞进iOS 18.5系统,7B迷你版跑在iPhone上不卡顿,13B专业版在Mac Studio上玩转设计全流程! GitHub直达:https://github.com/appl… -
Step-Video-T2V:阶跃星辰推出的开源视频生成大模型
Step-Video-T2V是什么? 阶跃星辰与吉利联合开源的高性能视频生成模型,能根据文字描述直接生成540P高清视频。它擅长处理复杂动作(如舞蹈、打斗)、精准控制镜头运动(推拉摇移),并生成细腻的人物表情和皮肤质感,特别适合影视广告、游戏动画等创意领域。 官网体验:https://yuewen.cn/videos 🔥 核心功能亮点 高清长视频生成支持单次生成最长204帧视频(约8秒),分辨率达… -
猎户星空大模型
🚀 猎户星空大模型是什么? 猎户星空大模型(Orion-14B)是专为企业级场景打造的多语言AI模型,2025年最新升级版已支持320K超长上下文和多模态输入。它用2.5万亿token训练出的140亿参数“小巨人”,在千元显卡(如RTX 3060)上每秒能处理50个汉字,被网友称为“平民企业AI神器”! https://www.orionstar.com/llm.html 🔧 六大模型全家桶,按需… -
Phi-3:微软推出的开源小型语言模型,支持移动设备
Phi-4系列是什么? 微软推出的新一代轻量级AI模型,主打“小身材大能量”。包含两款核心产品:Phi-4-Mini(38亿参数,纯文本处理)和Phi-4-Multimodal(多模态模型,支持图文音)。最大亮点是在手机、笔记本等普通设备上就能流畅运行,性能却媲美参数翻倍的大模型,彻底摆脱对云端服务器的依赖。 在线体验地址:https://huggingface.co/chat/models/mi… -
LivePhoto:图片生成动态视频模型
🎬 想让照片动起来?LivePhoto让静态图片秒变动态视频 LivePhoto是一款由阿里巴巴、香港大学和蚂蚁集团联合研发的图片转视频AI模型,基于先进的Stable Diffusion架构,创新性地融合了运动控制技术。它能够将静态图像转换为生动的动态视频,用户只需通过文字指令就能精准控制画面中元素的运动,让照片真正"活"起来。 官网链接:https://xavierchen… -
LongCat-Flash-Chat:美团推出的开源大语言模型
美团开源LongCat大模型:5600亿参数MoE架构,支持128K上下文和智能体任务,免费商用。性能媲美Claude4,适合开发者和企业高效AI应用。立即体验开源模型优势。 -
OmniGen2 – 智源研究院推出的开源多模态生成模型
🎨 OmniGen2:能画会改的AI创意多面手 OmniGen2是北京智源人工智能研究院在2025年6月底推出的开源多模态生成模型,就像一个全能的AI艺术家,既能根据文字描述生成图像,也能精准编辑现有图片,甚至能理解图片内容并进行创意组合。它最大的特点是采用图文解耦架构,就像让AI学会了"分开思考"文字和图像,再巧妙地把它们融合在一起,这让它在处理复杂创意任务时更加得心应手。 … -
MiniMax-M1:MiniMax开源的大规模混合架构推理模型
🚀 MiniMax-M1:全球首个开源混合架构推理模型,百万级上下文处理能力颠覆行业 MiniMax-M1是上海稀宇科技在2025年6月推出的全球首个开源大规模混合架构推理模型,这家伙可不是普通的AI模型,它专门擅长“动脑筋”解决复杂问题。最厉害的是它能处理高达100万token的超长文本,相当于一次性能读完好几本长篇小说的内容,并且还能生成8万token的深度推理结果,在数学推理、代码生成和长文…











![FLUX.1 Kontext [dev]:Black Forest Labs开源的图像编辑模型](https://res.hello123.com/wp-content/uploads/2025/07/20250714140602806.webp)












