← 返回名录
条目信息来自其公开主页与公开发布内容。按本站规范,页面不展示任何联系方式。 需要更正或删除?通过收录与更正通道提交,24 小时内处理。
Haoze Zheng
PhD Student at Fudan University, working on Multimodal LLMs, Unified Multimodal Models, AI Agents, and trustworthy, reliable reasoning and evaluation.
- 公司
- Fudan University
- 位置
- Tianjin,China
- Stars
- 287
- 粉丝 / 仓库
- 14
代表作品 / 项目
- VisionForge⭐ 62VisionForge是一个轻量级、高扩展性的大模型图片训练&描述工具生成器,支持多家大模型API(Google、OpenAI 兼容、DeepSeek、Qwen、GLM、Claude、Doubao、自定义模型)。 它提供多图片上传、提示词优化、自动生成JSONL训练数据、多项信息分析(标签、OCR、场景分类、主色调、置信度、推理原因)等能力。 支持实时统计图表(置信度分布直方图与趋势曲线),适用于AI数据集制作、图像训练样本生成、遥感标注、计算机视觉模型预处理等场景。
- Chinese-985-teachers-AI-and-computer-science-faculty-member-⭐ 15本项目详细整理了中国985大学所有人工智能,计算机,电子信息,机器人等信息工科方向的老师的个人网页并提供了爬取脚本,可配合该项目中”生成名单_deepseek.py“脚本自动结合老师个人网页,学生个人简历生成老师的简要介绍,近几年学术成果总结,以及保研套磁优先级(低/中/高),并随后可以结合该项目中的"send_email.py"自动编写套磁信并进行发送(默认为163邮箱),为保研er提供便利。(完整版本将在10月后发布)
- VideoToNotes⭐ 13VideoToNotes(视频直接变学习笔记)是一款面向学生与自学人群的学习效率工具:输入一个YouTube链接或本地视频文件,它会自动获取字幕/转写出带时间戳的文本,识别主题切换点并切分成结构化章节,再把每个章节提炼成“可复习”的学习笔记要点(概念、定义、结论、因果逻辑与步骤),同时附上时间戳方便一键回看验证。最终输出一份清晰的Markdown笔记,包含章节化Notes与3–5条Key Takeaways,帮助用户把“看完视频”变成“真正学会、随时能复习”。
- EchoAgent⭐ 10EchoAgent超越了传统LLM的问答范式,引入“界面感知认知”概念。它不仅能进行对话,更能通过长期记忆构建用户技术画像,并在识别到复杂工程挑战时,主动编写代码来扩展自身能力。 系统由三个核心视图构成:Chat(交互): 提供流式对话体验,负责实时信息的输入与反馈。Memory(认知): 实时分析对话流,将碎片化信息沉淀为结构化的长期记忆、技术图谱与用户偏好模型,实现对上下文的深度理解。Evolve(进化): 核心特性。打破对话框限制,赋予AI代码级的自我重构权限。关于“自我进化”:当系统检测到用户面临的是系统性架构难题而非单一代码错误时,它会主动触发进化流程:深度洞察、架构设计、全栈实现、自我反思。EchoAgent最终交付的不是文本建议,而是经过设计与验证的可运行代码解决方案。
- Next-AI-PlantUML⭐ 10Next AI PlantUML是一个基于PlantUML的AI辅助平台,旨在降低PlantUML的学习与使用门槛,并弥补其只能通过代码修改图形、缺乏交互能力的不足。该项目支持通过输入自然语言和图片自动生成规范的PlantUML代码,并真实调用官方PlantUML服务完成渲染,同时在不破坏声明式特性的前提下,引入基础的可视化布局调整能力,将拖动、间距和尺寸等操作自动转换为可维护的PlantUML布局约束代码。此外,系统还提供AI对生成的图自动分析并给出优化建议,以及内置的PlantUML教学模块,支持类图、时序图、用例图、组件图、活动图、状态图、部署图、ER图、C4架构图等多种工程常用图类型,是你快速做图完成作业以及科研项目需求的好帮手,致力于让PlantUML更易用、更高效、更智能。