新书推介:《语义网技术体系》
作者:瞿裕忠,胡伟,程龚
   >>中国XML论坛<<     W3CHINA.ORG讨论区     计算机科学论坛     SOAChina论坛     Blog     开放翻译计划     新浪微博  
 
  • 首页
  • 登录
  • 注册
  • 软件下载
  • 资料下载
  • 核心成员
  • 帮助
  •   Add to Google

    >> 本版讨论DOM, SAX, XPath等。
    [返回] 中文XML论坛 - 专业的XML技术讨论区XML.ORG.CN讨论区 - XML技术『 DOM/SAX/XPath 』 → 采用dom读取xml,不同版本系统出现的乱码不一样。 查看新帖用户列表

      发表一个新主题  发表一个新投票  回复主题  (订阅本版) 您是本帖的第 3869 个阅读者浏览上一篇主题  刷新本主题   树形显示贴子 浏览下一篇主题
     * 贴子主题: 采用dom读取xml,不同版本系统出现的乱码不一样。 举报  打印  推荐  IE收藏夹 
       本主题类别:     
     oceansky 帅哥哟,离线,有人找我吗?
      
      
      等级:大一新生
      文章:0
      积分:52
      门派:XML.ORG.CN
      注册:2007/3/20

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给oceansky发送一个短消息 把oceansky加入好友 查看oceansky的个人资料 搜索oceansky在『 DOM/SAX/XPath 』的所有贴子 引用回复这个贴子 回复这个贴子 查看oceansky的博客楼主
    发贴心情 采用dom读取xml,不同版本系统出现的乱码不一样。

    读取xml数据回来乱码啊。
    在中文系统中读到M的三次方乱码,但在英文版中读到就是u上面有两点的字符出现乱码。
    要读取的网络文件是:http://xml2.tip-ex.com/feed/aliases.php?pid=1000
    我试过几种方式,比如new String(str.getBytes("iso8859-1"),"utf-8"),都没办法解决。
    package Xml;

    import javax.xml.parsers.*;
    import org.w3c.dom.*;
    import java.io.*;
    import java.util.Collection;
    import java.net.URL;
    import java.net.URLConnection;
    import java.util.TreeSet;

    public class TeamXml {
        public TeamXml() {
        }
    //解释并获得联赛队名的别名数据
        public Collection getTeam(String file) {
            TreeSet teamList = new TreeSet();
            try {
                DocumentBuilderFactory factory = DocumentBuilderFactory.newInstance();
                DocumentBuilder builder = factory.newDocumentBuilder();
                //解析XML文件
                URL sohu = new URL(file);
                URLConnection sh = sohu.openConnection();
                InputStream in = sh.getInputStream();
                Document document = builder.parse(in);
                in.close();
                //去掉XML文档中空白部分
                document.normalize();
                //获取根节点并打印根节点的名称
                Element root = document.getDocumentElement();
                NodeList teams = root.getElementsByTagName("aliases");
                //遍历NodeList
                for (int i = 0; i < teams.getLength(); i++) {
                    Element team = (Element) teams.item(i);
                    NodeList nleas=team.getElementsByTagName("alias");
                    for(int j=0; j<nleas.getLength(); j++){
                       try{
                           String str=team.getElementsByTagName("alias").item(j).
                                       getFirstChild().getNodeValue();
                            teamList.add(str);
                            system.out.printn(str)//此处写出有乱码
                      }catch(Exception e){
                            continue;
                      }
                    }
                }
            } catch (Exception e) {
                e.printStackTrace();
            }
            return teamList;
        }
    }


       收藏   分享  
    顶(0)
      




    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2007/3/20 19:12:00
     
     GoogleAdSense
      
      
      等级:大一新生
      文章:1
      积分:50
      门派:无门无派
      院校:未填写
      注册:2007-01-01
    给Google AdSense发送一个短消息 把Google AdSense加入好友 查看Google AdSense的个人资料 搜索Google AdSense在『 DOM/SAX/XPath 』的所有贴子 访问Google AdSense的主页 引用回复这个贴子 回复这个贴子 查看Google AdSense的博客广告
    2025/7/5 6:48:21

    本主题贴数1,分页: [1]

    管理选项修改tag | 锁定 | 解锁 | 提升 | 删除 | 移动 | 固顶 | 总固顶 | 奖励 | 惩罚 | 发布公告
    W3C Contributing Supporter! W 3 C h i n a ( since 2003 ) 旗 下 站 点
    苏ICP备05006046号《全国人大常委会关于维护互联网安全的决定》《计算机信息网络国际联网安全保护管理办法》
    265.625ms